Generative Semantic Communication: Diffusion Models Beyond Bit Recovery
Fuente:
arXiv
Salvato in:
| Autori principali: | Grassucci, Eleonora, Barbarossa, Sergio, Comminiello, Danilo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Controllable Audio-Visual Viewpoint Generation from 360° Spatial Information
di: Marinoni, Christian, et al.
Pubblicazione: (2025)
di: Marinoni, Christian, et al.
Pubblicazione: (2025)
A TRIANGLE Enables Multimodal Alignment Beyond Cosine Similarity
di: Cicchetti, Giordano, et al.
Pubblicazione: (2025)
di: Cicchetti, Giordano, et al.
Pubblicazione: (2025)
Multi-View Hypercomplex Learning for Breast Cancer Screening
di: Lopez, Eleonora, et al.
Pubblicazione: (2022)
di: Lopez, Eleonora, et al.
Pubblicazione: (2022)
Wireless Video Semantic Communication with Decoupled Diffusion Multi-frame Compensation
di: Xie, Bingyan, et al.
Pubblicazione: (2025)
di: Xie, Bingyan, et al.
Pubblicazione: (2025)
Generative AI Meets Semantic Communication: Evolution and Revolution of Communication Tasks
di: Grassucci, Eleonora, et al.
Pubblicazione: (2024)
di: Grassucci, Eleonora, et al.
Pubblicazione: (2024)
FoleyGRAM: Video-to-Audio Generation with GRAM-Aligned Multimodal Encoders
di: Gramaccioni, Riccardo Fosco, et al.
Pubblicazione: (2025)
di: Gramaccioni, Riccardo Fosco, et al.
Pubblicazione: (2025)
Lightweight Diffusion Models for Resource-Constrained Semantic Communication
di: Pignata, Giovanni, et al.
Pubblicazione: (2024)
di: Pignata, Giovanni, et al.
Pubblicazione: (2024)
Semantic Communication-Enabled Cloud-Edge-End-collaborative Metaverse Services Architecure
di: Li, Yuxuan, et al.
Pubblicazione: (2025)
di: Li, Yuxuan, et al.
Pubblicazione: (2025)
Gramian Multimodal Representation Learning and Alignment
di: Cicchetti, Giordano, et al.
Pubblicazione: (2024)
di: Cicchetti, Giordano, et al.
Pubblicazione: (2024)
Semantic-Guided Unsupervised Video Summarization
di: Liu, Haizhou, et al.
Pubblicazione: (2026)
di: Liu, Haizhou, et al.
Pubblicazione: (2026)
Open-Vocabulary Audio-Visual Semantic Segmentation
di: Guo, Ruohao, et al.
Pubblicazione: (2024)
di: Guo, Ruohao, et al.
Pubblicazione: (2024)
Towards Open-Vocabulary Video Semantic Segmentation
di: Li, Xinhao, et al.
Pubblicazione: (2024)
di: Li, Xinhao, et al.
Pubblicazione: (2024)
D3PIA: A Discrete Denoising Diffusion Model for Piano Accompaniment Generation From Lead sheet
di: Choi, Eunjin, et al.
Pubblicazione: (2026)
di: Choi, Eunjin, et al.
Pubblicazione: (2026)
On Copyright Risks of Text-to-Image Diffusion Models
di: Zhang, Yang, et al.
Pubblicazione: (2023)
di: Zhang, Yang, et al.
Pubblicazione: (2023)
Multimodal Emotion Recognition by Fusing Video Semantic in MOOC Learning Scenarios
di: Zhang, Yuan, et al.
Pubblicazione: (2024)
di: Zhang, Yuan, et al.
Pubblicazione: (2024)
Language-Oriented Semantic Latent Representation for Image Transmission
di: Cicchetti, Giordano, et al.
Pubblicazione: (2024)
di: Cicchetti, Giordano, et al.
Pubblicazione: (2024)
SEER: Semantic Enhancement and Emotional Reasoning Network for Multimodal Fake News Detection
di: Zhu, Peican, et al.
Pubblicazione: (2025)
di: Zhu, Peican, et al.
Pubblicazione: (2025)
DRAGON: Distributional Rewards Optimize Diffusion Generative Models
di: Bai, Yatong, et al.
Pubblicazione: (2025)
di: Bai, Yatong, et al.
Pubblicazione: (2025)
MaXsive: High-Capacity and Robust Training-Free Generative Image Watermarking in Diffusion Models
di: Mao, Po-Yuan, et al.
Pubblicazione: (2025)
di: Mao, Po-Yuan, et al.
Pubblicazione: (2025)
Conquering High Packet-Loss Erasure: MoE Swin Transformer-Based Video Semantic Communication
di: Teng, Lei, et al.
Pubblicazione: (2025)
di: Teng, Lei, et al.
Pubblicazione: (2025)
LLMER: Crafting Interactive Extended Reality Worlds with JSON Data Generated by Large Language Models
di: Chen, Jiangong, et al.
Pubblicazione: (2025)
di: Chen, Jiangong, et al.
Pubblicazione: (2025)
ProAV-DiT: A Projected Latent Diffusion Transformer for Efficient Synchronized Audio-Video Generation
di: Sun, Jiahui, et al.
Pubblicazione: (2025)
di: Sun, Jiahui, et al.
Pubblicazione: (2025)
Attention of a Kiss: Exploring Attention Maps in Video Diffusion for XAIxArts
di: Cole, Adam, et al.
Pubblicazione: (2025)
di: Cole, Adam, et al.
Pubblicazione: (2025)
TIP and Polish: Text-Image-Prototype Guided Multi-Modal Generation via Commonality-Discrepancy Modeling and Refinement
di: Ma, Zhiyong, et al.
Pubblicazione: (2025)
di: Ma, Zhiyong, et al.
Pubblicazione: (2025)
Live Music Diffusion Models: Efficient Fine-Tuning and Post-Training of Interactive Diffusion Music Generators
di: Novack, Zachary, et al.
Pubblicazione: (2026)
di: Novack, Zachary, et al.
Pubblicazione: (2026)
Bernini: Latent Semantic Planning for Video Diffusion
di: Bernini Team, et al.
Pubblicazione: (2026)
di: Bernini Team, et al.
Pubblicazione: (2026)
Watermarking Visual Concepts for Diffusion Models
di: Lei, Liangqi, et al.
Pubblicazione: (2024)
di: Lei, Liangqi, et al.
Pubblicazione: (2024)
Beyond Answers: How LLMs Can Pursue Strategic Thinking in Education
di: Grassucci, Eleonora, et al.
Pubblicazione: (2025)
di: Grassucci, Eleonora, et al.
Pubblicazione: (2025)
HCVR Scene Generation: High Compatibility Virtual Reality Environment Generation for Extended Redirected Walking
di: Zhang, Yiran, et al.
Pubblicazione: (2026)
di: Zhang, Yiran, et al.
Pubblicazione: (2026)
Optimization-Free Universal Watermark Forgery with Regenerative Diffusion Models
di: Zhu, Chaoyi, et al.
Pubblicazione: (2025)
di: Zhu, Chaoyi, et al.
Pubblicazione: (2025)
Towards Automatic Soccer Commentary Generation with Knowledge-Enhanced Visual Reasoning
di: Jin, Zeyu, et al.
Pubblicazione: (2026)
di: Jin, Zeyu, et al.
Pubblicazione: (2026)
AniME: Adaptive Multi-Agent Planning for Long Animation Generation
di: Zhang, Lisai, et al.
Pubblicazione: (2025)
di: Zhang, Lisai, et al.
Pubblicazione: (2025)
AMB-DSGDN: Adaptive Modality-Balanced Dynamic Semantic Graph Differential Network for Multimodal Emotion Recognition
di: Wang, Yunsheng, et al.
Pubblicazione: (2026)
di: Wang, Yunsheng, et al.
Pubblicazione: (2026)
Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation
di: Yu, Lijun, et al.
Pubblicazione: (2023)
di: Yu, Lijun, et al.
Pubblicazione: (2023)
End-to-End Learning-based Video Streaming Enhancement Pipeline: A Generative AI Approach
di: Artioli, Emanuele, et al.
Pubblicazione: (2025)
di: Artioli, Emanuele, et al.
Pubblicazione: (2025)
Beyond Spurious Signals: Debiasing Multimodal Large Language Models via Counterfactual Inference and Adaptive Expert Routing
di: Wu, Zichen, et al.
Pubblicazione: (2025)
di: Wu, Zichen, et al.
Pubblicazione: (2025)
Modeling Human Responses to Multimodal AI Content
di: Shen, Zhiqi, et al.
Pubblicazione: (2025)
di: Shen, Zhiqi, et al.
Pubblicazione: (2025)
WorldGPT: Empowering LLM as Multimodal World Model
di: Ge, Zhiqi, et al.
Pubblicazione: (2024)
di: Ge, Zhiqi, et al.
Pubblicazione: (2024)
A Survey of Generative Categories and Techniques in Multimodal Generative Models
di: Han, Longzhen, et al.
Pubblicazione: (2025)
di: Han, Longzhen, et al.
Pubblicazione: (2025)
Semantic Item Graph Enhancement for Multimodal Recommendation
di: Zhang, Xiaoxiong, et al.
Pubblicazione: (2025)
di: Zhang, Xiaoxiong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Controllable Audio-Visual Viewpoint Generation from 360° Spatial Information
di: Marinoni, Christian, et al.
Pubblicazione: (2025) -
A TRIANGLE Enables Multimodal Alignment Beyond Cosine Similarity
di: Cicchetti, Giordano, et al.
Pubblicazione: (2025) -
Multi-View Hypercomplex Learning for Breast Cancer Screening
di: Lopez, Eleonora, et al.
Pubblicazione: (2022) -
Wireless Video Semantic Communication with Decoupled Diffusion Multi-frame Compensation
di: Xie, Bingyan, et al.
Pubblicazione: (2025) -
Generative AI Meets Semantic Communication: Evolution and Revolution of Communication Tasks
di: Grassucci, Eleonora, et al.
Pubblicazione: (2024)