Semantic Communication-Enabled Cloud-Edge-End-collaborative Metaverse Services Architecure
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Yuxuan, Jinag, Sheng, Wang, Bizhu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Wireless Video Semantic Communication with Decoupled Diffusion Multi-frame Compensation
par: Xie, Bingyan, et autres
Publié: (2025)
par: Xie, Bingyan, et autres
Publié: (2025)
Edge Learning via Federated Split Decision Transformers for Metaverse Resource Allocation
par: Temiz, Fatih, et autres
Publié: (2026)
par: Temiz, Fatih, et autres
Publié: (2026)
Generative Semantic Communication: Diffusion Models Beyond Bit Recovery
par: Grassucci, Eleonora, et autres
Publié: (2023)
par: Grassucci, Eleonora, et autres
Publié: (2023)
End-to-End Learning-based Video Streaming Enhancement Pipeline: A Generative AI Approach
par: Artioli, Emanuele, et autres
Publié: (2025)
par: Artioli, Emanuele, et autres
Publié: (2025)
EVER: Edge-Assisted Auto-Verification for Mobile MR-Aided Operation
par: Chen, Jiangong, et autres
Publié: (2025)
par: Chen, Jiangong, et autres
Publié: (2025)
Semantic-Guided Unsupervised Video Summarization
par: Liu, Haizhou, et autres
Publié: (2026)
par: Liu, Haizhou, et autres
Publié: (2026)
Towards Open-Vocabulary Video Semantic Segmentation
par: Li, Xinhao, et autres
Publié: (2024)
par: Li, Xinhao, et autres
Publié: (2024)
Open-Vocabulary Audio-Visual Semantic Segmentation
par: Guo, Ruohao, et autres
Publié: (2024)
par: Guo, Ruohao, et autres
Publié: (2024)
Multimodal Emotion Recognition by Fusing Video Semantic in MOOC Learning Scenarios
par: Zhang, Yuan, et autres
Publié: (2024)
par: Zhang, Yuan, et autres
Publié: (2024)
SEER: Semantic Enhancement and Emotional Reasoning Network for Multimodal Fake News Detection
par: Zhu, Peican, et autres
Publié: (2025)
par: Zhu, Peican, et autres
Publié: (2025)
AMB-DSGDN: Adaptive Modality-Balanced Dynamic Semantic Graph Differential Network for Multimodal Emotion Recognition
par: Wang, Yunsheng, et autres
Publié: (2026)
par: Wang, Yunsheng, et autres
Publié: (2026)
Real-Time Mobile Video Analytics for Pre-arrival Emergency Medical Services
par: Jin, Liuyi, et autres
Publié: (2025)
par: Jin, Liuyi, et autres
Publié: (2025)
Semantic Communication Enabled Holographic Video Processing and Transmission
par: Ying, Jingkai, et autres
Publié: (2025)
par: Ying, Jingkai, et autres
Publié: (2025)
Conquering High Packet-Loss Erasure: MoE Swin Transformer-Based Video Semantic Communication
par: Teng, Lei, et autres
Publié: (2025)
par: Teng, Lei, et autres
Publié: (2025)
Adaptive Social Metaverse Streaming based on Federated Multi-Agent Deep Reinforcement Learning
par: Long, Zijian, et autres
Publié: (2025)
par: Long, Zijian, et autres
Publié: (2025)
DualComp: End-to-End Learning of a Unified Dual-Modality Lossless Compressor
par: Zhao, Yan, et autres
Publié: (2025)
par: Zhao, Yan, et autres
Publié: (2025)
Why We Feel: Breaking Boundaries in Emotional Reasoning with Multimodal Large Language Models
par: Lin, Yuxiang, et autres
Publié: (2025)
par: Lin, Yuxiang, et autres
Publié: (2025)
Unsupervised Multimodal Clustering for Semantics Discovery in Multimodal Utterances
par: Zhang, Hanlei, et autres
Publié: (2024)
par: Zhang, Hanlei, et autres
Publié: (2024)
LLM-Guided Semantic Relational Reasoning for Multimodal Intent Recognition
par: Zhou, Qianrui, et autres
Publié: (2025)
par: Zhou, Qianrui, et autres
Publié: (2025)
When Harmful Content Gets Camouflaged: Unveiling Perception Failure of LVLMs with CamHarmTI
par: Li, Yanhui, et autres
Publié: (2025)
par: Li, Yanhui, et autres
Publié: (2025)
LiveK12Bench: Have Large Multimodal Models Truly Conquered High School-level Examinations?
par: Wang, Xiaohan, et autres
Publié: (2026)
par: Wang, Xiaohan, et autres
Publié: (2026)
End-to-End Optimized Image Compression with the Frequency-Oriented Transform
par: Zhang, Yuefeng, et autres
Publié: (2024)
par: Zhang, Yuefeng, et autres
Publié: (2024)
Semantic Item Graph Enhancement for Multimodal Recommendation
par: Zhang, Xiaoxiong, et autres
Publié: (2025)
par: Zhang, Xiaoxiong, et autres
Publié: (2025)
End-to-end Semantic-centric Video-based Multimodal Affective Computing
par: Lin, Ronghao, et autres
Publié: (2024)
par: Lin, Ronghao, et autres
Publié: (2024)
WorldGPT: Empowering LLM as Multimodal World Model
par: Ge, Zhiqi, et autres
Publié: (2024)
par: Ge, Zhiqi, et autres
Publié: (2024)
Evaluating the Impact of Point Cloud Colorization on Semantic Segmentation Accuracy
par: Zhu, Qinfeng, et autres
Publié: (2024)
par: Zhu, Qinfeng, et autres
Publié: (2024)
A Multi-modal Fusion Network for Terrain Perception Based on Illumination Aware
par: Wang, Rui, et autres
Publié: (2025)
par: Wang, Rui, et autres
Publié: (2025)
QMAVIS: Long Video-Audio Understanding using Fusion of Large Multimodal Models
par: Lin, Zixing, et autres
Publié: (2026)
par: Lin, Zixing, et autres
Publié: (2026)
Chinese-LiPS: A Chinese audio-visual speech recognition dataset with Lip-reading and Presentation Slides
par: Zhao, Jinghua, et autres
Publié: (2025)
par: Zhao, Jinghua, et autres
Publié: (2025)
MultimodalHugs: Enabling Sign Language Processing in Hugging Face
par: Sant, Gerard, et autres
Publié: (2025)
par: Sant, Gerard, et autres
Publié: (2025)
Differential Multimodal Transformers
par: Li, Jerry, et autres
Publié: (2025)
par: Li, Jerry, et autres
Publié: (2025)
TIP and Polish: Text-Image-Prototype Guided Multi-Modal Generation via Commonality-Discrepancy Modeling and Refinement
par: Ma, Zhiyong, et autres
Publié: (2025)
par: Ma, Zhiyong, et autres
Publié: (2025)
The Dream Within Huang Long Cave: AI-Driven Interactive Narrative for Family Storytelling and Emotional Reflection
par: Huang, Jiayang, et autres
Publié: (2025)
par: Huang, Jiayang, et autres
Publié: (2025)
LLMER: Crafting Interactive Extended Reality Worlds with JSON Data Generated by Large Language Models
par: Chen, Jiangong, et autres
Publié: (2025)
par: Chen, Jiangong, et autres
Publié: (2025)
Synthesizing Sentiment-Controlled Feedback For Multimodal Text and Image Data
par: Kumar, Puneet, et autres
Publié: (2024)
par: Kumar, Puneet, et autres
Publié: (2024)
Enhancing Multimodal Retrieval via Complementary Information Extraction and Alignment
par: Zeng, Delong, et autres
Publié: (2026)
par: Zeng, Delong, et autres
Publié: (2026)
A Survey on Multimodal Benchmarks: In the Era of Large AI Models
par: Li, Lin, et autres
Publié: (2024)
par: Li, Lin, et autres
Publié: (2024)
HumanVLM: Foundation for Human-Scene Vision-Language Model
par: Dai, Dawei, et autres
Publié: (2024)
par: Dai, Dawei, et autres
Publié: (2024)
MaLoRA: Gated Modality LoRA for Key-Space Alignment in Multimodal LLM Fine-Tuning
par: Zheng, Xinhan, et autres
Publié: (2025)
par: Zheng, Xinhan, et autres
Publié: (2025)
RA-BLIP: Multimodal Adaptive Retrieval-Augmented Bootstrapping Language-Image Pre-training
par: Ding, Muhe, et autres
Publié: (2024)
par: Ding, Muhe, et autres
Publié: (2024)
Documents similaires
-
Wireless Video Semantic Communication with Decoupled Diffusion Multi-frame Compensation
par: Xie, Bingyan, et autres
Publié: (2025) -
Edge Learning via Federated Split Decision Transformers for Metaverse Resource Allocation
par: Temiz, Fatih, et autres
Publié: (2026) -
Generative Semantic Communication: Diffusion Models Beyond Bit Recovery
par: Grassucci, Eleonora, et autres
Publié: (2023) -
End-to-End Learning-based Video Streaming Enhancement Pipeline: A Generative AI Approach
par: Artioli, Emanuele, et autres
Publié: (2025) -
EVER: Edge-Assisted Auto-Verification for Mobile MR-Aided Operation
par: Chen, Jiangong, et autres
Publié: (2025)