TokenCom: Vision-Language Model for Multimodal and Multitask Token Communications
Fuente:
arXiv
Salvato in:
| Autori principali: | Jiang, Feibo, Tu, Siwei, Dong, Li, Li, Xiaolong, Wang, Kezhi, Pan, Cunhua, Han, Zhu, Wang, Jiangzhou |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Lightweight Vision Model-based Multi-user Semantic Communication Systems
di: Jiang, Feibo, et al.
Pubblicazione: (2025)
di: Jiang, Feibo, et al.
Pubblicazione: (2025)
Visual Language Model based Cross-modal Semantic Communication Systems
di: Jiang, Feibo, et al.
Pubblicazione: (2024)
di: Jiang, Feibo, et al.
Pubblicazione: (2024)
M4SC: An MLLM-based Multi-modal, Multi-task and Multi-user Semantic Communication System
di: Jiang, Feibo, et al.
Pubblicazione: (2025)
di: Jiang, Feibo, et al.
Pubblicazione: (2025)
Large Generative Model-assisted Talking-face Semantic Communication System
di: Jiang, Feibo, et al.
Pubblicazione: (2024)
di: Jiang, Feibo, et al.
Pubblicazione: (2024)
CommGPT: A Graph and Retrieval-Augmented Multimodal Communication Foundation Model
di: Jiang, Feibo, et al.
Pubblicazione: (2025)
di: Jiang, Feibo, et al.
Pubblicazione: (2025)
Agentic AI Empowered Multi-UAV Trajectory Optimization in Low-Altitude Economy Networks
di: Jiang, Feibo, et al.
Pubblicazione: (2025)
di: Jiang, Feibo, et al.
Pubblicazione: (2025)
A Comprehensive Survey of Large AI Models for Future Communications: Foundations, Applications and Challenges
di: Jiang, Feibo, et al.
Pubblicazione: (2025)
di: Jiang, Feibo, et al.
Pubblicazione: (2025)
Aerial Agentic AI: Synergizing LLM and SLM for Low-Altitude Wireless Networks
di: Dong, Li, et al.
Pubblicazione: (2026)
di: Dong, Li, et al.
Pubblicazione: (2026)
Large Generative Model Assisted 3D Semantic Communication
di: Jiang, Feibo, et al.
Pubblicazione: (2024)
di: Jiang, Feibo, et al.
Pubblicazione: (2024)
Video TokenCom: Textual Intent-Guided Multi-Rate Video Token Communications with UEP-Based Adaptive Source-Channel Coding
di: Men, Jingxuan, et al.
Pubblicazione: (2026)
di: Men, Jingxuan, et al.
Pubblicazione: (2026)
Magic Tokens: Select Diverse Tokens for Multi-modal Object Re-Identification
di: Zhang, Pingping, et al.
Pubblicazione: (2024)
di: Zhang, Pingping, et al.
Pubblicazione: (2024)
Robust Cross-Domain WiFi Fall Detection via Physics-Driven Attention-Enhanced Transformers
di: Wang, Yingzhe, et al.
Pubblicazione: (2026)
di: Wang, Yingzhe, et al.
Pubblicazione: (2026)
Wireless TokenCom: RL-Based Tokenizer Agreement for Multi-User Wireless Token Communications
di: Zeinali, Farshad, et al.
Pubblicazione: (2026)
di: Zeinali, Farshad, et al.
Pubblicazione: (2026)
WiFi-based Cross-Domain Gesture Recognition Using Attention Mechanism
di: Liu, Ruijing, et al.
Pubblicazione: (2025)
di: Liu, Ruijing, et al.
Pubblicazione: (2025)
Personalized Wireless Federated Learning for Large Language Models
di: Jiang, Feibo, et al.
Pubblicazione: (2024)
di: Jiang, Feibo, et al.
Pubblicazione: (2024)
Evolving Token Communication with Parametric Memory Network
di: Chen, Weixuan, et al.
Pubblicazione: (2026)
di: Chen, Weixuan, et al.
Pubblicazione: (2026)
Large AI Model Empowered Multimodal Semantic Communications
di: Jiang, Feibo, et al.
Pubblicazione: (2023)
di: Jiang, Feibo, et al.
Pubblicazione: (2023)
Personalized Federated Learning for Generative AI-Assisted Semantic Communications
di: Peng, Yubo, et al.
Pubblicazione: (2024)
di: Peng, Yubo, et al.
Pubblicazione: (2024)
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
di: Wang, Xinhao, et al.
Pubblicazione: (2026)
di: Wang, Xinhao, et al.
Pubblicazione: (2026)
RAVEN: Multitask Retrieval Augmented Vision-Language Learning
di: Rao, Varun Nagaraj, et al.
Pubblicazione: (2024)
di: Rao, Varun Nagaraj, et al.
Pubblicazione: (2024)
TokenCarve: Information-Preserving Visual Token Compression in Multimodal Large Language Models
di: Tan, Xudong, et al.
Pubblicazione: (2025)
di: Tan, Xudong, et al.
Pubblicazione: (2025)
Dynamic Token Reweighting for Robust Vision-Language Models
di: Jiang, Tanqiu, et al.
Pubblicazione: (2025)
di: Jiang, Tanqiu, et al.
Pubblicazione: (2025)
VisionSelector: End-to-End Learnable Visual Token Compression for Efficient Multimodal LLMs
di: Zhu, Jiaying, et al.
Pubblicazione: (2025)
di: Zhu, Jiaying, et al.
Pubblicazione: (2025)
Beyond Next-Token Alignment: Distilling Multimodal Large Language Models via Token Interactions
di: Chen, Lin, et al.
Pubblicazione: (2026)
di: Chen, Lin, et al.
Pubblicazione: (2026)
Multimodal Latent Language Modeling with Next-Token Diffusion
di: Sun, Yutao, et al.
Pubblicazione: (2024)
di: Sun, Yutao, et al.
Pubblicazione: (2024)
Accelerating Multimodal Large Language Models by Searching Optimal Vision Token Reduction
di: Zhao, Shiyu, et al.
Pubblicazione: (2024)
di: Zhao, Shiyu, et al.
Pubblicazione: (2024)
GAI-Enabled Explainable Personalized Federated Semi-Supervised Learning
di: Peng, Yubo, et al.
Pubblicazione: (2024)
di: Peng, Yubo, et al.
Pubblicazione: (2024)
Accurate and Scalable Multimodal Pathology Retrieval via Attentive Vision-Language Alignment
di: Wang, Hongyi, et al.
Pubblicazione: (2025)
di: Wang, Hongyi, et al.
Pubblicazione: (2025)
TokenCompose: Text-to-Image Diffusion with Token-level Supervision
di: Wang, Zirui, et al.
Pubblicazione: (2023)
di: Wang, Zirui, et al.
Pubblicazione: (2023)
Object-Centric Vision Token Pruning for Vision Language Models
di: Li, Guangyuan, et al.
Pubblicazione: (2025)
di: Li, Guangyuan, et al.
Pubblicazione: (2025)
HybridToken-VLM: Hybrid Token Compression for Vision-Language Models
di: Zhang, Jusheng, et al.
Pubblicazione: (2025)
di: Zhang, Jusheng, et al.
Pubblicazione: (2025)
TONIC: Token-Centric Semantic Communication for Task-Oriented Wireless Systems
di: Liu, Sige, et al.
Pubblicazione: (2026)
di: Liu, Sige, et al.
Pubblicazione: (2026)
Token Communications: A Large Model-Driven Framework for Cross-modal Context-aware Semantic Communications
di: Qiao, Li, et al.
Pubblicazione: (2025)
di: Qiao, Li, et al.
Pubblicazione: (2025)
EM-KD: Distilling Efficient Multimodal Large Language Model with Unbalanced Vision Tokens
di: Feng, Ze, et al.
Pubblicazione: (2025)
di: Feng, Ze, et al.
Pubblicazione: (2025)
Explainable Semantic Federated Learning Enabled Industrial Edge Network for Fire Surveillance
di: Dong, Li, et al.
Pubblicazione: (2024)
di: Dong, Li, et al.
Pubblicazione: (2024)
UniCompress: Token Compression for Unified Vision-Language Understanding and Generation
di: Wang, Ziyao, et al.
Pubblicazione: (2026)
di: Wang, Ziyao, et al.
Pubblicazione: (2026)
Grounding Everything in Tokens for Multimodal Large Language Models
di: Ren, Xiangxuan, et al.
Pubblicazione: (2025)
di: Ren, Xiangxuan, et al.
Pubblicazione: (2025)
AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning
di: Zhang, Kai, et al.
Pubblicazione: (2025)
di: Zhang, Kai, et al.
Pubblicazione: (2025)
MADTP: Multimodal Alignment-Guided Dynamic Token Pruning for Accelerating Vision-Language Transformer
di: Cao, Jianjian, et al.
Pubblicazione: (2024)
di: Cao, Jianjian, et al.
Pubblicazione: (2024)
From Large AI Models to Agentic AI: A Tutorial on Future Intelligent Communications
di: Jiang, Feibo, et al.
Pubblicazione: (2025)
di: Jiang, Feibo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Lightweight Vision Model-based Multi-user Semantic Communication Systems
di: Jiang, Feibo, et al.
Pubblicazione: (2025) -
Visual Language Model based Cross-modal Semantic Communication Systems
di: Jiang, Feibo, et al.
Pubblicazione: (2024) -
M4SC: An MLLM-based Multi-modal, Multi-task and Multi-user Semantic Communication System
di: Jiang, Feibo, et al.
Pubblicazione: (2025) -
Large Generative Model-assisted Talking-face Semantic Communication System
di: Jiang, Feibo, et al.
Pubblicazione: (2024) -
CommGPT: A Graph and Retrieval-Augmented Multimodal Communication Foundation Model
di: Jiang, Feibo, et al.
Pubblicazione: (2025)