CAMD: Coverage-Aware Multimodal Decoding for Efficient Reasoning of Multimodal Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Guo, Huijie, Wang, Jingyao, Si, Lingyu, Zhou, Jiahuan, Zheng, Changwen, Qiang, Wenwen |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Towards Generalizable Reasoning: Group Causal Counterfactual Policy Optimization for LLM Reasoning
by: Wang, Jingyao, et al.
Published: (2026)
by: Wang, Jingyao, et al.
Published: (2026)
On the Plasticity and Stability for Post-Training Large Language Models
by: Qiang, Wenwen, et al.
Published: (2026)
by: Qiang, Wenwen, et al.
Published: (2026)
Rethinking Multi-Modal Learning from Gradient Uncertainty
by: Guo, Peizheng, et al.
Published: (2025)
by: Guo, Peizheng, et al.
Published: (2025)
A Generalized Learning Framework for Self-Supervised Contrastive Learning
by: Si, Lingyu, et al.
Published: (2025)
by: Si, Lingyu, et al.
Published: (2025)
Exploring Transferability of Self-Supervised Learning by Task Conflict Calibration
by: Guo, Huijie, et al.
Published: (2025)
by: Guo, Huijie, et al.
Published: (2025)
Enhancing Large Language Models for Time-Series Forecasting via Vector-Injected In-Context Learning
by: Zhang, Jianqi, et al.
Published: (2026)
by: Zhang, Jianqi, et al.
Published: (2026)
Neuromodulated Meta-Learning
by: Wang, Jingyao, et al.
Published: (2024)
by: Wang, Jingyao, et al.
Published: (2024)
Group Causal Policy Optimization for Post-Training Large Language Models
by: Gu, Ziyin, et al.
Published: (2025)
by: Gu, Ziyin, et al.
Published: (2025)
Reward Model Generalization for Compute-Aware Test-Time Reasoning
by: Song, Zeen, et al.
Published: (2025)
by: Song, Zeen, et al.
Published: (2025)
On the Out-of-Distribution Generalization of Self-Supervised Learning
by: Qiang, Wenwen, et al.
Published: (2025)
by: Qiang, Wenwen, et al.
Published: (2025)
Learning to Think: Information-Theoretic Reinforcement Fine-Tuning for LLMs
by: Wang, Jingyao, et al.
Published: (2025)
by: Wang, Jingyao, et al.
Published: (2025)
Spatio-Temporal Fuzzy-oriented Multi-Modal Meta-Learning for Fine-grained Emotion Recognition
by: Wang, Jingyao, et al.
Published: (2024)
by: Wang, Jingyao, et al.
Published: (2024)
Adaptive Uncertainty-Aware Tree Search for Robust Reasoning
by: Song, Zeen, et al.
Published: (2026)
by: Song, Zeen, et al.
Published: (2026)
On the Universality of Self-Supervised Learning
by: Qiang, Wenwen, et al.
Published: (2024)
by: Qiang, Wenwen, et al.
Published: (2024)
Rethinking Meta-Learning from a Learning Lens
by: Wang, Jingyao, et al.
Published: (2024)
by: Wang, Jingyao, et al.
Published: (2024)
PAPO-VLA: Planning-Aware Policy Optimization for Vision-Language-Action Models
by: Guo, Peizheng, et al.
Published: (2026)
by: Guo, Peizheng, et al.
Published: (2026)
Hacking Task Confounder in Meta-Learning
by: Wang, Jingyao, et al.
Published: (2023)
by: Wang, Jingyao, et al.
Published: (2023)
AwesomeMeta+: A Mixed-Prototyping Meta-Learning System Supporting AI Application Design Anywhere
by: Wang, Jingyao, et al.
Published: (2023)
by: Wang, Jingyao, et al.
Published: (2023)
Not All Frequencies Are Created Equal:Towards a Dynamic Fusion of Frequencies in Time-Series Forecasting
by: Zhang, Xingyu, et al.
Published: (2024)
by: Zhang, Xingyu, et al.
Published: (2024)
Towards Task Sampler Learning for Meta-Learning
by: Wang, Jingyao, et al.
Published: (2023)
by: Wang, Jingyao, et al.
Published: (2023)
Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction
by: Song, Ruike, et al.
Published: (2025)
by: Song, Ruike, et al.
Published: (2025)
Towards the Causal Complete Cause of Multi-Modal Representation Learning
by: Wang, Jingyao, et al.
Published: (2024)
by: Wang, Jingyao, et al.
Published: (2024)
On the Transferability and Discriminability of Repersentation Learning in Unsupervised Domain Adaptation
by: Qiang, Wenwen, et al.
Published: (2025)
by: Qiang, Wenwen, et al.
Published: (2025)
COPO: Causal-Oriented Policy Optimization for Hallucinations of MLLMs
by: Guo, Peizheng, et al.
Published: (2025)
by: Guo, Peizheng, et al.
Published: (2025)
SinkRouter: Sink-Aware Routing for Efficient Long-Context Decoding in Large Language and Multimodal Models
by: Liu, Junnan, et al.
Published: (2026)
by: Liu, Junnan, et al.
Published: (2026)
Doubly Debiased Test-Time Prompt Tuning for Vision-Language Models
by: Song, Fei, et al.
Published: (2025)
by: Song, Fei, et al.
Published: (2025)
On Speculative Decoding for Multimodal Large Language Models
by: Gagrani, Mukul, et al.
Published: (2024)
by: Gagrani, Mukul, et al.
Published: (2024)
Understanding Token-level Topological Structures in Transformer-based Time Series Forecasting
by: Zhang, Jianqi, et al.
Published: (2024)
by: Zhang, Jianqi, et al.
Published: (2024)
Decoupling Contrastive Decoding: Robust Hallucination Mitigation in Multimodal Large Language Models
by: Chen, Wei, et al.
Published: (2025)
by: Chen, Wei, et al.
Published: (2025)
Causal Decoding for Hallucination-Resistant Multimodal Large Language Models
by: Tan, Shiwei, et al.
Published: (2026)
by: Tan, Shiwei, et al.
Published: (2026)
Advancing Complex Wide-Area Scene Understanding with Hierarchical Coresets Selection
by: Wang, Jingyao, et al.
Published: (2025)
by: Wang, Jingyao, et al.
Published: (2025)
Multimodal Large Language Models for Multi-Subject In-Context Image Generation
by: Zhou, Yucheng, et al.
Published: (2026)
by: Zhou, Yucheng, et al.
Published: (2026)
Enhancing Time Series Forecasting via Logic-Inspired Regularization
by: Zhang, Jianqi, et al.
Published: (2025)
by: Zhang, Jianqi, et al.
Published: (2025)
Closing the Loop: A Control-Theoretic Framework for Provably Stable Time Series Forecasting with LLMs
by: Zhang, Xingyu, et al.
Published: (2026)
by: Zhang, Xingyu, et al.
Published: (2026)
Beyond All-to-All: Causal-Aligned Transformer with Dynamic Structure Learning for Multivariate Time Series Forecasting
by: Zhang, Xingyu, et al.
Published: (2025)
by: Zhang, Xingyu, et al.
Published: (2025)
Causal Prompt Calibration Guided Segment Anything Model for Open-Vocabulary Multi-Entity Segmentation
by: Wang, Jingyao, et al.
Published: (2025)
by: Wang, Jingyao, et al.
Published: (2025)
Visual-Redundancy-Controlled Parallel Decoding for Diffusion-Based Multimodal Large Language Models
by: Yuan, Yulin, et al.
Published: (2026)
by: Yuan, Yulin, et al.
Published: (2026)
MoPE: Mixture of Prompt Experts for Parameter-Efficient and Scalable Multimodal Fusion
by: Jiang, Ruixiang, et al.
Published: (2024)
by: Jiang, Ruixiang, et al.
Published: (2024)
Efficient Table Retrieval and Understanding with Multimodal Large Language Models
by: Xu, Zhuoyan, et al.
Published: (2026)
by: Xu, Zhuoyan, et al.
Published: (2026)
Towards Reasoning-Preserving Unlearning in Multimodal Large Language Models
by: Li, Hongji, et al.
Published: (2025)
by: Li, Hongji, et al.
Published: (2025)
Similar Items
-
Towards Generalizable Reasoning: Group Causal Counterfactual Policy Optimization for LLM Reasoning
by: Wang, Jingyao, et al.
Published: (2026) -
On the Plasticity and Stability for Post-Training Large Language Models
by: Qiang, Wenwen, et al.
Published: (2026) -
Rethinking Multi-Modal Learning from Gradient Uncertainty
by: Guo, Peizheng, et al.
Published: (2025) -
A Generalized Learning Framework for Self-Supervised Contrastive Learning
by: Si, Lingyu, et al.
Published: (2025) -
Exploring Transferability of Self-Supervised Learning by Task Conflict Calibration
by: Guo, Huijie, et al.
Published: (2025)