Visual-Redundancy-Controlled Parallel Decoding for Diffusion-Based Multimodal Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yuan, Yulin, Zhao, Hongshuo, Meng, Xiangming |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Diffusion Model Based Posterior Sampling for Noisy Linear Inverse Problems
von: Meng, Xiangming, et al.
Veröffentlicht: (2022)
von: Meng, Xiangming, et al.
Veröffentlicht: (2022)
AlloyBERT: Alloy Property Prediction with Large Language Models
von: Chaudhari, Akshat, et al.
Veröffentlicht: (2024)
von: Chaudhari, Akshat, et al.
Veröffentlicht: (2024)
Free Draft-and-Verification: Toward Lossless Parallel Decoding for Diffusion Large Language Models
von: Wu, Shutong, et al.
Veröffentlicht: (2025)
von: Wu, Shutong, et al.
Veröffentlicht: (2025)
ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
von: Li, Jia-Nan, et al.
Veröffentlicht: (2025)
von: Li, Jia-Nan, et al.
Veröffentlicht: (2025)
Locally Coherent Parallel Decoding in Diffusion Language Models
von: Hersche, Michael, et al.
Veröffentlicht: (2026)
von: Hersche, Michael, et al.
Veröffentlicht: (2026)
From Bits to Rounds: Parallel Decoding with Exploration for Diffusion Language Models
von: Fu, Hengyu, et al.
Veröffentlicht: (2025)
von: Fu, Hengyu, et al.
Veröffentlicht: (2025)
Decoding Large Language Diffusion Models with Foreseeing Movement
von: Mo, Yichuan, et al.
Veröffentlicht: (2025)
von: Mo, Yichuan, et al.
Veröffentlicht: (2025)
QCM-SGM+: Improved Quantized Compressed Sensing With Score-Based Generative Models
von: Meng, Xiangming, et al.
Veröffentlicht: (2023)
von: Meng, Xiangming, et al.
Veröffentlicht: (2023)
Beyond Frequency: The Role of Redundancy in Large Language Model Memorization
von: Zhang, Jie, et al.
Veröffentlicht: (2025)
von: Zhang, Jie, et al.
Veröffentlicht: (2025)
SAIP: A Plug-and-Play Scale-adaptive Module in Diffusion-based Inverse Problems
von: Wang, Lingyu, et al.
Veröffentlicht: (2025)
von: Wang, Lingyu, et al.
Veröffentlicht: (2025)
ParallelBench: Understanding the Trade-offs of Parallel Decoding in Diffusion LLMs
von: Kang, Wonjun, et al.
Veröffentlicht: (2025)
von: Kang, Wonjun, et al.
Veröffentlicht: (2025)
CAMD: Coverage-Aware Multimodal Decoding for Efficient Reasoning of Multimodal Large Language Models
von: Guo, Huijie, et al.
Veröffentlicht: (2026)
von: Guo, Huijie, et al.
Veröffentlicht: (2026)
On Speculative Decoding for Multimodal Large Language Models
von: Gagrani, Mukul, et al.
Veröffentlicht: (2024)
von: Gagrani, Mukul, et al.
Veröffentlicht: (2024)
Asymmetric Adaptation-based Real-time Fault Diagnosis Under Transitional Operating Conditions
von: Zhao, Hongshuo, et al.
Veröffentlicht: (2026)
von: Zhao, Hongshuo, et al.
Veröffentlicht: (2026)
Fast-Slow Efficient Training for Multimodal Large Language Models via Visual Token Pruning
von: Zhang, Dingkun, et al.
Veröffentlicht: (2026)
von: Zhang, Dingkun, et al.
Veröffentlicht: (2026)
Improving Decoupled Posterior Sampling for Inverse Problems using Data Consistency Constraint
von: Qi, Zhi, et al.
Veröffentlicht: (2024)
von: Qi, Zhi, et al.
Veröffentlicht: (2024)
Heterogeneous Parallelism for Multimodal Large Language Model Training
von: Karnati, Yashaswi, et al.
Veröffentlicht: (2026)
von: Karnati, Yashaswi, et al.
Veröffentlicht: (2026)
Decoupling Contrastive Decoding: Robust Hallucination Mitigation in Multimodal Large Language Models
von: Chen, Wei, et al.
Veröffentlicht: (2025)
von: Chen, Wei, et al.
Veröffentlicht: (2025)
Generation Order and Parallel Decoding in Masked Diffusion Models: An Information-Theoretic Perspective
von: Zhang, Shaorong, et al.
Veröffentlicht: (2026)
von: Zhang, Shaorong, et al.
Veröffentlicht: (2026)
Collaborative Large Language Model Inference via Resource-Aware Parallel Speculative Decoding
von: Koh, Jungyeon, et al.
Veröffentlicht: (2025)
von: Koh, Jungyeon, et al.
Veröffentlicht: (2025)
Lossless Acceleration of Large Language Model via Adaptive N-gram Parallel Decoding
von: Ou, Jie, et al.
Veröffentlicht: (2024)
von: Ou, Jie, et al.
Veröffentlicht: (2024)
Plan, Verify and Fill: A Structured Parallel Decoding Approach for Diffusion Language Models
von: Li, Miao, et al.
Veröffentlicht: (2026)
von: Li, Miao, et al.
Veröffentlicht: (2026)
GQLA: Group-Query Latent Attention for Hardware-Adaptive Large Language Model Decoding
von: Meng, Fanxu
Veröffentlicht: (2026)
von: Meng, Fanxu
Veröffentlicht: (2026)
ConVis: Contrastive Decoding with Hallucination Visualization for Mitigating Hallucinations in Multimodal Large Language Models
von: Park, Yeji, et al.
Veröffentlicht: (2024)
von: Park, Yeji, et al.
Veröffentlicht: (2024)
Robust Multi-Objective Controlled Decoding of Large Language Models
von: Son, Seongho, et al.
Veröffentlicht: (2025)
von: Son, Seongho, et al.
Veröffentlicht: (2025)
DAPD: Dependency-Aware Parallel Decoding via Attention for Diffusion LLMs
von: Kim, Bumjun, et al.
Veröffentlicht: (2026)
von: Kim, Bumjun, et al.
Veröffentlicht: (2026)
Bridging Visualization and Optimization: Multimodal Large Language Models on Graph-Structured Combinatorial Optimization
von: Zhao, Jie, et al.
Veröffentlicht: (2025)
von: Zhao, Jie, et al.
Veröffentlicht: (2025)
Causal Decoding for Hallucination-Resistant Multimodal Large Language Models
von: Tan, Shiwei, et al.
Veröffentlicht: (2026)
von: Tan, Shiwei, et al.
Veröffentlicht: (2026)
Discrete Diffusion in Large Language and Multimodal Models: A Survey
von: Yu, Runpeng, et al.
Veröffentlicht: (2025)
von: Yu, Runpeng, et al.
Veröffentlicht: (2025)
Multimodal ELBO with Diffusion Decoders
von: Wesego, Daniel, et al.
Veröffentlicht: (2024)
von: Wesego, Daniel, et al.
Veröffentlicht: (2024)
RAD: Redundancy-Aware Distillation for Hybrid Models via Self-Speculative Decoding
von: Hoshino, Yuichiro, et al.
Veröffentlicht: (2025)
von: Hoshino, Yuichiro, et al.
Veröffentlicht: (2025)
$R^2$-dLLM: Accelerating Diffusion Large Language Models via Spatio-Temporal Redundancy Reduction
von: Du, Zhenbang, et al.
Veröffentlicht: (2026)
von: Du, Zhenbang, et al.
Veröffentlicht: (2026)
Confidence-Based Decoding is Provably Efficient for Diffusion Language Models
von: Cai, Changxiao, et al.
Veröffentlicht: (2026)
von: Cai, Changxiao, et al.
Veröffentlicht: (2026)
Stability-Weighted Decoding for Diffusion Language Models
von: Wu, Yue, et al.
Veröffentlicht: (2026)
von: Wu, Yue, et al.
Veröffentlicht: (2026)
Predictive Regularization Against Visual Representation Degradation in Multimodal Large Language Models
von: Wang, Enguang, et al.
Veröffentlicht: (2026)
von: Wang, Enguang, et al.
Veröffentlicht: (2026)
dgMARK: Decoding-Guided Watermarking for Diffusion Language Models
von: Hong, Pyo Min, et al.
Veröffentlicht: (2026)
von: Hong, Pyo Min, et al.
Veröffentlicht: (2026)
TraceDet: Hallucination Detection from the Decoding Trace of Diffusion Large Language Models
von: Chang, Shenxu, et al.
Veröffentlicht: (2025)
von: Chang, Shenxu, et al.
Veröffentlicht: (2025)
Generation Meets Verification: Accelerating Large Language Model Inference with Smart Parallel Auto-Correct Decoding
von: Yi, Hanling, et al.
Veröffentlicht: (2024)
von: Yi, Hanling, et al.
Veröffentlicht: (2024)
Diffusion Language Models are Provably Optimal Parallel Samplers
von: Jiang, Haozhe, et al.
Veröffentlicht: (2025)
von: Jiang, Haozhe, et al.
Veröffentlicht: (2025)
RobotDiffuse: Diffusion-Based Motion Planning for Redundant Manipulators with the ROP Obstacle Avoidance Dataset
von: Mou, Xudong, et al.
Veröffentlicht: (2024)
von: Mou, Xudong, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Diffusion Model Based Posterior Sampling for Noisy Linear Inverse Problems
von: Meng, Xiangming, et al.
Veröffentlicht: (2022) -
AlloyBERT: Alloy Property Prediction with Large Language Models
von: Chaudhari, Akshat, et al.
Veröffentlicht: (2024) -
Free Draft-and-Verification: Toward Lossless Parallel Decoding for Diffusion Large Language Models
von: Wu, Shutong, et al.
Veröffentlicht: (2025) -
ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
von: Li, Jia-Nan, et al.
Veröffentlicht: (2025) -
Locally Coherent Parallel Decoding in Diffusion Language Models
von: Hersche, Michael, et al.
Veröffentlicht: (2026)