Visual-Redundancy-Controlled Parallel Decoding for Diffusion-Based Multimodal Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Yuan, Yulin, Zhao, Hongshuo, Meng, Xiangming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Diffusion Model Based Posterior Sampling for Noisy Linear Inverse Problems
di: Meng, Xiangming, et al.
Pubblicazione: (2022)
di: Meng, Xiangming, et al.
Pubblicazione: (2022)
AlloyBERT: Alloy Property Prediction with Large Language Models
di: Chaudhari, Akshat, et al.
Pubblicazione: (2024)
di: Chaudhari, Akshat, et al.
Pubblicazione: (2024)
Free Draft-and-Verification: Toward Lossless Parallel Decoding for Diffusion Large Language Models
di: Wu, Shutong, et al.
Pubblicazione: (2025)
di: Wu, Shutong, et al.
Pubblicazione: (2025)
ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
di: Li, Jia-Nan, et al.
Pubblicazione: (2025)
Locally Coherent Parallel Decoding in Diffusion Language Models
di: Hersche, Michael, et al.
Pubblicazione: (2026)
di: Hersche, Michael, et al.
Pubblicazione: (2026)
From Bits to Rounds: Parallel Decoding with Exploration for Diffusion Language Models
di: Fu, Hengyu, et al.
Pubblicazione: (2025)
di: Fu, Hengyu, et al.
Pubblicazione: (2025)
Decoding Large Language Diffusion Models with Foreseeing Movement
di: Mo, Yichuan, et al.
Pubblicazione: (2025)
di: Mo, Yichuan, et al.
Pubblicazione: (2025)
QCM-SGM+: Improved Quantized Compressed Sensing With Score-Based Generative Models
di: Meng, Xiangming, et al.
Pubblicazione: (2023)
di: Meng, Xiangming, et al.
Pubblicazione: (2023)
Beyond Frequency: The Role of Redundancy in Large Language Model Memorization
di: Zhang, Jie, et al.
Pubblicazione: (2025)
di: Zhang, Jie, et al.
Pubblicazione: (2025)
SAIP: A Plug-and-Play Scale-adaptive Module in Diffusion-based Inverse Problems
di: Wang, Lingyu, et al.
Pubblicazione: (2025)
di: Wang, Lingyu, et al.
Pubblicazione: (2025)
ParallelBench: Understanding the Trade-offs of Parallel Decoding in Diffusion LLMs
di: Kang, Wonjun, et al.
Pubblicazione: (2025)
di: Kang, Wonjun, et al.
Pubblicazione: (2025)
CAMD: Coverage-Aware Multimodal Decoding for Efficient Reasoning of Multimodal Large Language Models
di: Guo, Huijie, et al.
Pubblicazione: (2026)
di: Guo, Huijie, et al.
Pubblicazione: (2026)
On Speculative Decoding for Multimodal Large Language Models
di: Gagrani, Mukul, et al.
Pubblicazione: (2024)
di: Gagrani, Mukul, et al.
Pubblicazione: (2024)
Asymmetric Adaptation-based Real-time Fault Diagnosis Under Transitional Operating Conditions
di: Zhao, Hongshuo, et al.
Pubblicazione: (2026)
di: Zhao, Hongshuo, et al.
Pubblicazione: (2026)
Fast-Slow Efficient Training for Multimodal Large Language Models via Visual Token Pruning
di: Zhang, Dingkun, et al.
Pubblicazione: (2026)
di: Zhang, Dingkun, et al.
Pubblicazione: (2026)
Improving Decoupled Posterior Sampling for Inverse Problems using Data Consistency Constraint
di: Qi, Zhi, et al.
Pubblicazione: (2024)
di: Qi, Zhi, et al.
Pubblicazione: (2024)
Heterogeneous Parallelism for Multimodal Large Language Model Training
di: Karnati, Yashaswi, et al.
Pubblicazione: (2026)
di: Karnati, Yashaswi, et al.
Pubblicazione: (2026)
Decoupling Contrastive Decoding: Robust Hallucination Mitigation in Multimodal Large Language Models
di: Chen, Wei, et al.
Pubblicazione: (2025)
di: Chen, Wei, et al.
Pubblicazione: (2025)
Generation Order and Parallel Decoding in Masked Diffusion Models: An Information-Theoretic Perspective
di: Zhang, Shaorong, et al.
Pubblicazione: (2026)
di: Zhang, Shaorong, et al.
Pubblicazione: (2026)
Collaborative Large Language Model Inference via Resource-Aware Parallel Speculative Decoding
di: Koh, Jungyeon, et al.
Pubblicazione: (2025)
di: Koh, Jungyeon, et al.
Pubblicazione: (2025)
Lossless Acceleration of Large Language Model via Adaptive N-gram Parallel Decoding
di: Ou, Jie, et al.
Pubblicazione: (2024)
di: Ou, Jie, et al.
Pubblicazione: (2024)
Plan, Verify and Fill: A Structured Parallel Decoding Approach for Diffusion Language Models
di: Li, Miao, et al.
Pubblicazione: (2026)
di: Li, Miao, et al.
Pubblicazione: (2026)
GQLA: Group-Query Latent Attention for Hardware-Adaptive Large Language Model Decoding
di: Meng, Fanxu
Pubblicazione: (2026)
di: Meng, Fanxu
Pubblicazione: (2026)
ConVis: Contrastive Decoding with Hallucination Visualization for Mitigating Hallucinations in Multimodal Large Language Models
di: Park, Yeji, et al.
Pubblicazione: (2024)
di: Park, Yeji, et al.
Pubblicazione: (2024)
Robust Multi-Objective Controlled Decoding of Large Language Models
di: Son, Seongho, et al.
Pubblicazione: (2025)
di: Son, Seongho, et al.
Pubblicazione: (2025)
DAPD: Dependency-Aware Parallel Decoding via Attention for Diffusion LLMs
di: Kim, Bumjun, et al.
Pubblicazione: (2026)
di: Kim, Bumjun, et al.
Pubblicazione: (2026)
Bridging Visualization and Optimization: Multimodal Large Language Models on Graph-Structured Combinatorial Optimization
di: Zhao, Jie, et al.
Pubblicazione: (2025)
di: Zhao, Jie, et al.
Pubblicazione: (2025)
Causal Decoding for Hallucination-Resistant Multimodal Large Language Models
di: Tan, Shiwei, et al.
Pubblicazione: (2026)
di: Tan, Shiwei, et al.
Pubblicazione: (2026)
Discrete Diffusion in Large Language and Multimodal Models: A Survey
di: Yu, Runpeng, et al.
Pubblicazione: (2025)
di: Yu, Runpeng, et al.
Pubblicazione: (2025)
Multimodal ELBO with Diffusion Decoders
di: Wesego, Daniel, et al.
Pubblicazione: (2024)
di: Wesego, Daniel, et al.
Pubblicazione: (2024)
RAD: Redundancy-Aware Distillation for Hybrid Models via Self-Speculative Decoding
di: Hoshino, Yuichiro, et al.
Pubblicazione: (2025)
di: Hoshino, Yuichiro, et al.
Pubblicazione: (2025)
$R^2$-dLLM: Accelerating Diffusion Large Language Models via Spatio-Temporal Redundancy Reduction
di: Du, Zhenbang, et al.
Pubblicazione: (2026)
di: Du, Zhenbang, et al.
Pubblicazione: (2026)
Confidence-Based Decoding is Provably Efficient for Diffusion Language Models
di: Cai, Changxiao, et al.
Pubblicazione: (2026)
di: Cai, Changxiao, et al.
Pubblicazione: (2026)
Stability-Weighted Decoding for Diffusion Language Models
di: Wu, Yue, et al.
Pubblicazione: (2026)
di: Wu, Yue, et al.
Pubblicazione: (2026)
Predictive Regularization Against Visual Representation Degradation in Multimodal Large Language Models
di: Wang, Enguang, et al.
Pubblicazione: (2026)
di: Wang, Enguang, et al.
Pubblicazione: (2026)
dgMARK: Decoding-Guided Watermarking for Diffusion Language Models
di: Hong, Pyo Min, et al.
Pubblicazione: (2026)
di: Hong, Pyo Min, et al.
Pubblicazione: (2026)
TraceDet: Hallucination Detection from the Decoding Trace of Diffusion Large Language Models
di: Chang, Shenxu, et al.
Pubblicazione: (2025)
di: Chang, Shenxu, et al.
Pubblicazione: (2025)
Generation Meets Verification: Accelerating Large Language Model Inference with Smart Parallel Auto-Correct Decoding
di: Yi, Hanling, et al.
Pubblicazione: (2024)
di: Yi, Hanling, et al.
Pubblicazione: (2024)
Diffusion Language Models are Provably Optimal Parallel Samplers
di: Jiang, Haozhe, et al.
Pubblicazione: (2025)
di: Jiang, Haozhe, et al.
Pubblicazione: (2025)
RobotDiffuse: Diffusion-Based Motion Planning for Redundant Manipulators with the ROP Obstacle Avoidance Dataset
di: Mou, Xudong, et al.
Pubblicazione: (2024)
di: Mou, Xudong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Diffusion Model Based Posterior Sampling for Noisy Linear Inverse Problems
di: Meng, Xiangming, et al.
Pubblicazione: (2022) -
AlloyBERT: Alloy Property Prediction with Large Language Models
di: Chaudhari, Akshat, et al.
Pubblicazione: (2024) -
Free Draft-and-Verification: Toward Lossless Parallel Decoding for Diffusion Large Language Models
di: Wu, Shutong, et al.
Pubblicazione: (2025) -
ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
di: Li, Jia-Nan, et al.
Pubblicazione: (2025) -
Locally Coherent Parallel Decoding in Diffusion Language Models
di: Hersche, Michael, et al.
Pubblicazione: (2026)