Wide-In, Narrow-Out: Revokable Decoding for Efficient and Effective DLLMs
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Hong, Feng, Yu, Geng, Ye, Yushi, Huang, Haicheng, Zheng, Huangjie, Zhang, Ya, Wang, Yanfeng, Yao, Jiangchao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Rejection Mixing: Fast Semantic Propagation of Mask Tokens for Efficient DLLM Inference
von: Ye, Yushi, et al.
Veröffentlicht: (2026)
von: Ye, Yushi, et al.
Veröffentlicht: (2026)
Roll Out and Roll Back: Diffusion LLMs are Their Own Efficiency Teachers
von: Zeng, Fanqin, et al.
Veröffentlicht: (2026)
von: Zeng, Fanqin, et al.
Veröffentlicht: (2026)
FOCUS: DLLMs Know How to Tame Their Compute Bound
von: Liang, Kaihua, et al.
Veröffentlicht: (2026)
von: Liang, Kaihua, et al.
Veröffentlicht: (2026)
Eliciting Medical Reasoning with Knowledge-enhanced Data Synthesis: A Semi-Supervised Reinforcement Learning Approach
von: Li, Haolin, et al.
Veröffentlicht: (2026)
von: Li, Haolin, et al.
Veröffentlicht: (2026)
TAIA: Large Language Models are Out-of-Distribution Data Learners
von: Jiang, Shuyang, et al.
Veröffentlicht: (2024)
von: Jiang, Shuyang, et al.
Veröffentlicht: (2024)
Learning to Instruct for Visual Instruction Tuning
von: Zhou, Zhihan, et al.
Veröffentlicht: (2025)
von: Zhou, Zhihan, et al.
Veröffentlicht: (2025)
Simulate and Eliminate: Revoke Backdoors for Generative Large Language Models
von: Li, Haoran, et al.
Veröffentlicht: (2024)
von: Li, Haoran, et al.
Veröffentlicht: (2024)
Towards Building Multilingual Language Model for Medicine
von: Qiu, Pengcheng, et al.
Veröffentlicht: (2024)
von: Qiu, Pengcheng, et al.
Veröffentlicht: (2024)
Miner:Mining Intrinsic Mastery for Data-Efficient RL in Large Reasoning Models
von: Jiang, Shuyang, et al.
Veröffentlicht: (2026)
von: Jiang, Shuyang, et al.
Veröffentlicht: (2026)
UniChest: Conquer-and-Divide Pre-training for Multi-Source Chest X-Ray Classification
von: Dai, Tianjie, et al.
Veröffentlicht: (2023)
von: Dai, Tianjie, et al.
Veröffentlicht: (2023)
DSVD: Dynamic Self-Verify Decoding for Faithful Generation in Large Language Models
von: Guo, YiQiu, et al.
Veröffentlicht: (2025)
von: Guo, YiQiu, et al.
Veröffentlicht: (2025)
Neural Search Space in Gboard Decoder
von: Zhang, Yanxiang, et al.
Veröffentlicht: (2024)
von: Zhang, Yanxiang, et al.
Veröffentlicht: (2024)
Guided Score identity Distillation for Data-Free One-Step Text-to-Image Generation
von: Zhou, Mingyuan, et al.
Veröffentlicht: (2024)
von: Zhou, Mingyuan, et al.
Veröffentlicht: (2024)
Towards an End-to-End Framework for Invasive Brain Signal Decoding with Large Language Models
von: Feng, Sheng, et al.
Veröffentlicht: (2024)
von: Feng, Sheng, et al.
Veröffentlicht: (2024)
Self-Calibrated Tuning of Vision-Language Models for Out-of-Distribution Detection
von: Yu, Geng, et al.
Veröffentlicht: (2024)
von: Yu, Geng, et al.
Veröffentlicht: (2024)
Diversified Batch Selection for Training Acceleration
von: Hong, Feng, et al.
Veröffentlicht: (2024)
von: Hong, Feng, et al.
Veröffentlicht: (2024)
Efficient and Effective Internal Memory Retrieval for LLM-Based Healthcare Prediction
von: Li, Mingchen, et al.
Veröffentlicht: (2026)
von: Li, Mingchen, et al.
Veröffentlicht: (2026)
G4Seg: Generation for Inexact Segmentation Refinement with Diffusion Models
von: Zhang, Tianjiao, et al.
Veröffentlicht: (2025)
von: Zhang, Tianjiao, et al.
Veröffentlicht: (2025)
Dual-granularity Sinkhorn Distillation for Enhanced Learning from Long-tailed Noisy Data
von: Hong, Feng, et al.
Veröffentlicht: (2025)
von: Hong, Feng, et al.
Veröffentlicht: (2025)
Domain-Inspired Sharpness-Aware Minimization Under Domain Shifts
von: Zhang, Ruipeng, et al.
Veröffentlicht: (2024)
von: Zhang, Ruipeng, et al.
Veröffentlicht: (2024)
Zero-shot Composed Text-Image Retrieval
von: Liu, Yikun, et al.
Veröffentlicht: (2023)
von: Liu, Yikun, et al.
Veröffentlicht: (2023)
DictLLM: Harnessing Key-Value Data Structures with Large Language Models for Enhanced Medical Diagnostics
von: Guo, YiQiu, et al.
Veröffentlicht: (2024)
von: Guo, YiQiu, et al.
Veröffentlicht: (2024)
Overthinking Reduction with Decoupled Rewards and Curriculum Data Scheduling
von: Jiang, Shuyang, et al.
Veröffentlicht: (2025)
von: Jiang, Shuyang, et al.
Veröffentlicht: (2025)
Decoding Linguistic Representations of Human Brain
von: Wang, Yu, et al.
Veröffentlicht: (2024)
von: Wang, Yu, et al.
Veröffentlicht: (2024)
Embarrassingly Simple Self-Distillation Improves Code Generation
von: Zhang, Ruixiang, et al.
Veröffentlicht: (2026)
von: Zhang, Ruixiang, et al.
Veröffentlicht: (2026)
MedS$^3$: Towards Medical Slow Thinking with Self-Evolved Soft Dual-sided Process Supervision
von: Jiang, Shuyang, et al.
Veröffentlicht: (2025)
von: Jiang, Shuyang, et al.
Veröffentlicht: (2025)
Out-of-Vocabulary Sampling Boosts Speculative Decoding
von: Timor, Nadav, et al.
Veröffentlicht: (2025)
von: Timor, Nadav, et al.
Veröffentlicht: (2025)
DiffuCoder: Understanding and Improving Masked Diffusion Models for Code Generation
von: Gong, Shansan, et al.
Veröffentlicht: (2025)
von: Gong, Shansan, et al.
Veröffentlicht: (2025)
Federated Learning with Bilateral Curation for Partially Class-Disjoint Data
von: Fan, Ziqing, et al.
Veröffentlicht: (2024)
von: Fan, Ziqing, et al.
Veröffentlicht: (2024)
Federated Learning under Partially Class-Disjoint Data via Manifold Reshaping
von: Fan, Ziqing, et al.
Veröffentlicht: (2024)
von: Fan, Ziqing, et al.
Veröffentlicht: (2024)
RelayLLM: Efficient Reasoning via Collaborative Decoding
von: Huang, Chengsong, et al.
Veröffentlicht: (2026)
von: Huang, Chengsong, et al.
Veröffentlicht: (2026)
Decoding Continuous Character-based Language from Non-invasive Brain Recordings
von: Zhang, Cenyuan, et al.
Veröffentlicht: (2024)
von: Zhang, Cenyuan, et al.
Veröffentlicht: (2024)
Differential-informed Sample Selection Accelerates Multimodal Contrastive Learning
von: Zhao, Zihua, et al.
Veröffentlicht: (2025)
von: Zhao, Zihua, et al.
Veröffentlicht: (2025)
M^3Builder: A Multi-Agent System for Automated Machine Learning in Medical Imaging
von: Feng, Jinghao, et al.
Veröffentlicht: (2025)
von: Feng, Jinghao, et al.
Veröffentlicht: (2025)
Rethinking How to Remember: Beyond Atomic Facts in Lifelong LLM Agent Memory
von: Sun, Jingwei, et al.
Veröffentlicht: (2026)
von: Sun, Jingwei, et al.
Veröffentlicht: (2026)
When Linear Attention Meets Autoregressive Decoding: Towards More Effective and Efficient Linearized Large Language Models
von: You, Haoran, et al.
Veröffentlicht: (2024)
von: You, Haoran, et al.
Veröffentlicht: (2024)
Efficient and Asymptotically Unbiased Constrained Decoding for Large Language Models
von: Ye, Haotian, et al.
Veröffentlicht: (2025)
von: Ye, Haotian, et al.
Veröffentlicht: (2025)
Pipelined Decoder for Efficient Context-Aware Text Generation
von: Huang, Zixian, et al.
Veröffentlicht: (2025)
von: Huang, Zixian, et al.
Veröffentlicht: (2025)
Efficient Encoder-Decoder Transformer Decoding for Decomposable Tasks
von: Lu, Bo-Ru, et al.
Veröffentlicht: (2024)
von: Lu, Bo-Ru, et al.
Veröffentlicht: (2024)
GUARD: Glocal Uncertainty-Aware Robust Decoding for Effective and Efficient Open-Ended Text Generation
von: Ding, Yuanhao, et al.
Veröffentlicht: (2025)
von: Ding, Yuanhao, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Rejection Mixing: Fast Semantic Propagation of Mask Tokens for Efficient DLLM Inference
von: Ye, Yushi, et al.
Veröffentlicht: (2026) -
Roll Out and Roll Back: Diffusion LLMs are Their Own Efficiency Teachers
von: Zeng, Fanqin, et al.
Veröffentlicht: (2026) -
FOCUS: DLLMs Know How to Tame Their Compute Bound
von: Liang, Kaihua, et al.
Veröffentlicht: (2026) -
Eliciting Medical Reasoning with Knowledge-enhanced Data Synthesis: A Semi-Supervised Reinforcement Learning Approach
von: Li, Haolin, et al.
Veröffentlicht: (2026) -
TAIA: Large Language Models are Out-of-Distribution Data Learners
von: Jiang, Shuyang, et al.
Veröffentlicht: (2024)