Enregistré dans:
| Auteurs principaux: | Zou, Shun, Wang, Yong, Chen, Zehui, Chen, Lin, Tao, Chongyang, Zhao, Feng, Chu, Xiangxiang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2604.08964 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AR-MAP: Are Autoregressive Large Language Models Implicit Teachers for Diffusion Large Language Models?
par: Lin, Liang, et autres
Publié: (2026)
par: Lin, Liang, et autres
Publié: (2026)
Anchor-based Large Language Models
par: Pang, Jianhui, et autres
Publié: (2024)
par: Pang, Jianhui, et autres
Publié: (2024)
CreditDecoding: Accelerating Parallel Decoding in Diffusion Large Language Models with Trace Credit
par: Wang, Kangyu, et autres
Publié: (2025)
par: Wang, Kangyu, et autres
Publié: (2025)
D$^2$Evo: Dual Difficulty-Aware Self-Evolution for Data-Efficient Reinforcement Learning
par: Zhang, Ru, et autres
Publié: (2026)
par: Zhang, Ru, et autres
Publié: (2026)
Agent-FLAN: Designing Data and Methods of Effective Agent Tuning for Large Language Models
par: Chen, Zehui, et autres
Publié: (2024)
par: Chen, Zehui, et autres
Publié: (2024)
Falcon: Faster and Parallel Inference of Large Language Models through Enhanced Semi-Autoregressive Drafting and Custom-Designed Decoding Tree
par: Gao, Xiangxiang, et autres
Publié: (2024)
par: Gao, Xiangxiang, et autres
Publié: (2024)
DFlash: Block Diffusion for Flash Speculative Decoding
par: Chen, Jian, et autres
Publié: (2026)
par: Chen, Jian, et autres
Publié: (2026)
Preference Alignment for Diffusion Model via Explicit Denoised Distribution Estimation
par: Shi, Dingyuan, et autres
Publié: (2024)
par: Shi, Dingyuan, et autres
Publié: (2024)
Breaking Contextual Inertia: Reinforcement Learning with Single-Turn Anchors for Stable Multi-Turn Interaction
par: Chen, Xingwu, et autres
Publié: (2026)
par: Chen, Xingwu, et autres
Publié: (2026)
Reversible Diffusion Decoding for Diffusion Language Models
par: Wang, Xinyun, et autres
Publié: (2026)
par: Wang, Xinyun, et autres
Publié: (2026)
CRITICTOOL: Evaluating Self-Critique Capabilities of Large Language Models in Tool-Calling Error Scenarios
par: Huang, Shiting, et autres
Publié: (2025)
par: Huang, Shiting, et autres
Publié: (2025)
Leveraging Large Language Models for NLG Evaluation: Advances and Challenges
par: Li, Zhen, et autres
Publié: (2024)
par: Li, Zhen, et autres
Publié: (2024)
SaaSBench: Exploring the Boundaries of Coding Agents in Long-Horizon Enterprise SaaS Engineering
par: Ren, Qingnan, et autres
Publié: (2026)
par: Ren, Qingnan, et autres
Publié: (2026)
T-Eval: Evaluating the Tool Utilization Capability of Large Language Models Step by Step
par: Chen, Zehui, et autres
Publié: (2023)
par: Chen, Zehui, et autres
Publié: (2023)
A Comprehensive Evaluation on Event Reasoning of Large Language Models
par: Tao, Zhengwei, et autres
Publié: (2024)
par: Tao, Zhengwei, et autres
Publié: (2024)
Optimizing Decoding Paths in Masked Diffusion Models by Quantifying Uncertainty
par: Chen, Ziyu, et autres
Publié: (2025)
par: Chen, Ziyu, et autres
Publié: (2025)
Token Constraint Decoding Improves Robustness on Question Answering for Large Language Models
par: Yao, Jui-Ming, et autres
Publié: (2025)
par: Yao, Jui-Ming, et autres
Publié: (2025)
AdvAnchor: Enhancing Diffusion Model Unlearning with Adversarial Anchors
par: Zhao, Mengnan, et autres
Publié: (2024)
par: Zhao, Mengnan, et autres
Publié: (2024)
AnTKV: Anchor Token-Aware Sub-Bit Vector Quantization for KV Cache in Large Language Models
par: Li, Zeyu, et autres
Publié: (2025)
par: Li, Zeyu, et autres
Publié: (2025)
Meta-Task Prompting Elicits Embeddings from Large Language Models
par: Lei, Yibin, et autres
Publié: (2024)
par: Lei, Yibin, et autres
Publié: (2024)
A Survey on Knowledge Distillation of Large Language Models
par: Xu, Xiaohan, et autres
Publié: (2024)
par: Xu, Xiaohan, et autres
Publié: (2024)
Efficient and Asymptotically Unbiased Constrained Decoding for Large Language Models
par: Ye, Haotian, et autres
Publié: (2025)
par: Ye, Haotian, et autres
Publié: (2025)
Learning to Parallel: Accelerating Diffusion Large Language Models via Learnable Parallel Decoding
par: Bao, Wenrui, et autres
Publié: (2025)
par: Bao, Wenrui, et autres
Publié: (2025)
Encoder-Decoder or Decoder-Only? Revisiting Encoder-Decoder Large Language Model
par: Zhang, Biao, et autres
Publié: (2025)
par: Zhang, Biao, et autres
Publié: (2025)
Beyond Confidence: Adaptive and Coherent Decoding for Diffusion Language Models
par: Chen, Kecheng, et autres
Publié: (2025)
par: Chen, Kecheng, et autres
Publié: (2025)
Re-Reading Improves Reasoning in Large Language Models
par: Xu, Xiaohan, et autres
Publié: (2023)
par: Xu, Xiaohan, et autres
Publié: (2023)
Self Speculative Decoding for Diffusion Large Language Models
par: Gao, Yifeng, et autres
Publié: (2025)
par: Gao, Yifeng, et autres
Publié: (2025)
Knowledge Boundary of Large Language Models: A Survey
par: Li, Moxin, et autres
Publié: (2024)
par: Li, Moxin, et autres
Publié: (2024)
WizardCoder: Empowering Code Large Language Models with Evol-Instruct
par: Luo, Ziyang, et autres
Publié: (2023)
par: Luo, Ziyang, et autres
Publié: (2023)
Deferred Commitment Decoding for Diffusion Language Models
par: Shu, Yingte, et autres
Publié: (2026)
par: Shu, Yingte, et autres
Publié: (2026)
SAC-Opt: Semantic Anchors for Iterative Correction in Optimization Modeling
par: Zhang, Yansen, et autres
Publié: (2025)
par: Zhang, Yansen, et autres
Publié: (2025)
DLLMQuant: Quantizing Diffusion-based Large Language Models
par: Xu, Chen, et autres
Publié: (2025)
par: Xu, Chen, et autres
Publié: (2025)
WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct
par: Luo, Haipeng, et autres
Publié: (2023)
par: Luo, Haipeng, et autres
Publié: (2023)
Latent Refinement Decoding: Enhancing Diffusion-Based Language Models by Refining Belief States
par: Zhu, Qinglin, et autres
Publié: (2025)
par: Zhu, Qinglin, et autres
Publié: (2025)
History, Development, and Principles of Large Language Models-An Introductory Survey
par: Wang, Zichong, et autres
Publié: (2024)
par: Wang, Zichong, et autres
Publié: (2024)
Large Language Model as a Universal Clinical Multi-task Decoder
par: Wu, Yujiang, et autres
Publié: (2024)
par: Wu, Yujiang, et autres
Publié: (2024)
Detecting Knowledge Boundary of Vision Large Language Models by Sampling-Based Inference
par: Chen, Zhuo, et autres
Publié: (2025)
par: Chen, Zhuo, et autres
Publié: (2025)
Teaching Large Language Models to Express Knowledge Boundary from Their Own Signals
par: Chen, Lida, et autres
Publié: (2024)
par: Chen, Lida, et autres
Publié: (2024)
KBM: Delineating Knowledge Boundary for Adaptive Retrieval in Large Language Models
par: Zhang, Zhen, et autres
Publié: (2024)
par: Zhang, Zhen, et autres
Publié: (2024)
Accelerating Speculative Decoding with Block Diffusion Draft Trees
par: Ringel, Liran, et autres
Publié: (2026)
par: Ringel, Liran, et autres
Publié: (2026)
Documents similaires
-
AR-MAP: Are Autoregressive Large Language Models Implicit Teachers for Diffusion Large Language Models?
par: Lin, Liang, et autres
Publié: (2026) -
Anchor-based Large Language Models
par: Pang, Jianhui, et autres
Publié: (2024) -
CreditDecoding: Accelerating Parallel Decoding in Diffusion Large Language Models with Trace Credit
par: Wang, Kangyu, et autres
Publié: (2025) -
D$^2$Evo: Dual Difficulty-Aware Self-Evolution for Data-Efficient Reinforcement Learning
par: Zhang, Ru, et autres
Publié: (2026) -
Agent-FLAN: Designing Data and Methods of Effective Agent Tuning for Large Language Models
par: Chen, Zehui, et autres
Publié: (2024)