Reasoning in Diffusion Large Language Models is Concentrated in Dynamic Confusion Zones
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Ranfei, Chen, Ming, Wang, Kaifei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DSFT: Inspiring Diffusion Large Language Models to Comprehend Mathematical and Logical Patterns
por: Chen, Ranfei, et al.
Publicado: (2025)
por: Chen, Ranfei, et al.
Publicado: (2025)
Muon in Associative Memory Learning: Training Dynamics and Scaling Laws
por: Li, Binghui, et al.
Publicado: (2026)
por: Li, Binghui, et al.
Publicado: (2026)
Meta-Reasoner: Dynamic Guidance for Optimized Inference-time Reasoning in Large Language Models
por: Sui, Yuan, et al.
Publicado: (2025)
por: Sui, Yuan, et al.
Publicado: (2025)
Decoding Large Language Diffusion Models with Foreseeing Movement
por: Mo, Yichuan, et al.
Publicado: (2025)
por: Mo, Yichuan, et al.
Publicado: (2025)
Large Language Models as Analogical Reasoners
por: Yasunaga, Michihiro, et al.
Publicado: (2023)
por: Yasunaga, Michihiro, et al.
Publicado: (2023)
DyVal: Dynamic Evaluation of Large Language Models for Reasoning Tasks
por: Zhu, Kaijie, et al.
Publicado: (2023)
por: Zhu, Kaijie, et al.
Publicado: (2023)
Exploring the Hidden Reasoning Process of Large Language Models by Misleading Them
por: Chen, Guanyu, et al.
Publicado: (2025)
por: Chen, Guanyu, et al.
Publicado: (2025)
TLPO: Token-Level Policy Optimization for Mitigating Language Confusion in Large Language Models
por: Choo, Jinho, et al.
Publicado: (2026)
por: Choo, Jinho, et al.
Publicado: (2026)
pUniFind: a unified large pre-trained deep learning model pushing the limit of mass spectra interpretation
por: Zhao, Jiale, et al.
Publicado: (2025)
por: Zhao, Jiale, et al.
Publicado: (2025)
RFG: Test-Time Scaling for Diffusion Large Language Model Reasoning with Reward-Free Guidance
por: Chen, Tianlang, et al.
Publicado: (2025)
por: Chen, Tianlang, et al.
Publicado: (2025)
Self-guided Knowledgeable Network of Thoughts: Amplifying Reasoning with Large Language Models
por: Chen, Chao-Chi, et al.
Publicado: (2024)
por: Chen, Chao-Chi, et al.
Publicado: (2024)
LEAD: Length-Efficient Adaptive and Dynamic Reasoning for Large Language Models
por: Wei, Songtao, et al.
Publicado: (2026)
por: Wei, Songtao, et al.
Publicado: (2026)
Dynamic Thinking-Token Selection for Efficient Reasoning in Large Reasoning Models
por: Guo, Zhenyuan, et al.
Publicado: (2026)
por: Guo, Zhenyuan, et al.
Publicado: (2026)
Reducing Class-wise Confusion for Incremental Learning with Disentangled Manifolds
por: Chen, Huitong, et al.
Publicado: (2025)
por: Chen, Huitong, et al.
Publicado: (2025)
Handling Imbalanced Pseudolabels for Vision-Language Models with Concept Alignment and Confusion-Aware Calibrated Margin
por: Wang, Yuchen, et al.
Publicado: (2025)
por: Wang, Yuchen, et al.
Publicado: (2025)
Diversity-Aware Policy Optimization for Large Language Model Reasoning
por: Yao, Jian, et al.
Publicado: (2025)
por: Yao, Jian, et al.
Publicado: (2025)
Break the Block: Dynamic-size Reasoning Blocks for Diffusion Large Language Models via Monotonic Entropy Descent with Reinforcement Learning
por: Jiang, Yan, et al.
Publicado: (2026)
por: Jiang, Yan, et al.
Publicado: (2026)
How Hard is it to Confuse a World Model?
por: Radji, Waris, et al.
Publicado: (2025)
por: Radji, Waris, et al.
Publicado: (2025)
Inpainting-Guided Policy Optimization for Diffusion Large Language Models
por: Zhao, Siyan, et al.
Publicado: (2025)
por: Zhao, Siyan, et al.
Publicado: (2025)
Think Smart, Not Hard: Difficulty Adaptive Reasoning for Large Audio Language Models
por: Sheng, Zhichao, et al.
Publicado: (2025)
por: Sheng, Zhichao, et al.
Publicado: (2025)
Reasoning with Latent Tokens in Diffusion Language Models
por: He, Andre, et al.
Publicado: (2026)
por: He, Andre, et al.
Publicado: (2026)
DICE: Diffusion Large Language Models Excel at Generating CUDA Kernels
por: Bai, Haolei, et al.
Publicado: (2026)
por: Bai, Haolei, et al.
Publicado: (2026)
DS-Agent: Automated Data Science by Empowering Large Language Models with Case-Based Reasoning
por: Guo, Siyuan, et al.
Publicado: (2024)
por: Guo, Siyuan, et al.
Publicado: (2024)
Exploring and Addressing Reward Confusion in Offline Preference Learning
por: Chen, Xin, et al.
Publicado: (2024)
por: Chen, Xin, et al.
Publicado: (2024)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
por: Ye, Jiacheng, et al.
Publicado: (2024)
por: Ye, Jiacheng, et al.
Publicado: (2024)
Toward Adaptive Reasoning in Large Language Models with Thought Rollback
por: Chen, Sijia, et al.
Publicado: (2024)
por: Chen, Sijia, et al.
Publicado: (2024)
MM-OPERA: Benchmarking Open-ended Association Reasoning for Large Vision-Language Models
por: Huang, Zimeng, et al.
Publicado: (2025)
por: Huang, Zimeng, et al.
Publicado: (2025)
DynaAct: Large Language Model Reasoning with Dynamic Action Spaces
por: Zhao, Xueliang, et al.
Publicado: (2025)
por: Zhao, Xueliang, et al.
Publicado: (2025)
Linear Dynamics in the RLVR Training of Large Language Models
por: Wang, Tianle, et al.
Publicado: (2026)
por: Wang, Tianle, et al.
Publicado: (2026)
DeepForm: Reasoning Large Language Model for Communication System Formulation
por: Wu, Panlong, et al.
Publicado: (2025)
por: Wu, Panlong, et al.
Publicado: (2025)
Towards a Mechanistic Understanding of Propositional Logical Reasoning in Large Language Models
por: Chen, Danchun, et al.
Publicado: (2026)
por: Chen, Danchun, et al.
Publicado: (2026)
Reasoning on the Manifold: Bidirectional Consistency for Self-Verification in Diffusion Language Models
por: Ruan, Jiaoyang, et al.
Publicado: (2026)
por: Ruan, Jiaoyang, et al.
Publicado: (2026)
Improving Reasoning for Diffusion Language Models via Group Diffusion Policy Optimization
por: Rojas, Kevin, et al.
Publicado: (2025)
por: Rojas, Kevin, et al.
Publicado: (2025)
d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning
por: Zhao, Siyan, et al.
Publicado: (2025)
por: Zhao, Siyan, et al.
Publicado: (2025)
Diffuse or Confuse: A Diffusion Deepfake Speech Dataset
por: Firc, Anton, et al.
Publicado: (2024)
por: Firc, Anton, et al.
Publicado: (2024)
SmartThinker: Progressive Chain-of-Thought Length Calibration for Efficient Large Language Model Reasoning
por: Hu, Chenzhi, et al.
Publicado: (2026)
por: Hu, Chenzhi, et al.
Publicado: (2026)
Are Large-Language Models Graph Algorithmic Reasoners?
por: Taylor, Alexander K, et al.
Publicado: (2024)
por: Taylor, Alexander K, et al.
Publicado: (2024)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
por: Wang, Shumin, et al.
Publicado: (2026)
por: Wang, Shumin, et al.
Publicado: (2026)
Consistent Diffusion Language Models
por: Amin, Hasan, et al.
Publicado: (2026)
por: Amin, Hasan, et al.
Publicado: (2026)
Multi-Layer GRPO: Enhancing Reasoning and Self-Correction in Large Language Models
por: Ding, Fei, et al.
Publicado: (2025)
por: Ding, Fei, et al.
Publicado: (2025)
Ejemplares similares
-
DSFT: Inspiring Diffusion Large Language Models to Comprehend Mathematical and Logical Patterns
por: Chen, Ranfei, et al.
Publicado: (2025) -
Muon in Associative Memory Learning: Training Dynamics and Scaling Laws
por: Li, Binghui, et al.
Publicado: (2026) -
Meta-Reasoner: Dynamic Guidance for Optimized Inference-time Reasoning in Large Language Models
por: Sui, Yuan, et al.
Publicado: (2025) -
Decoding Large Language Diffusion Models with Foreseeing Movement
por: Mo, Yichuan, et al.
Publicado: (2025) -
Large Language Models as Analogical Reasoners
por: Yasunaga, Michihiro, et al.
Publicado: (2023)