Advancing Block Diffusion Language Models for Test-Time Scaling
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Lu, Yi, Kong, Deyang, Wang, Jianing, Guo, Linsen, Wang, Xue, Guo, Qi, Gui, Tao, Huang, Xuanjing, Ye, Wei, Zhang, Shikun, Wang, Wei |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
R-Horizon: How Far Can Your Large Reasoning Model Really Go in Breadth and Depth?
von: Lu, Yi, et al.
Veröffentlicht: (2025)
von: Lu, Yi, et al.
Veröffentlicht: (2025)
OPE: Overcoming Information Saturation in Parallel Thinking via Outline-Guided Path Exploration
von: Guo, Qi, et al.
Veröffentlicht: (2026)
von: Guo, Qi, et al.
Veröffentlicht: (2026)
LongAgent: Scaling Language Models to 128k Context through Multi-Agent Collaboration
von: Zhao, Jun, et al.
Veröffentlicht: (2024)
von: Zhao, Jun, et al.
Veröffentlicht: (2024)
LLM-DA: Data Augmentation via Large Language Models for Few-Shot Named Entity Recognition
von: Ye, Junjie, et al.
Veröffentlicht: (2024)
von: Ye, Junjie, et al.
Veröffentlicht: (2024)
SampleMix: A Sample-wise Pre-training Data Mixing Strategey by Coordinating Data Quality and Diversity
von: Xi, Xiangyu, et al.
Veröffentlicht: (2025)
von: Xi, Xiangyu, et al.
Veröffentlicht: (2025)
Unveiling Linguistic Regions in Large Language Models
von: Zhang, Zhihao, et al.
Veröffentlicht: (2024)
von: Zhang, Zhihao, et al.
Veröffentlicht: (2024)
Autoformalizer with Tool Feedback
von: Guo, Qi, et al.
Veröffentlicht: (2025)
von: Guo, Qi, et al.
Veröffentlicht: (2025)
LongHeads: Multi-Head Attention is Secretly a Long Context Processor
von: Lu, Yi, et al.
Veröffentlicht: (2024)
von: Lu, Yi, et al.
Veröffentlicht: (2024)
Self-Demos: Eliciting Out-of-Demonstration Generalizability in Large Language Models
von: He, Wei, et al.
Veröffentlicht: (2024)
von: He, Wei, et al.
Veröffentlicht: (2024)
Rethinking the Sampling Criteria in Reinforcement Learning for LLM Reasoning: A Competence-Difficulty Alignment Perspective
von: Kong, Deyang, et al.
Veröffentlicht: (2025)
von: Kong, Deyang, et al.
Veröffentlicht: (2025)
RoCoIns: Enhancing Robustness of Large Language Models through Code-Style Instructions
von: Zhang, Yuansen, et al.
Veröffentlicht: (2024)
von: Zhang, Yuansen, et al.
Veröffentlicht: (2024)
Domain Generalization via Causal Adjustment for Cross-Domain Sentiment Analysis
von: Wang, Siyin, et al.
Veröffentlicht: (2024)
von: Wang, Siyin, et al.
Veröffentlicht: (2024)
CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models
von: Lv, Huijie, et al.
Veröffentlicht: (2024)
von: Lv, Huijie, et al.
Veröffentlicht: (2024)
Length Generalization of Causal Transformers without Position Encoding
von: Wang, Jie, et al.
Veröffentlicht: (2024)
von: Wang, Jie, et al.
Veröffentlicht: (2024)
Are Large Language Models Good Prompt Optimizers?
von: Ma, Ruotian, et al.
Veröffentlicht: (2024)
von: Ma, Ruotian, et al.
Veröffentlicht: (2024)
LLaMA Beyond English: An Empirical Study on Language Capability Transfer
von: Zhao, Jun, et al.
Veröffentlicht: (2024)
von: Zhao, Jun, et al.
Veröffentlicht: (2024)
CCTU: A Benchmark for Tool Use under Complex Constraints
von: Ye, Junjie, et al.
Veröffentlicht: (2026)
von: Ye, Junjie, et al.
Veröffentlicht: (2026)
ATLAS: All-round Testing of Long-context Abilities across Scales
von: Huang, Deli, et al.
Veröffentlicht: (2026)
von: Huang, Deli, et al.
Veröffentlicht: (2026)
Instruction Data Selection via Answer Divergence
von: Li, Bo, et al.
Veröffentlicht: (2026)
von: Li, Bo, et al.
Veröffentlicht: (2026)
60 Data Points are Sufficient to Fine-Tune LLMs for Question-Answering
von: Ye, Junjie, et al.
Veröffentlicht: (2024)
von: Ye, Junjie, et al.
Veröffentlicht: (2024)
LongCat-Flash-Prover: Advancing Native Formal Reasoning via Agentic Tool-Integrated Reinforcement Learning
von: Wang, Jianing, et al.
Veröffentlicht: (2026)
von: Wang, Jianing, et al.
Veröffentlicht: (2026)
Reinforcing the Diffusion Chain of Lateral Thought with Diffusion Language Models
von: Huang, Zemin, et al.
Veröffentlicht: (2025)
von: Huang, Zemin, et al.
Veröffentlicht: (2025)
Self-Harmony: Learning to Harmonize Self-Supervision and Self-Play in Test-Time Reinforcement Learning
von: Wang, Ru, et al.
Veröffentlicht: (2025)
von: Wang, Ru, et al.
Veröffentlicht: (2025)
ToolSword: Unveiling Safety Issues of Large Language Models in Tool Learning Across Three Stages
von: Ye, Junjie, et al.
Veröffentlicht: (2024)
von: Ye, Junjie, et al.
Veröffentlicht: (2024)
Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future
von: Wang, Yidong, et al.
Veröffentlicht: (2025)
von: Wang, Yidong, et al.
Veröffentlicht: (2025)
Don't Settle Too Early: Self-Reflective Remasking for Diffusion Language Models
von: Huang, Zemin, et al.
Veröffentlicht: (2025)
von: Huang, Zemin, et al.
Veröffentlicht: (2025)
Language Control Diffusion: Efficiently Scaling through Space, Time, and Tasks
von: Zhang, Edwin, et al.
Veröffentlicht: (2022)
von: Zhang, Edwin, et al.
Veröffentlicht: (2022)
MatryoshkaThinking: Recursive Test-Time Scaling Enables Efficient Reasoning
von: Chen, Hongwei, et al.
Veröffentlicht: (2025)
von: Chen, Hongwei, et al.
Veröffentlicht: (2025)
J1: Exploring Simple Test-Time Scaling for LLM-as-a-Judge
von: Chan, Chi-Min, et al.
Veröffentlicht: (2025)
von: Chan, Chi-Min, et al.
Veröffentlicht: (2025)
Compression Hacking: A Supplementary Perspective on Informatics Properties of Language Models from Geometric Distortion
von: Zang, Jianxiang, et al.
Veröffentlicht: (2025)
von: Zang, Jianxiang, et al.
Veröffentlicht: (2025)
Agentar-Scale-SQL: Advancing Text-to-SQL through Orchestrated Test-Time Scaling
von: Wang, Pengfei, et al.
Veröffentlicht: (2025)
von: Wang, Pengfei, et al.
Veröffentlicht: (2025)
Parrot: A Training Pipeline Enhances Both Program CoT and Natural Language CoT for Reasoning
von: Jin, Senjie, et al.
Veröffentlicht: (2025)
von: Jin, Senjie, et al.
Veröffentlicht: (2025)
Prejudge-Before-Think: Enhancing Large Language Models at Test-Time by Process Prejudge Reasoning
von: Wang, Jianing, et al.
Veröffentlicht: (2025)
von: Wang, Jianing, et al.
Veröffentlicht: (2025)
Beyond Boundaries: Learning a Universal Entity Taxonomy across Datasets and Languages for Open Named Entity Recognition
von: Yang, Yuming, et al.
Veröffentlicht: (2024)
von: Yang, Yuming, et al.
Veröffentlicht: (2024)
Synergistic Multi-Agent Framework with Trajectory Learning for Knowledge-Intensive Tasks
von: Yue, Shengbin, et al.
Veröffentlicht: (2024)
von: Yue, Shengbin, et al.
Veröffentlicht: (2024)
SG-Bench: Evaluating LLM Safety Generalization Across Diverse Tasks and Prompt Types
von: Mou, Yutao, et al.
Veröffentlicht: (2024)
von: Mou, Yutao, et al.
Veröffentlicht: (2024)
Navigating the OverKill in Large Language Models
von: Shi, Chenyu, et al.
Veröffentlicht: (2024)
von: Shi, Chenyu, et al.
Veröffentlicht: (2024)
ALaRM: Align Language Models via Hierarchical Rewards Modeling
von: Lai, Yuhang, et al.
Veröffentlicht: (2024)
von: Lai, Yuhang, et al.
Veröffentlicht: (2024)
Scaling Laws for Fact Memorization of Large Language Models
von: Lu, Xingyu, et al.
Veröffentlicht: (2024)
von: Lu, Xingyu, et al.
Veröffentlicht: (2024)
A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?
von: Zhang, Qiyuan, et al.
Veröffentlicht: (2025)
von: Zhang, Qiyuan, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
R-Horizon: How Far Can Your Large Reasoning Model Really Go in Breadth and Depth?
von: Lu, Yi, et al.
Veröffentlicht: (2025) -
OPE: Overcoming Information Saturation in Parallel Thinking via Outline-Guided Path Exploration
von: Guo, Qi, et al.
Veröffentlicht: (2026) -
LongAgent: Scaling Language Models to 128k Context through Multi-Agent Collaboration
von: Zhao, Jun, et al.
Veröffentlicht: (2024) -
LLM-DA: Data Augmentation via Large Language Models for Few-Shot Named Entity Recognition
von: Ye, Junjie, et al.
Veröffentlicht: (2024) -
SampleMix: A Sample-wise Pre-training Data Mixing Strategey by Coordinating Data Quality and Diversity
von: Xi, Xiangyu, et al.
Veröffentlicht: (2025)