Enregistré dans:
| Auteurs principaux: | Xu, Haotian, Wu, Xing, Wang, Weinong, Li, Zhongzhi, Zheng, Da, Chen, Boyuan, Hu, Yi, Kang, Shijia, Ji, Jiaming, Zhang, Yingying, Guo, Zhijiang, Yang, Yaodong, Zhang, Muhan, Zhang, Debing |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2501.11284 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LiteLong: Resource-Efficient Long-Context Data Synthesis for LLMs
par: Jia, Junlong, et autres
Publié: (2025)
par: Jia, Junlong, et autres
Publié: (2025)
SedarEval: Automated Evaluation using Self-Adaptive Rubrics
par: Fan, Zhiyuan, et autres
Publié: (2025)
par: Fan, Zhiyuan, et autres
Publié: (2025)
The Road Less Traveled: Enhancing Exploration in LLMs via Sequential Sampling
par: Kang, Shijia, et autres
Publié: (2025)
par: Kang, Shijia, et autres
Publié: (2025)
CodePMP: Scalable Preference Model Pretraining for Large Language Model Reasoning
par: Yu, Huimu, et autres
Publié: (2024)
par: Yu, Huimu, et autres
Publié: (2024)
Beyond Single-Task: Robust Multi-Task Length Generalization for LLMs
par: Hu, Yi, et autres
Publié: (2025)
par: Hu, Yi, et autres
Publié: (2025)
Can Pruning Improve Reasoning? Revisiting Long-CoT Compression with Capability in Mind for Better Reasoning
par: Zhao, Shangziqi, et autres
Publié: (2025)
par: Zhao, Shangziqi, et autres
Publié: (2025)
RedVLA: Physical Red Teaming for Vision-Language-Action Models
par: Zhang, Yuhao, et autres
Publié: (2026)
par: Zhang, Yuhao, et autres
Publié: (2026)
Agent RL Scaling Law: Agent RL with Spontaneous Code Execution for Mathematical Problem Solving
par: Mai, Xinji, et autres
Publié: (2025)
par: Mai, Xinji, et autres
Publié: (2025)
Mol-R1: Towards Explicit Long-CoT Reasoning in Molecule Discovery
par: Li, Jiatong, et autres
Publié: (2025)
par: Li, Jiatong, et autres
Publié: (2025)
Knowledge-Augmented Long-CoT Generation for Complex Biomolecular Reasoning
par: Lyu, Tianwen, et autres
Publié: (2025)
par: Lyu, Tianwen, et autres
Publié: (2025)
Distribution-Aligned Sequence Distillation for Superior Long-CoT Reasoning
par: Yan, Shaotian, et autres
Publié: (2026)
par: Yan, Shaotian, et autres
Publié: (2026)
Long or short CoT? Investigating Instance-level Switch of Large Reasoning Models
par: Zhang, Ruiqi, et autres
Publié: (2025)
par: Zhang, Ruiqi, et autres
Publié: (2025)
NExtLong: Toward Effective Long-Context Training without Long Documents
par: Gao, Chaochen, et autres
Publié: (2025)
par: Gao, Chaochen, et autres
Publié: (2025)
Parrot: A Training Pipeline Enhances Both Program CoT and Natural Language CoT for Reasoning
par: Jin, Senjie, et autres
Publié: (2025)
par: Jin, Senjie, et autres
Publié: (2025)
On the Completeness of Invariant Geometric Deep Learning Models
par: Li, Zian, et autres
Publié: (2024)
par: Li, Zian, et autres
Publié: (2024)
Efficient Long CoT Reasoning in Small Language Models
par: Wang, Zhaoyang, et autres
Publié: (2025)
par: Wang, Zhaoyang, et autres
Publié: (2025)
LongMagpie: A Self-synthesis Method for Generating Large-scale Long-context Instructions
par: Gao, Chaochen, et autres
Publié: (2025)
par: Gao, Chaochen, et autres
Publié: (2025)
How Likely Do LLMs with CoT Mimic Human Reasoning?
par: Bao, Guangsheng, et autres
Publié: (2024)
par: Bao, Guangsheng, et autres
Publié: (2024)
VideoTIR: Accurate Understanding for Long Videos with Efficient Tool-Integrated Reasoning
par: Gao, Zhe, et autres
Publié: (2026)
par: Gao, Zhe, et autres
Publié: (2026)
Deconstructing Long Chain-of-Thought: A Structured Reasoning Optimization Framework for Long CoT Distillation
par: Luo, Yijia, et autres
Publié: (2025)
par: Luo, Yijia, et autres
Publié: (2025)
Critic-CoT: Boosting the reasoning abilities of large language model via Chain-of-thoughts Critic
par: Zheng, Xin, et autres
Publié: (2024)
par: Zheng, Xin, et autres
Publié: (2024)
Untie the Knots: An Efficient Data Augmentation Strategy for Long-Context Pre-Training in Language Models
par: Tian, Junfeng, et autres
Publié: (2024)
par: Tian, Junfeng, et autres
Publié: (2024)
Empowering Lightweight MLLMs with Reasoning via Long CoT SFT
par: Ou, Linyu, et autres
Publié: (2025)
par: Ou, Linyu, et autres
Publié: (2025)
Self-Verifying Reflection Helps Transformers with CoT Reasoning
par: Yu, Zhongwei, et autres
Publié: (2025)
par: Yu, Zhongwei, et autres
Publié: (2025)
Beyond Isolated Capabilities: Bridging Long CoT Reasoning and Long-Context Understanding
par: Wang, Yifei
Publié: (2025)
par: Wang, Yifei
Publié: (2025)
GREPO: A Benchmark for Graph Neural Networks on Repository-Level Bug Localization
par: Wang, Juntong, et autres
Publié: (2026)
par: Wang, Juntong, et autres
Publié: (2026)
OCN: Effectively Utilizing Higher-Order Common Neighbors for Better Link Prediction
par: Wang, Juntong, et autres
Publié: (2025)
par: Wang, Juntong, et autres
Publié: (2025)
CoT-Evo: Evolutionary Distillation of Chain-of-Thought for Scientific Reasoning
par: Feng, Kehua, et autres
Publié: (2025)
par: Feng, Kehua, et autres
Publié: (2025)
Number Cookbook: Number Understanding of Language Models and How to Improve It
par: Yang, Haotong, et autres
Publié: (2024)
par: Yang, Haotong, et autres
Publié: (2024)
Structural Anchors and Reasoning Fragility:Understanding CoT Robustness in LLM4Code
par: Liu, Yang, et autres
Publié: (2026)
par: Liu, Yang, et autres
Publié: (2026)
Select2Reason: Efficient Instruction-Tuning Data Selection for Long-CoT Reasoning
par: Yang, Cehao, et autres
Publié: (2025)
par: Yang, Cehao, et autres
Publié: (2025)
Diagnosing Harmful Continuation in Answer-Correct Long-CoT Training Traces
par: He, Chen, et autres
Publié: (2026)
par: He, Chen, et autres
Publié: (2026)
The Synergy Dilemma of Long-CoT SFT and RL: Investigating Post-Training Techniques for Reasoning VLMs
par: Chen, Jierun, et autres
Publié: (2025)
par: Chen, Jierun, et autres
Publié: (2025)
What Characterizes Effective Reasoning? Revisiting Length, Review, and Structure of CoT
par: Feng, Yunzhen, et autres
Publié: (2025)
par: Feng, Yunzhen, et autres
Publié: (2025)
CAP-CoT: Cycle Adversarial Prompt for Improving Chain of Thoughts in LLM Reasoning
par: Chen, Shuxu, et autres
Publié: (2026)
par: Chen, Shuxu, et autres
Publié: (2026)
$\textit{SKIntern}$: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language Models
par: Liao, Huanxuan, et autres
Publié: (2024)
par: Liao, Huanxuan, et autres
Publié: (2024)
Bridging Efficiency and Transparency: Explainable CoT Compression in Multimodal Large Reasoning Models
par: Wang, Yizhi, et autres
Publié: (2026)
par: Wang, Yizhi, et autres
Publié: (2026)
Ada-R1: Hybrid-CoT via Bi-Level Adaptive Reasoning Optimization
par: Luo, Haotian, et autres
Publié: (2025)
par: Luo, Haotian, et autres
Publié: (2025)
From Explicit CoT to Implicit CoT: Learning to Internalize CoT Step by Step
par: Deng, Yuntian, et autres
Publié: (2024)
par: Deng, Yuntian, et autres
Publié: (2024)
Does LLM Alignment Really Need Diversity? An Empirical Study of Adapting RLVR Methods for Moral Reasoning
par: Zhang, Zhaowei, et autres
Publié: (2026)
par: Zhang, Zhaowei, et autres
Publié: (2026)
Documents similaires
-
LiteLong: Resource-Efficient Long-Context Data Synthesis for LLMs
par: Jia, Junlong, et autres
Publié: (2025) -
SedarEval: Automated Evaluation using Self-Adaptive Rubrics
par: Fan, Zhiyuan, et autres
Publié: (2025) -
The Road Less Traveled: Enhancing Exploration in LLMs via Sequential Sampling
par: Kang, Shijia, et autres
Publié: (2025) -
CodePMP: Scalable Preference Model Pretraining for Large Language Model Reasoning
par: Yu, Huimu, et autres
Publié: (2024) -
Beyond Single-Task: Robust Multi-Task Length Generalization for LLMs
par: Hu, Yi, et autres
Publié: (2025)