AutoTIR: Autonomous Tools Integrated Reasoning via Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wei, Yifan, Yu, Xiaoyan, Weng, Yixuan, Pan, Tengfei, Li, Angsheng, Du, Li |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Structural Entropy Guided Agent for Detecting and Repairing Knowledge Deficiencies in LLMs
von: Wei, Yifan, et al.
Veröffentlicht: (2025)
von: Wei, Yifan, et al.
Veröffentlicht: (2025)
Towards Compositional Generalization of LLMs via Skill Taxonomy Guided Data Synthesis
von: Wei, Yifan, et al.
Veröffentlicht: (2026)
von: Wei, Yifan, et al.
Veröffentlicht: (2026)
SetKE: Knowledge Editing for Knowledge Elements Overlap
von: Wei, Yifan, et al.
Veröffentlicht: (2025)
von: Wei, Yifan, et al.
Veröffentlicht: (2025)
AdaTIR: Adaptive Tool-Integrated Reasoning via Difficulty-Aware Policy Optimization
von: Fang, Zhaiyu, et al.
Veröffentlicht: (2026)
von: Fang, Zhaiyu, et al.
Veröffentlicht: (2026)
PruneTIR: Inference-Time Tool Call Pruning for Effective yet Efficient Tool-Integrated Reasoning
von: Zhang, Luan, et al.
Veröffentlicht: (2026)
von: Zhang, Luan, et al.
Veröffentlicht: (2026)
MatchTIR: Fine-Grained Supervision for Tool-Integrated Reasoning via Bipartite Matching
von: Qu, Changle, et al.
Veröffentlicht: (2026)
von: Qu, Changle, et al.
Veröffentlicht: (2026)
Scaling Medical Reasoning Verification via Tool-Integrated Reinforcement Learning
von: Zhang, Hang, et al.
Veröffentlicht: (2026)
von: Zhang, Hang, et al.
Veröffentlicht: (2026)
Discovery and Reinforcement of Tool-Integrated Reasoning Chains via Rollout Trees
von: Li, Kun, et al.
Veröffentlicht: (2026)
von: Li, Kun, et al.
Veröffentlicht: (2026)
AutoTool: Dynamic Tool Selection and Integration for Agentic Reasoning
von: Zou, Jiaru, et al.
Veröffentlicht: (2025)
von: Zou, Jiaru, et al.
Veröffentlicht: (2025)
Incentivizing Agentic Reasoning in LLM Judges via Tool-Integrated Reinforcement Learning
von: Xu, Ran, et al.
Veröffentlicht: (2025)
von: Xu, Ran, et al.
Veröffentlicht: (2025)
When to Trust Tools? Adaptive Tool Trust Calibration For Tool-Integrated Math Reasoning
von: Xu, Ruotao, et al.
Veröffentlicht: (2026)
von: Xu, Ruotao, et al.
Veröffentlicht: (2026)
LongCat-Flash-Prover: Advancing Native Formal Reasoning via Agentic Tool-Integrated Reinforcement Learning
von: Wang, Jianing, et al.
Veröffentlicht: (2026)
von: Wang, Jianing, et al.
Veröffentlicht: (2026)
Does Knowledge Localization Hold True? Surprising Differences Between Entity and Relation Perspectives in Language Models
von: Wei, Yifan, et al.
Veröffentlicht: (2024)
von: Wei, Yifan, et al.
Veröffentlicht: (2024)
Scaling Agentic Reinforcement Learning for Tool-Integrated Reasoning in VLMs
von: Lu, Meng, et al.
Veröffentlicht: (2025)
von: Lu, Meng, et al.
Veröffentlicht: (2025)
THOR: Tool-Integrated Hierarchical Optimization via RL for Mathematical Reasoning
von: Chang, Qikai, et al.
Veröffentlicht: (2025)
von: Chang, Qikai, et al.
Veröffentlicht: (2025)
Tool-Star: Empowering LLM-Brained Multi-Tool Reasoner via Reinforcement Learning
von: Dong, Guanting, et al.
Veröffentlicht: (2025)
von: Dong, Guanting, et al.
Veröffentlicht: (2025)
RLKD: Distilling LLMs' Reasoning via Reinforcement Learning
von: Xu, Shicheng, et al.
Veröffentlicht: (2025)
von: Xu, Shicheng, et al.
Veröffentlicht: (2025)
Agentic Conversational Search with Contextualized Reasoning via Reinforcement Learning
von: Mo, Fengran, et al.
Veröffentlicht: (2026)
von: Mo, Fengran, et al.
Veröffentlicht: (2026)
SARI: Structured Audio Reasoning via Curriculum-Guided Reinforcement Learning
von: Wen, Cheng, et al.
Veröffentlicht: (2025)
von: Wen, Cheng, et al.
Veröffentlicht: (2025)
VideoTIR: Accurate Understanding for Long Videos with Efficient Tool-Integrated Reasoning
von: Gao, Zhe, et al.
Veröffentlicht: (2026)
von: Gao, Zhe, et al.
Veröffentlicht: (2026)
Implicit Hierarchical GRPO: Decoupling Tool Invocation from Execution for Tool-Integrated Mathematical Reasoning
von: Wang, Li, et al.
Veröffentlicht: (2026)
von: Wang, Li, et al.
Veröffentlicht: (2026)
Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning
von: Cheng, Qianjia, et al.
Veröffentlicht: (2026)
von: Cheng, Qianjia, et al.
Veröffentlicht: (2026)
LBM: Hierarchical Large Auto-Bidding Model via Reasoning and Acting
von: Li, Yewen, et al.
Veröffentlicht: (2026)
von: Li, Yewen, et al.
Veröffentlicht: (2026)
AutoFigure: Generating and Refining Publication-Ready Scientific Illustrations
von: Zhu, Minjun, et al.
Veröffentlicht: (2026)
von: Zhu, Minjun, et al.
Veröffentlicht: (2026)
SimpleTIR: End-to-End Reinforcement Learning for Multi-Turn Tool-Integrated Reasoning
von: Xue, Zhenghai, et al.
Veröffentlicht: (2025)
von: Xue, Zhenghai, et al.
Veröffentlicht: (2025)
Beyond IID: Optimizing Instruction Learning from the Perspective of Instruction Interaction and Dependency
von: Zhao, Hanyu, et al.
Veröffentlicht: (2024)
von: Zhao, Hanyu, et al.
Veröffentlicht: (2024)
Scaling Towards the Information Boundary of Instruction Sets: The Infinity Instruct Subject Technical Report
von: Du, Li, et al.
Veröffentlicht: (2025)
von: Du, Li, et al.
Veröffentlicht: (2025)
LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance
von: Fan, Yuchun, et al.
Veröffentlicht: (2026)
von: Fan, Yuchun, et al.
Veröffentlicht: (2026)
Memory-T1: Reinforcement Learning for Temporal Reasoning in Multi-session Agents
von: Du, Yiming, et al.
Veröffentlicht: (2025)
von: Du, Yiming, et al.
Veröffentlicht: (2025)
LLM Agents Already Know When to Call Tools -- Even Without Reasoning
von: Sun, Chung-En, et al.
Veröffentlicht: (2026)
von: Sun, Chung-En, et al.
Veröffentlicht: (2026)
Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning
von: Beutel, Alex, et al.
Veröffentlicht: (2024)
von: Beutel, Alex, et al.
Veröffentlicht: (2024)
SRPO: Enhancing Multimodal LLM Reasoning via Reflection-Aware Reinforcement Learning
von: Wan, Zhongwei, et al.
Veröffentlicht: (2025)
von: Wan, Zhongwei, et al.
Veröffentlicht: (2025)
AutoTriton: Automatic Triton Programming with Reinforcement Learning in LLMs
von: Li, Shangzhan, et al.
Veröffentlicht: (2025)
von: Li, Shangzhan, et al.
Veröffentlicht: (2025)
Learning to Draft: Adaptive Speculative Decoding with Reinforcement Learning
von: Zhang, Jiebin, et al.
Veröffentlicht: (2026)
von: Zhang, Jiebin, et al.
Veröffentlicht: (2026)
StepTool: Enhancing Multi-Step Tool Usage in LLMs via Step-Grained Reinforcement Learning
von: Yu, Yuanqing, et al.
Veröffentlicht: (2024)
von: Yu, Yuanqing, et al.
Veröffentlicht: (2024)
Concise Reasoning via Reinforcement Learning
von: Fatemi, Mehdi, et al.
Veröffentlicht: (2025)
von: Fatemi, Mehdi, et al.
Veröffentlicht: (2025)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
von: Chen, Mingyang, et al.
Veröffentlicht: (2025)
von: Chen, Mingyang, et al.
Veröffentlicht: (2025)
ToolSpec: Accelerating Tool Calling via Schema-Aware and Retrieval-Augmented Speculative Decoding
von: Xia, Heming, et al.
Veröffentlicht: (2026)
von: Xia, Heming, et al.
Veröffentlicht: (2026)
Reinforcement Learning for Tool-Integrated Interleaved Thinking towards Cross-Domain Generalization
von: Chen, Zhengyu, et al.
Veröffentlicht: (2025)
von: Chen, Zhengyu, et al.
Veröffentlicht: (2025)
Unlocking Reasoning Capabilities in LLMs via Reinforcement Learning Exploration
von: Deng, Wenhao, et al.
Veröffentlicht: (2025)
von: Deng, Wenhao, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Structural Entropy Guided Agent for Detecting and Repairing Knowledge Deficiencies in LLMs
von: Wei, Yifan, et al.
Veröffentlicht: (2025) -
Towards Compositional Generalization of LLMs via Skill Taxonomy Guided Data Synthesis
von: Wei, Yifan, et al.
Veröffentlicht: (2026) -
SetKE: Knowledge Editing for Knowledge Elements Overlap
von: Wei, Yifan, et al.
Veröffentlicht: (2025) -
AdaTIR: Adaptive Tool-Integrated Reasoning via Difficulty-Aware Policy Optimization
von: Fang, Zhaiyu, et al.
Veröffentlicht: (2026) -
PruneTIR: Inference-Time Tool Call Pruning for Effective yet Efficient Tool-Integrated Reasoning
von: Zhang, Luan, et al.
Veröffentlicht: (2026)