Enregistré dans:
| Auteurs principaux: | Zhang, Xuqin, He, Quan, Zheng, Zhenrui, Zhang, Zongzhang, He, Xu, Li, Dong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.01204 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Sentence-level Reward Model can Generalize Better for Aligning LLM from Human Preference
par: Qiu, Wenjie, et autres
Publié: (2025)
par: Qiu, Wenjie, et autres
Publié: (2025)
AutoTool: Dynamic Tool Selection and Integration for Agentic Reasoning
par: Zou, Jiaru, et autres
Publié: (2025)
par: Zou, Jiaru, et autres
Publié: (2025)
Scaling Agentic Reinforcement Learning for Tool-Integrated Reasoning in VLMs
par: Lu, Meng, et autres
Publié: (2025)
par: Lu, Meng, et autres
Publié: (2025)
Agentic Reasoning: A Streamlined Framework for Enhancing LLM Reasoning with Agentic Tools
par: Wu, Junde, et autres
Publié: (2025)
par: Wu, Junde, et autres
Publié: (2025)
When to Trust Tools? Adaptive Tool Trust Calibration For Tool-Integrated Math Reasoning
par: Xu, Ruotao, et autres
Publié: (2026)
par: Xu, Ruotao, et autres
Publié: (2026)
Open-Vocabulary Federated Learning with Multimodal Prototyping
par: Zeng, Huimin, et autres
Publié: (2024)
par: Zeng, Huimin, et autres
Publié: (2024)
Scaling Agentic Verifier for Competitive Coding
par: Ma, Zeyao, et autres
Publié: (2026)
par: Ma, Zeyao, et autres
Publié: (2026)
MedOrch: Medical Diagnosis with Tool-Augmented Reasoning Agents for Flexible Extensibility
par: He, Yexiao, et autres
Publié: (2025)
par: He, Yexiao, et autres
Publié: (2025)
AgenticQwen: Training Small Agentic Language Models with Dual Data Flywheels for Industrial-Scale Tool Use
par: Lyu, Yuanjie, et autres
Publié: (2026)
par: Lyu, Yuanjie, et autres
Publié: (2026)
rStar2-Agent: Agentic Reasoning Technical Report
par: Shang, Ning, et autres
Publié: (2025)
par: Shang, Ning, et autres
Publié: (2025)
Improving Sample Efficiency of Reinforcement Learning with Background Knowledge from Large Language Models
par: Zhang, Fuxiang, et autres
Publié: (2024)
par: Zhang, Fuxiang, et autres
Publié: (2024)
Hybrid Latent Reasoning via Reinforcement Learning
par: Yue, Zhenrui, et autres
Publié: (2025)
par: Yue, Zhenrui, et autres
Publié: (2025)
Scaling Medical Reasoning Verification via Tool-Integrated Reinforcement Learning
par: Zhang, Hang, et autres
Publié: (2026)
par: Zhang, Hang, et autres
Publié: (2026)
OctoTools: An Agentic Framework with Extensible Tools for Complex Reasoning
par: Lu, Pan, et autres
Publié: (2025)
par: Lu, Pan, et autres
Publié: (2025)
GeoBrowse: A Geolocation Benchmark for Agentic Tool Use with Expert-Annotated Reasoning Traces
par: Geng, Xinyu, et autres
Publié: (2026)
par: Geng, Xinyu, et autres
Publié: (2026)
PyVision: Agentic Vision with Dynamic Tooling
par: Zhao, Shitian, et autres
Publié: (2025)
par: Zhao, Shitian, et autres
Publié: (2025)
Agentic Tool Use in Large Language Models
par: Hu, Jinchao, et autres
Publié: (2026)
par: Hu, Jinchao, et autres
Publié: (2026)
Evidence-Driven Retrieval Augmented Response Generation for Online Misinformation
par: Yue, Zhenrui, et autres
Publié: (2024)
par: Yue, Zhenrui, et autres
Publié: (2024)
Retrieval Augmented Fact Verification by Synthesizing Contrastive Arguments
par: Yue, Zhenrui, et autres
Publié: (2024)
par: Yue, Zhenrui, et autres
Publié: (2024)
A Survey of Frontiers in LLM Reasoning: Inference Scaling, Learning to Reason, and Agentic Systems
par: Ke, Zixuan, et autres
Publié: (2025)
par: Ke, Zixuan, et autres
Publié: (2025)
ToolOmni: Enabling Open-World Tool Use via Agentic learning with Proactive Retrieval and Grounded Execution
par: Huang, Shouzheng, et autres
Publié: (2026)
par: Huang, Shouzheng, et autres
Publié: (2026)
LRAS: Advanced Legal Reasoning with Agentic Search
par: Zhou, Yujin, et autres
Publié: (2026)
par: Zhou, Yujin, et autres
Publié: (2026)
Inference Scaling for Long-Context Retrieval Augmented Generation
par: Yue, Zhenrui, et autres
Publié: (2024)
par: Yue, Zhenrui, et autres
Publié: (2024)
Agentic Reasoning for Large Language Models
par: Wei, Tianxin, et autres
Publié: (2026)
par: Wei, Tianxin, et autres
Publié: (2026)
GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models
par: 5 Team, et autres
Publié: (2025)
par: 5 Team, et autres
Publié: (2025)
Incentivizing Agentic Reasoning in LLM Judges via Tool-Integrated Reinforcement Learning
par: Xu, Ran, et autres
Publié: (2025)
par: Xu, Ran, et autres
Publié: (2025)
AgentV-RL: Scaling Reward Modeling with Agentic Verifier
par: Zhang, Jiazheng, et autres
Publié: (2026)
par: Zhang, Jiazheng, et autres
Publié: (2026)
THOR: Tool-Integrated Hierarchical Optimization via RL for Mathematical Reasoning
par: Chang, Qikai, et autres
Publié: (2025)
par: Chang, Qikai, et autres
Publié: (2025)
Scaling Code-Assisted Chain-of-Thoughts and Instructions for Model Reasoning
par: Lin, Honglin, et autres
Publié: (2025)
par: Lin, Honglin, et autres
Publié: (2025)
START: Self-taught Reasoner with Tools
par: Li, Chengpeng, et autres
Publié: (2025)
par: Li, Chengpeng, et autres
Publié: (2025)
Eliminating Agentic Workflow for Introduction Generation with Parametric Stage Tokens
par: Zhang, Meicong, et autres
Publié: (2025)
par: Zhang, Meicong, et autres
Publié: (2025)
Multi-Step Visual Reasoning with Visual Tokens Scaling and Verification
par: Bai, Tianyi, et autres
Publié: (2025)
par: Bai, Tianyi, et autres
Publié: (2025)
LongCat-Flash-Prover: Advancing Native Formal Reasoning via Agentic Tool-Integrated Reinforcement Learning
par: Wang, Jianing, et autres
Publié: (2026)
par: Wang, Jianing, et autres
Publié: (2026)
Team of Thoughts: Efficient Test-time Scaling of Agentic Systems through Orchestrated Tool Calling
par: Wong, Jeffrey T. H., et autres
Publié: (2026)
par: Wong, Jeffrey T. H., et autres
Publié: (2026)
Search-o1: Agentic Search-Enhanced Large Reasoning Models
par: Li, Xiaoxi, et autres
Publié: (2025)
par: Li, Xiaoxi, et autres
Publié: (2025)
An Agentic Approach to Generating XAI-Narratives
par: He, Yifan, et autres
Publié: (2026)
par: He, Yifan, et autres
Publié: (2026)
Generalist Reward Models: Found Inside Large Language Models
par: Li, Yi-Chen, et autres
Publié: (2025)
par: Li, Yi-Chen, et autres
Publié: (2025)
LLMs Improving LLMs: Agentic Discovery for Test-Time Scaling
par: Zheng, Tong, et autres
Publié: (2026)
par: Zheng, Tong, et autres
Publié: (2026)
Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning
par: Jin, Bowen, et autres
Publié: (2025)
par: Jin, Bowen, et autres
Publié: (2025)
AgenticRAGTracer: A Hop-Aware Benchmark for Diagnosing Multi-Step Retrieval Reasoning in Agentic RAG
par: You, Qijie, et autres
Publié: (2026)
par: You, Qijie, et autres
Publié: (2026)
Documents similaires
-
Sentence-level Reward Model can Generalize Better for Aligning LLM from Human Preference
par: Qiu, Wenjie, et autres
Publié: (2025) -
AutoTool: Dynamic Tool Selection and Integration for Agentic Reasoning
par: Zou, Jiaru, et autres
Publié: (2025) -
Scaling Agentic Reinforcement Learning for Tool-Integrated Reasoning in VLMs
par: Lu, Meng, et autres
Publié: (2025) -
Agentic Reasoning: A Streamlined Framework for Enhancing LLM Reasoning with Agentic Tools
par: Wu, Junde, et autres
Publié: (2025) -
When to Trust Tools? Adaptive Tool Trust Calibration For Tool-Integrated Math Reasoning
par: Xu, Ruotao, et autres
Publié: (2026)