ASTER: Agentic Scaling with Tool-integrated Extended Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Xuqin, He, Quan, Zheng, Zhenrui, Zhang, Zongzhang, He, Xu, Li, Dong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Sentence-level Reward Model can Generalize Better for Aligning LLM from Human Preference
di: Qiu, Wenjie, et al.
Pubblicazione: (2025)
di: Qiu, Wenjie, et al.
Pubblicazione: (2025)
AutoTool: Dynamic Tool Selection and Integration for Agentic Reasoning
di: Zou, Jiaru, et al.
Pubblicazione: (2025)
di: Zou, Jiaru, et al.
Pubblicazione: (2025)
Scaling Agentic Reinforcement Learning for Tool-Integrated Reasoning in VLMs
di: Lu, Meng, et al.
Pubblicazione: (2025)
di: Lu, Meng, et al.
Pubblicazione: (2025)
Agentic Reasoning: A Streamlined Framework for Enhancing LLM Reasoning with Agentic Tools
di: Wu, Junde, et al.
Pubblicazione: (2025)
di: Wu, Junde, et al.
Pubblicazione: (2025)
When to Trust Tools? Adaptive Tool Trust Calibration For Tool-Integrated Math Reasoning
di: Xu, Ruotao, et al.
Pubblicazione: (2026)
di: Xu, Ruotao, et al.
Pubblicazione: (2026)
Scaling Agentic Verifier for Competitive Coding
di: Ma, Zeyao, et al.
Pubblicazione: (2026)
di: Ma, Zeyao, et al.
Pubblicazione: (2026)
AgenticQwen: Training Small Agentic Language Models with Dual Data Flywheels for Industrial-Scale Tool Use
di: Lyu, Yuanjie, et al.
Pubblicazione: (2026)
di: Lyu, Yuanjie, et al.
Pubblicazione: (2026)
MedOrch: Medical Diagnosis with Tool-Augmented Reasoning Agents for Flexible Extensibility
di: He, Yexiao, et al.
Pubblicazione: (2025)
di: He, Yexiao, et al.
Pubblicazione: (2025)
Open-Vocabulary Federated Learning with Multimodal Prototyping
di: Zeng, Huimin, et al.
Pubblicazione: (2024)
di: Zeng, Huimin, et al.
Pubblicazione: (2024)
rStar2-Agent: Agentic Reasoning Technical Report
di: Shang, Ning, et al.
Pubblicazione: (2025)
di: Shang, Ning, et al.
Pubblicazione: (2025)
GeoBrowse: A Geolocation Benchmark for Agentic Tool Use with Expert-Annotated Reasoning Traces
di: Geng, Xinyu, et al.
Pubblicazione: (2026)
di: Geng, Xinyu, et al.
Pubblicazione: (2026)
Scaling Medical Reasoning Verification via Tool-Integrated Reinforcement Learning
di: Zhang, Hang, et al.
Pubblicazione: (2026)
di: Zhang, Hang, et al.
Pubblicazione: (2026)
Agentic Tool Use in Large Language Models
di: Hu, Jinchao, et al.
Pubblicazione: (2026)
di: Hu, Jinchao, et al.
Pubblicazione: (2026)
OctoTools: An Agentic Framework with Extensible Tools for Complex Reasoning
di: Lu, Pan, et al.
Pubblicazione: (2025)
di: Lu, Pan, et al.
Pubblicazione: (2025)
ToolOmni: Enabling Open-World Tool Use via Agentic learning with Proactive Retrieval and Grounded Execution
di: Huang, Shouzheng, et al.
Pubblicazione: (2026)
di: Huang, Shouzheng, et al.
Pubblicazione: (2026)
PyVision: Agentic Vision with Dynamic Tooling
di: Zhao, Shitian, et al.
Pubblicazione: (2025)
di: Zhao, Shitian, et al.
Pubblicazione: (2025)
Hybrid Latent Reasoning via Reinforcement Learning
di: Yue, Zhenrui, et al.
Pubblicazione: (2025)
di: Yue, Zhenrui, et al.
Pubblicazione: (2025)
A Survey of Frontiers in LLM Reasoning: Inference Scaling, Learning to Reason, and Agentic Systems
di: Ke, Zixuan, et al.
Pubblicazione: (2025)
di: Ke, Zixuan, et al.
Pubblicazione: (2025)
Improving Sample Efficiency of Reinforcement Learning with Background Knowledge from Large Language Models
di: Zhang, Fuxiang, et al.
Pubblicazione: (2024)
di: Zhang, Fuxiang, et al.
Pubblicazione: (2024)
GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models
di: 5 Team, et al.
Pubblicazione: (2025)
di: 5 Team, et al.
Pubblicazione: (2025)
LRAS: Advanced Legal Reasoning with Agentic Search
di: Zhou, Yujin, et al.
Pubblicazione: (2026)
di: Zhou, Yujin, et al.
Pubblicazione: (2026)
START: Self-taught Reasoner with Tools
di: Li, Chengpeng, et al.
Pubblicazione: (2025)
di: Li, Chengpeng, et al.
Pubblicazione: (2025)
Agentic Reasoning for Large Language Models
di: Wei, Tianxin, et al.
Pubblicazione: (2026)
di: Wei, Tianxin, et al.
Pubblicazione: (2026)
Scaling Code-Assisted Chain-of-Thoughts and Instructions for Model Reasoning
di: Lin, Honglin, et al.
Pubblicazione: (2025)
di: Lin, Honglin, et al.
Pubblicazione: (2025)
Incentivizing Agentic Reasoning in LLM Judges via Tool-Integrated Reinforcement Learning
di: Xu, Ran, et al.
Pubblicazione: (2025)
di: Xu, Ran, et al.
Pubblicazione: (2025)
An Agentic Approach to Generating XAI-Narratives
di: He, Yifan, et al.
Pubblicazione: (2026)
di: He, Yifan, et al.
Pubblicazione: (2026)
AgenticRAGTracer: A Hop-Aware Benchmark for Diagnosing Multi-Step Retrieval Reasoning in Agentic RAG
di: You, Qijie, et al.
Pubblicazione: (2026)
di: You, Qijie, et al.
Pubblicazione: (2026)
AgentV-RL: Scaling Reward Modeling with Agentic Verifier
di: Zhang, Jiazheng, et al.
Pubblicazione: (2026)
di: Zhang, Jiazheng, et al.
Pubblicazione: (2026)
LongCat-Flash-Prover: Advancing Native Formal Reasoning via Agentic Tool-Integrated Reinforcement Learning
di: Wang, Jianing, et al.
Pubblicazione: (2026)
di: Wang, Jianing, et al.
Pubblicazione: (2026)
LLMs Improving LLMs: Agentic Discovery for Test-Time Scaling
di: Zheng, Tong, et al.
Pubblicazione: (2026)
di: Zheng, Tong, et al.
Pubblicazione: (2026)
Eliminating Agentic Workflow for Introduction Generation with Parametric Stage Tokens
di: Zhang, Meicong, et al.
Pubblicazione: (2025)
di: Zhang, Meicong, et al.
Pubblicazione: (2025)
THOR: Tool-Integrated Hierarchical Optimization via RL for Mathematical Reasoning
di: Chang, Qikai, et al.
Pubblicazione: (2025)
di: Chang, Qikai, et al.
Pubblicazione: (2025)
Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning
di: Cheng, Qianjia, et al.
Pubblicazione: (2026)
di: Cheng, Qianjia, et al.
Pubblicazione: (2026)
Evidence-Driven Retrieval Augmented Response Generation for Online Misinformation
di: Yue, Zhenrui, et al.
Pubblicazione: (2024)
di: Yue, Zhenrui, et al.
Pubblicazione: (2024)
Retrieval Augmented Fact Verification by Synthesizing Contrastive Arguments
di: Yue, Zhenrui, et al.
Pubblicazione: (2024)
di: Yue, Zhenrui, et al.
Pubblicazione: (2024)
From Reasoning to Agentic: Credit Assignment in Reinforcement Learning for Large Language Models
di: Zhang, Chenchen
Pubblicazione: (2026)
di: Zhang, Chenchen
Pubblicazione: (2026)
BP4ER: Bootstrap Prompting for Explicit Reasoning in Medical Dialogue Generation
di: He, Yuhong, et al.
Pubblicazione: (2024)
di: He, Yuhong, et al.
Pubblicazione: (2024)
Team of Thoughts: Efficient Test-time Scaling of Agentic Systems through Orchestrated Tool Calling
di: Wong, Jeffrey T. H., et al.
Pubblicazione: (2026)
di: Wong, Jeffrey T. H., et al.
Pubblicazione: (2026)
Inference Scaling for Long-Context Retrieval Augmented Generation
di: Yue, Zhenrui, et al.
Pubblicazione: (2024)
di: Yue, Zhenrui, et al.
Pubblicazione: (2024)
Multi-Step Visual Reasoning with Visual Tokens Scaling and Verification
di: Bai, Tianyi, et al.
Pubblicazione: (2025)
di: Bai, Tianyi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Sentence-level Reward Model can Generalize Better for Aligning LLM from Human Preference
di: Qiu, Wenjie, et al.
Pubblicazione: (2025) -
AutoTool: Dynamic Tool Selection and Integration for Agentic Reasoning
di: Zou, Jiaru, et al.
Pubblicazione: (2025) -
Scaling Agentic Reinforcement Learning for Tool-Integrated Reasoning in VLMs
di: Lu, Meng, et al.
Pubblicazione: (2025) -
Agentic Reasoning: A Streamlined Framework for Enhancing LLM Reasoning with Agentic Tools
di: Wu, Junde, et al.
Pubblicazione: (2025) -
When to Trust Tools? Adaptive Tool Trust Calibration For Tool-Integrated Math Reasoning
di: Xu, Ruotao, et al.
Pubblicazione: (2026)