Toward Effective Tool-Integrated Reasoning via Self-Evolved Preference Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Yifei, Dong, Guanting, Dou, Zhicheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ET-Agent: Incentivizing Effective Tool-Integrated Reasoning Agent via Behavior Calibration
di: Chen, Yifei, et al.
Pubblicazione: (2026)
di: Chen, Yifei, et al.
Pubblicazione: (2026)
ToolScope: An Agentic Framework for Vision-Guided and Long-Horizon Tool Use
di: Deng, Mengjie, et al.
Pubblicazione: (2025)
di: Deng, Mengjie, et al.
Pubblicazione: (2025)
Revisiting RAG Ensemble: A Theoretical and Mechanistic Analysis of Multi-RAG System Collaboration
di: Chen, Yifei, et al.
Pubblicazione: (2025)
di: Chen, Yifei, et al.
Pubblicazione: (2025)
Tool-Star: Empowering LLM-Brained Multi-Tool Reasoner via Reinforcement Learning
di: Dong, Guanting, et al.
Pubblicazione: (2025)
di: Dong, Guanting, et al.
Pubblicazione: (2025)
SmartSearch: Process Reward-Guided Query Refinement for Search Agents
di: Wen, Tongyu, et al.
Pubblicazione: (2026)
di: Wen, Tongyu, et al.
Pubblicazione: (2026)
Towards Mixed-Modal Retrieval for Universal Retrieval-Augmented Generation
di: Zhang, Chenghao, et al.
Pubblicazione: (2025)
di: Zhang, Chenghao, et al.
Pubblicazione: (2025)
Towards Verifiable Multimodal Deep Research: A Multi-Agent Harness for Interleaved Report Generation
di: Zhang, Chenghao, et al.
Pubblicazione: (2026)
di: Zhang, Chenghao, et al.
Pubblicazione: (2026)
EnvScaler: Scaling Tool-Interactive Environments for LLM Agent via Programmatic Synthesis
di: Song, Xiaoshuai, et al.
Pubblicazione: (2026)
di: Song, Xiaoshuai, et al.
Pubblicazione: (2026)
Understand What LLM Needs: Dual Preference Alignment for Retrieval-Augmented Generation
di: Dong, Guanting, et al.
Pubblicazione: (2024)
di: Dong, Guanting, et al.
Pubblicazione: (2024)
Progressive Multimodal Reasoning via Active Retrieval
di: Dong, Guanting, et al.
Pubblicazione: (2024)
di: Dong, Guanting, et al.
Pubblicazione: (2024)
Toward General Instruction-Following Alignment for Retrieval-Augmented Generation
di: Dong, Guanting, et al.
Pubblicazione: (2024)
di: Dong, Guanting, et al.
Pubblicazione: (2024)
MetaAgent: Toward Self-Evolving Agent via Tool Meta-Learning
di: Qian, Hongjin, et al.
Pubblicazione: (2025)
di: Qian, Hongjin, et al.
Pubblicazione: (2025)
Tools as Continuous Flow for Evolving Agentic Reasoning
di: Huang, Tairan, et al.
Pubblicazione: (2026)
di: Huang, Tairan, et al.
Pubblicazione: (2026)
Search-o1: Agentic Search-Enhanced Large Reasoning Models
di: Li, Xiaoxi, et al.
Pubblicazione: (2025)
di: Li, Xiaoxi, et al.
Pubblicazione: (2025)
HiRA: A Hierarchical Reasoning Framework for Decoupled Planning and Execution in Deep Search
di: Jin, Jiajie, et al.
Pubblicazione: (2025)
di: Jin, Jiajie, et al.
Pubblicazione: (2025)
Reasoning-Aware AIGC Detection via Alignment and Reinforcement
di: Wang, Zhao, et al.
Pubblicazione: (2026)
di: Wang, Zhao, et al.
Pubblicazione: (2026)
WebThinker: Empowering Large Reasoning Models with Deep Research Capability
di: Li, Xiaoxi, et al.
Pubblicazione: (2025)
di: Li, Xiaoxi, et al.
Pubblicazione: (2025)
Self-Evolving Spatial Reasoning in Vision Language Models via Geometric Logic Consistency
di: Liu, Junming, et al.
Pubblicazione: (2026)
di: Liu, Junming, et al.
Pubblicazione: (2026)
Agent0-VL: Exploring Self-Evolving Agent for Tool-Integrated Vision-Language Reasoning
di: Liu, Jiaqi, et al.
Pubblicazione: (2025)
di: Liu, Jiaqi, et al.
Pubblicazione: (2025)
TimelineReasoner: Advancing Timeline Summarization with Large Reasoning Models
di: Zhang, Liancheng, et al.
Pubblicazione: (2026)
di: Zhang, Liancheng, et al.
Pubblicazione: (2026)
Agentic Reasoning and Tool Integration for LLMs via Reinforcement Learning
di: Singh, Joykirat, et al.
Pubblicazione: (2025)
di: Singh, Joykirat, et al.
Pubblicazione: (2025)
Evolving from Tool User to Creator via Training-Free Experience Reuse in Multimodal Reasoning
di: Shen, Xintian, et al.
Pubblicazione: (2026)
di: Shen, Xintian, et al.
Pubblicazione: (2026)
MindWatcher: Toward Smarter Multimodal Tool-Integrated Reasoning
di: Chen, Jiawei, et al.
Pubblicazione: (2025)
di: Chen, Jiawei, et al.
Pubblicazione: (2025)
Learning to Build the Environment: Self-Evolving Reasoning RL via Verifiable Environment Synthesis
di: Shi, Yucheng, et al.
Pubblicazione: (2026)
di: Shi, Yucheng, et al.
Pubblicazione: (2026)
Learning Active Perception via Self-Evolving Preference Optimization for GUI Grounding
di: Wang, Wanfu, et al.
Pubblicazione: (2025)
di: Wang, Wanfu, et al.
Pubblicazione: (2025)
LC-ERD: Mining Latent Logic for Self-Evolving Reasoning via Consistency-Regulated Reward Decomposition
di: Chen, Yanyu, et al.
Pubblicazione: (2026)
di: Chen, Yanyu, et al.
Pubblicazione: (2026)
RecNet: Self-Evolving Preference Propagation for Agentic Recommender Systems
di: Li, Bingqian, et al.
Pubblicazione: (2026)
di: Li, Bingqian, et al.
Pubblicazione: (2026)
Towards Effective Code-Integrated Reasoning
di: Bai, Fei, et al.
Pubblicazione: (2025)
di: Bai, Fei, et al.
Pubblicazione: (2025)
Self-Evolved Preference Optimization for Enhancing Mathematical Reasoning in Small Language Models
di: Singh, Joykirat, et al.
Pubblicazione: (2025)
di: Singh, Joykirat, et al.
Pubblicazione: (2025)
Self-Evolving Curriculum for LLM Reasoning
di: Chen, Xiaoyin, et al.
Pubblicazione: (2025)
di: Chen, Xiaoyin, et al.
Pubblicazione: (2025)
PruneTIR: Inference-Time Tool Call Pruning for Effective yet Efficient Tool-Integrated Reasoning
di: Zhang, Luan, et al.
Pubblicazione: (2026)
di: Zhang, Luan, et al.
Pubblicazione: (2026)
DeepTool: Scaling Interleaved Deliberation in Tool-Integrated Reasoning via Process-Supervised Reinforcement Learning
di: He, Yang, et al.
Pubblicazione: (2026)
di: He, Yang, et al.
Pubblicazione: (2026)
Towards Efficient Multimodal Unified Reasoning Model via Model Merging
di: Yin, Qixiang, et al.
Pubblicazione: (2025)
di: Yin, Qixiang, et al.
Pubblicazione: (2025)
Learning to Self-Evolve
di: Chen, Xiaoyin, et al.
Pubblicazione: (2026)
di: Chen, Xiaoyin, et al.
Pubblicazione: (2026)
HyEvo: Self-Evolving Hybrid Agentic Workflows for Efficient Reasoning
di: Xu, Beibei, et al.
Pubblicazione: (2026)
di: Xu, Beibei, et al.
Pubblicazione: (2026)
DotaMath: Decomposition of Thought with Code Assistance and Self-correction for Mathematical Reasoning
di: Li, Chengpeng, et al.
Pubblicazione: (2024)
di: Li, Chengpeng, et al.
Pubblicazione: (2024)
GLARE: Agentic Reasoning for Legal Judgment Prediction
di: Yang, Xinyu, et al.
Pubblicazione: (2025)
di: Yang, Xinyu, et al.
Pubblicazione: (2025)
ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory
di: Ouyang, Siru, et al.
Pubblicazione: (2025)
di: Ouyang, Siru, et al.
Pubblicazione: (2025)
CharTool: Tool-Integrated Visual Reasoning for Chart Understanding
di: Zhang, Situo, et al.
Pubblicazione: (2026)
di: Zhang, Situo, et al.
Pubblicazione: (2026)
Scaling Medical Reasoning Verification via Tool-Integrated Reinforcement Learning
di: Zhang, Hang, et al.
Pubblicazione: (2026)
di: Zhang, Hang, et al.
Pubblicazione: (2026)
Documenti analoghi
-
ET-Agent: Incentivizing Effective Tool-Integrated Reasoning Agent via Behavior Calibration
di: Chen, Yifei, et al.
Pubblicazione: (2026) -
ToolScope: An Agentic Framework for Vision-Guided and Long-Horizon Tool Use
di: Deng, Mengjie, et al.
Pubblicazione: (2025) -
Revisiting RAG Ensemble: A Theoretical and Mechanistic Analysis of Multi-RAG System Collaboration
di: Chen, Yifei, et al.
Pubblicazione: (2025) -
Tool-Star: Empowering LLM-Brained Multi-Tool Reasoner via Reinforcement Learning
di: Dong, Guanting, et al.
Pubblicazione: (2025) -
SmartSearch: Process Reward-Guided Query Refinement for Search Agents
di: Wen, Tongyu, et al.
Pubblicazione: (2026)