Salvato in:
| Autori principali: | Xu, Bowen, Wu, Shaoyu, Jiang, Hao, Liu, Kai, Chen, Xin, Hu, Lulu, Yang, Bin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.02160 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mixture-of-Instructions: Aligning Large Language Models via Mixture Prompting
di: Xu, Bowen, et al.
Pubblicazione: (2024)
di: Xu, Bowen, et al.
Pubblicazione: (2024)
La RoSA: Enhancing LLM Efficiency via Layerwise Rotated Sparse Activation
di: Liu, Kai, et al.
Pubblicazione: (2025)
di: Liu, Kai, et al.
Pubblicazione: (2025)
Incentivizing Agentic Reasoning in LLM Judges via Tool-Integrated Reinforcement Learning
di: Xu, Ran, et al.
Pubblicazione: (2025)
di: Xu, Ran, et al.
Pubblicazione: (2025)
CORE: A Conceptual Reasoning Layer for Large Language Models
di: Hegde, Vishwas, et al.
Pubblicazione: (2025)
di: Hegde, Vishwas, et al.
Pubblicazione: (2025)
Agentic Tool Use in Large Language Models
di: Hu, Jinchao, et al.
Pubblicazione: (2026)
di: Hu, Jinchao, et al.
Pubblicazione: (2026)
DentalGPT: Incentivizing Multimodal Complex Reasoning in Dentistry
di: Cai, Zhenyang, et al.
Pubblicazione: (2025)
di: Cai, Zhenyang, et al.
Pubblicazione: (2025)
LogicReward: Incentivizing LLM Reasoning via Step-Wise Logical Supervision
di: Xu, Jundong, et al.
Pubblicazione: (2025)
di: Xu, Jundong, et al.
Pubblicazione: (2025)
OctoTools: An Agentic Framework with Extensible Tools for Complex Reasoning
di: Lu, Pan, et al.
Pubblicazione: (2025)
di: Lu, Pan, et al.
Pubblicazione: (2025)
Mitigating Prompt-Induced Hallucinations in Large Language Models via Structured Reasoning
di: Hao, Jinbo, et al.
Pubblicazione: (2026)
di: Hao, Jinbo, et al.
Pubblicazione: (2026)
Incentivizing Dual Process Thinking for Efficient Large Language Model Reasoning
di: Cheng, Xiaoxue, et al.
Pubblicazione: (2025)
di: Cheng, Xiaoxue, et al.
Pubblicazione: (2025)
Meta-Reasoning Improves Tool Use in Large Language Models
di: Alazraki, Lisa, et al.
Pubblicazione: (2024)
di: Alazraki, Lisa, et al.
Pubblicazione: (2024)
Learning How to Use Tools, Not Just When: Pattern-Aware Tool-Integrated Reasoning
di: Xu, Ningning, et al.
Pubblicazione: (2025)
di: Xu, Ningning, et al.
Pubblicazione: (2025)
Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models
di: Huang, Wenxuan, et al.
Pubblicazione: (2025)
di: Huang, Wenxuan, et al.
Pubblicazione: (2025)
TL-Training: A Task-Feature-Based Framework for Training Large Language Models in Tool Use
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
AgentMath: Empowering Mathematical Reasoning for Large Language Models via Tool-Augmented Agent
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
di: Luo, Haipeng, et al.
Pubblicazione: (2025)
AWPO: Enhancing Tool-Use of Large Language Models through Adaptive Integration of Reasoning Rewards
di: Lin, Zihan, et al.
Pubblicazione: (2025)
di: Lin, Zihan, et al.
Pubblicazione: (2025)
LearNAT: Learning NL2SQL with AST-guided Task Decomposition for Large Language Models
di: Liao, Weibin, et al.
Pubblicazione: (2025)
di: Liao, Weibin, et al.
Pubblicazione: (2025)
A Stepwise-Enhanced Reasoning Framework for Large Language Models Based on External Subgraph Generation
di: Zhang, Xin, et al.
Pubblicazione: (2025)
di: Zhang, Xin, et al.
Pubblicazione: (2025)
Textualized Agent-Style Reasoning for Complex Tasks by Multiple Round LLM Generation
di: Liang, Chen, et al.
Pubblicazione: (2024)
di: Liang, Chen, et al.
Pubblicazione: (2024)
DRP: Distilled Reasoning Pruning with Skill-aware Step Decomposition for Efficient Large Reasoning Models
di: Jiang, Yuxuan, et al.
Pubblicazione: (2025)
di: Jiang, Yuxuan, et al.
Pubblicazione: (2025)
MMESGBench: Pioneering Multimodal Understanding and Complex Reasoning Benchmark for ESG Tasks
di: Zhang, Lei, et al.
Pubblicazione: (2025)
di: Zhang, Lei, et al.
Pubblicazione: (2025)
FinEval-KR: A Financial Domain Evaluation Framework for Large Language Models' Knowledge and Reasoning
di: Dou, Shaoyu, et al.
Pubblicazione: (2025)
di: Dou, Shaoyu, et al.
Pubblicazione: (2025)
Incentivizing Reasoning for Advanced Instruction-Following of Large Language Models
di: Qin, Yulei, et al.
Pubblicazione: (2025)
di: Qin, Yulei, et al.
Pubblicazione: (2025)
Context Reasoner: Incentivizing Reasoning Capability for Contextualized Privacy and Safety Compliance via Reinforcement Learning
di: Hu, Wenbin, et al.
Pubblicazione: (2025)
di: Hu, Wenbin, et al.
Pubblicazione: (2025)
Reinforcement Learning with Verifiable Rewards Implicitly Incentivizes Correct Reasoning in Base LLMs
di: Wen, Xumeng, et al.
Pubblicazione: (2025)
di: Wen, Xumeng, et al.
Pubblicazione: (2025)
MetaTool Benchmark for Large Language Models: Deciding Whether to Use Tools and Which to Use
di: Huang, Yue, et al.
Pubblicazione: (2023)
di: Huang, Yue, et al.
Pubblicazione: (2023)
TrajSelector: Harnessing Latent Representations for Efficient and Effective Best-of-N in Large Reasoning Model
di: Yu, Bin, et al.
Pubblicazione: (2025)
di: Yu, Bin, et al.
Pubblicazione: (2025)
Alignment for Efficient Tool Calling of Large Language Models
di: Xu, Hongshen, et al.
Pubblicazione: (2025)
di: Xu, Hongshen, et al.
Pubblicazione: (2025)
Atlas: Orchestrating Heterogeneous Models and Tools for Multi-Domain Complex Reasoning
di: Wu, Jinyang, et al.
Pubblicazione: (2026)
di: Wu, Jinyang, et al.
Pubblicazione: (2026)
Med-U1: Incentivizing Unified Medical Reasoning in LLMs via Large-scale Reinforcement Learning
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
MR-Align: Meta-Reasoning Informed Factuality Alignment for Large Reasoning Models
di: Wang, Xinming, et al.
Pubblicazione: (2025)
di: Wang, Xinming, et al.
Pubblicazione: (2025)
TInR: Exploring Tool-Internalized Reasoning in Large Language Models
di: Xu, Qiancheng, et al.
Pubblicazione: (2026)
di: Xu, Qiancheng, et al.
Pubblicazione: (2026)
Beyond Token-Level Policy Gradients for Complex Reasoning with Large Language Models
di: Xu, Mufan, et al.
Pubblicazione: (2026)
di: Xu, Mufan, et al.
Pubblicazione: (2026)
Thinking-Free Policy Initialization Makes Distilled Reasoning Models More Effective and Efficient Reasoners
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning
di: Cheng, Qianjia, et al.
Pubblicazione: (2026)
di: Cheng, Qianjia, et al.
Pubblicazione: (2026)
A Large Language Model Based Method for Complex Logical Reasoning over Knowledge Graphs
di: Zhang, Ziyan, et al.
Pubblicazione: (2025)
di: Zhang, Ziyan, et al.
Pubblicazione: (2025)
Probing Large Language Models in Reasoning and Translating Complex Linguistic Puzzles
di: Lin, Zheng-Lin, et al.
Pubblicazione: (2025)
di: Lin, Zheng-Lin, et al.
Pubblicazione: (2025)
ToolACE-DEV: Self-Improving Tool Learning via Decomposition and EVolution
di: Huang, Xu, et al.
Pubblicazione: (2025)
di: Huang, Xu, et al.
Pubblicazione: (2025)
ToolHop: A Query-Driven Benchmark for Evaluating Large Language Models in Multi-Hop Tool Use
di: Ye, Junjie, et al.
Pubblicazione: (2025)
di: Ye, Junjie, et al.
Pubblicazione: (2025)
How to Fine-Tune a Reasoning Model? A Teacher-Student Cooperation Framework to Synthesize Student-Consistent SFT Data
di: Huang, Zixian, et al.
Pubblicazione: (2026)
di: Huang, Zixian, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Mixture-of-Instructions: Aligning Large Language Models via Mixture Prompting
di: Xu, Bowen, et al.
Pubblicazione: (2024) -
La RoSA: Enhancing LLM Efficiency via Layerwise Rotated Sparse Activation
di: Liu, Kai, et al.
Pubblicazione: (2025) -
Incentivizing Agentic Reasoning in LLM Judges via Tool-Integrated Reinforcement Learning
di: Xu, Ran, et al.
Pubblicazione: (2025) -
CORE: A Conceptual Reasoning Layer for Large Language Models
di: Hegde, Vishwas, et al.
Pubblicazione: (2025) -
Agentic Tool Use in Large Language Models
di: Hu, Jinchao, et al.
Pubblicazione: (2026)