Salvato in:
| Autori principali: | Yang, Cheng, Lu, Jiaxuan, Wan, Haiyuan, Yu, Junchi, Qin, Feiwei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2509.23768 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond Static Tools: Test-Time Tool Evolution for Scientific Reasoning
di: Lu, Jiaxuan, et al.
Pubblicazione: (2026)
di: Lu, Jiaxuan, et al.
Pubblicazione: (2026)
Thought Propagation: An Analogical Approach to Complex Reasoning with Large Language Models
di: Yu, Junchi, et al.
Pubblicazione: (2023)
di: Yu, Junchi, et al.
Pubblicazione: (2023)
When AI Agents Collude Online: Financial Fraud Risks by Collaborative LLM Agents on Social Platforms
di: Ren, Qibing, et al.
Pubblicazione: (2025)
di: Ren, Qibing, et al.
Pubblicazione: (2025)
When Autonomy Goes Rogue: Preparing for Risks of Multi-Agent Collusion in Social Systems
di: Ren, Qibing, et al.
Pubblicazione: (2025)
di: Ren, Qibing, et al.
Pubblicazione: (2025)
From Query to Counsel: Structured Reasoning with a Multi-Agent Framework and Dataset for Legal Consultation
di: Lu, Mingfei, et al.
Pubblicazione: (2026)
di: Lu, Mingfei, et al.
Pubblicazione: (2026)
Reasoning via Video: The First Evaluation of Video Models' Reasoning Abilities through Maze-Solving Tasks
di: Yang, Cheng, et al.
Pubblicazione: (2025)
di: Yang, Cheng, et al.
Pubblicazione: (2025)
Table as Thought: Exploring Structured Thoughts in LLM Reasoning
di: Sun, Zhenjie, et al.
Pubblicazione: (2025)
di: Sun, Zhenjie, et al.
Pubblicazione: (2025)
Adaptive Stopping for Multi-Turn LLM Reasoning
di: Zhou, Xiaofan, et al.
Pubblicazione: (2026)
di: Zhou, Xiaofan, et al.
Pubblicazione: (2026)
Learning to Break: Knowledge-Enhanced Reasoning in Multi-Agent Debate System
di: Wang, Haotian, et al.
Pubblicazione: (2023)
di: Wang, Haotian, et al.
Pubblicazione: (2023)
From Self-Evolving Synthetic Data to Verifiable-Reward RL: Post-Training Multi-turn Interactive Tool-Using Agents
di: Gao, Jiaxuan, et al.
Pubblicazione: (2026)
di: Gao, Jiaxuan, et al.
Pubblicazione: (2026)
VAGEN: Reinforcing World Model Reasoning for Multi-Turn VLM Agents
di: Wang, Kangrui, et al.
Pubblicazione: (2025)
di: Wang, Kangrui, et al.
Pubblicazione: (2025)
MASLegalBench: Benchmarking Multi-Agent Systems in Deductive Legal Reasoning
di: Jing, Huihao, et al.
Pubblicazione: (2025)
di: Jing, Huihao, et al.
Pubblicazione: (2025)
Tell Me Why: Designing an Explainable LLM-based Dialogue System for Student Problem Behavior Diagnosis
di: Fan, Zhilin, et al.
Pubblicazione: (2026)
di: Fan, Zhilin, et al.
Pubblicazione: (2026)
Unlocking the Power of Multi-Agent LLM for Reasoning: From Lazy Agents to Deliberation
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
From What to Why: Thought-Space Recommendation with Small Language Models
di: Biswas, Prosenjit, et al.
Pubblicazione: (2025)
di: Biswas, Prosenjit, et al.
Pubblicazione: (2025)
ConsistencyChecker: Tree-based Evaluation of LLM Generalization Capabilities
di: Hong, Zhaochen, et al.
Pubblicazione: (2025)
di: Hong, Zhaochen, et al.
Pubblicazione: (2025)
POLIS-Bench: Towards Multi-Dimensional Evaluation of LLMs for Bilingual Policy Tasks in Governmental Scenarios
di: Yang, Tingyue, et al.
Pubblicazione: (2025)
di: Yang, Tingyue, et al.
Pubblicazione: (2025)
From Evidence to Trajectory: Abductive Reasoning Path Synthesis for Training Retrieval-Augmented Generation Agents
di: Li, Muzhi, et al.
Pubblicazione: (2025)
di: Li, Muzhi, et al.
Pubblicazione: (2025)
Conditional Advantage Estimation for Reinforcement Learning in Large Reasoning Models
di: Chen, Guanxu, et al.
Pubblicazione: (2025)
di: Chen, Guanxu, et al.
Pubblicazione: (2025)
Towards Multi-Agent Reasoning Systems for Collaborative Expertise Delegation: An Exploratory Design Study
di: Xu, Baixuan, et al.
Pubblicazione: (2025)
di: Xu, Baixuan, et al.
Pubblicazione: (2025)
QuestA: Expanding Reasoning Capacity in LLMs via Question Augmentation
di: Li, Jiazheng, et al.
Pubblicazione: (2025)
di: Li, Jiazheng, et al.
Pubblicazione: (2025)
MIRIX: Multi-Agent Memory System for LLM-Based Agents
di: Wang, Yu, et al.
Pubblicazione: (2025)
di: Wang, Yu, et al.
Pubblicazione: (2025)
SciAgent: A Unified Multi-Agent System for Generalistic Scientific Reasoning
di: Li, Xuchen, et al.
Pubblicazione: (2025)
di: Li, Xuchen, et al.
Pubblicazione: (2025)
How Far Are We from Optimal Reasoning Efficiency?
di: Gao, Jiaxuan, et al.
Pubblicazione: (2025)
di: Gao, Jiaxuan, et al.
Pubblicazione: (2025)
Evaluating Social Bias in RAG Systems: When External Context Helps and Reasoning Hurts
di: Parihar, Shweta, et al.
Pubblicazione: (2026)
di: Parihar, Shweta, et al.
Pubblicazione: (2026)
PhysicsMinions: Winning Gold Medals in the Latest Physics Olympiads with a Coevolutionary Multimodal Multi-Agent System
di: Yu, Fangchen, et al.
Pubblicazione: (2025)
di: Yu, Fangchen, et al.
Pubblicazione: (2025)
ChemAgent: Self-updating Library in Large Language Models Improves Chemical Reasoning
di: Tang, Xiangru, et al.
Pubblicazione: (2025)
di: Tang, Xiangru, et al.
Pubblicazione: (2025)
Optima: Optimizing Effectiveness and Efficiency for LLM-Based Multi-Agent System
di: Chen, Weize, et al.
Pubblicazione: (2024)
di: Chen, Weize, et al.
Pubblicazione: (2024)
DeepResearch Arena: The First Exam of LLMs' Research Abilities via Seminar-Grounded Tasks
di: Wan, Haiyuan, et al.
Pubblicazione: (2025)
di: Wan, Haiyuan, et al.
Pubblicazione: (2025)
What Really Improves Mathematical Reasoning: Structured Reasoning Signals Beyond Pure Code
di: Zhao, Yuze, et al.
Pubblicazione: (2026)
di: Zhao, Yuze, et al.
Pubblicazione: (2026)
PACE: A Pragmatic Agent for Enhancing Communication Efficiency Using Large Language Models
di: Li, Jiaxuan, et al.
Pubblicazione: (2024)
di: Li, Jiaxuan, et al.
Pubblicazione: (2024)
The Flexibility Trap: Why Arbitrary Order Limits Reasoning Potential in Diffusion Language Models
di: Ni, Zanlin, et al.
Pubblicazione: (2026)
di: Ni, Zanlin, et al.
Pubblicazione: (2026)
IMAGINE: Integrating Multi-Agent System into One Model for Complex Reasoning and Planning
di: Zhang, Xikai, et al.
Pubblicazione: (2025)
di: Zhang, Xikai, et al.
Pubblicazione: (2025)
TrajTok: Technical Report for 2025 Waymo Open Sim Agents Challenge
di: Zhang, Zhiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Zhiyuan, et al.
Pubblicazione: (2025)
MDCR: A Dataset for Multi-Document Conditional Reasoning
di: Chen, Peter Baile, et al.
Pubblicazione: (2024)
di: Chen, Peter Baile, et al.
Pubblicazione: (2024)
Creativity in LLM-based Multi-Agent Systems: A Survey
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2025)
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2025)
TodoEvolve: Learning to Architect Agent Planning Systems
di: Liu, Jiaxi, et al.
Pubblicazione: (2026)
di: Liu, Jiaxi, et al.
Pubblicazione: (2026)
What Defines Good Reasoning in LLMs? Dissecting Reasoning Steps with Multi-Aspect Evaluation
di: Do, Heejin, et al.
Pubblicazione: (2025)
di: Do, Heejin, et al.
Pubblicazione: (2025)
Dive into the Agent Matrix: A Realistic Evaluation of Self-Replication Risk in LLM Agents
di: Zhang, Boxuan, et al.
Pubblicazione: (2025)
di: Zhang, Boxuan, et al.
Pubblicazione: (2025)
SocialVeil: Probing Social Intelligence of Language Agents under Communication Barriers
di: Xuan, Keyang, et al.
Pubblicazione: (2026)
di: Xuan, Keyang, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Beyond Static Tools: Test-Time Tool Evolution for Scientific Reasoning
di: Lu, Jiaxuan, et al.
Pubblicazione: (2026) -
Thought Propagation: An Analogical Approach to Complex Reasoning with Large Language Models
di: Yu, Junchi, et al.
Pubblicazione: (2023) -
When AI Agents Collude Online: Financial Fraud Risks by Collaborative LLM Agents on Social Platforms
di: Ren, Qibing, et al.
Pubblicazione: (2025) -
When Autonomy Goes Rogue: Preparing for Risks of Multi-Agent Collusion in Social Systems
di: Ren, Qibing, et al.
Pubblicazione: (2025) -
From Query to Counsel: Structured Reasoning with a Multi-Agent Framework and Dataset for Legal Consultation
di: Lu, Mingfei, et al.
Pubblicazione: (2026)