Process-Supervised Reinforcement Learning for Interactive Multimodal Tool-Use Agents
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Tan, Weiting, Qu, Xinghua, Tu, Ming, Ge, Meng, Liu, Andy T., Koehn, Philipp, Lu, Lu |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
FlowPortrait: Reinforcement Learning for Audio-Driven Portrait Video Generation
von: Tan, Weiting, et al.
Veröffentlicht: (2026)
von: Tan, Weiting, et al.
Veröffentlicht: (2026)
Agents that Matter: Optimizing Multi-Agent LLMs via Removal-Based Attribution
von: Lu, Mingyu, et al.
Veröffentlicht: (2026)
von: Lu, Mingyu, et al.
Veröffentlicht: (2026)
You Only Align Once: Propagating Cooperative Behaviors in Multi-Agent Systems through Seed Agents
von: Hsing, Nicole, et al.
Veröffentlicht: (2026)
von: Hsing, Nicole, et al.
Veröffentlicht: (2026)
IBSEN: Director-Actor Agent Collaboration for Controllable and Interactive Drama Script Generation
von: Han, Senyu, et al.
Veröffentlicht: (2024)
von: Han, Senyu, et al.
Veröffentlicht: (2024)
Communication to Completion: Modeling Collaborative Workflows with Intelligent Multi-Agent Communication
von: Lu, Yiming, et al.
Veröffentlicht: (2025)
von: Lu, Yiming, et al.
Veröffentlicht: (2025)
In-the-Flow Agentic System Optimization for Effective Planning and Tool Use
von: Li, Zhuofeng, et al.
Veröffentlicht: (2025)
von: Li, Zhuofeng, et al.
Veröffentlicht: (2025)
Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
von: Yan, Sikuan, et al.
Veröffentlicht: (2025)
von: Yan, Sikuan, et al.
Veröffentlicht: (2025)
OPTAGENT: Optimizing Multi-Agent LLM Interactions Through Verbal Reinforcement Learning for Enhanced Reasoning
von: Bi, Zhenyu, et al.
Veröffentlicht: (2025)
von: Bi, Zhenyu, et al.
Veröffentlicht: (2025)
OralAgent: Integrating Reasoning, Tools, and Knowledge for Interactive Dental Image Analysis
von: Hao, Jing, et al.
Veröffentlicht: (2026)
von: Hao, Jing, et al.
Veröffentlicht: (2026)
ColorAgent: Building A Robust, Personalized, and Interactive OS Agent
von: Li, Ning, et al.
Veröffentlicht: (2025)
von: Li, Ning, et al.
Veröffentlicht: (2025)
Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems
von: Zhang, Shaokun, et al.
Veröffentlicht: (2025)
von: Zhang, Shaokun, et al.
Veröffentlicht: (2025)
TopoDIM: One-shot Topology Generation of Diverse Interaction Modes for Multi-Agent Systems
von: Sun, Rui, et al.
Veröffentlicht: (2026)
von: Sun, Rui, et al.
Veröffentlicht: (2026)
StitchCUDA: An Automated Multi-Agents End-to-End GPU Programing Framework with Rubric-based Agentic Reinforcement Learning
von: Li, Shiyang, et al.
Veröffentlicht: (2026)
von: Li, Shiyang, et al.
Veröffentlicht: (2026)
Multi-Agent Computer Use
von: Koh, Jing Yu, et al.
Veröffentlicht: (2026)
von: Koh, Jing Yu, et al.
Veröffentlicht: (2026)
Transformer-Based Scalable Multi-Agent Reinforcement Learning for Networked Systems with Long-Range Interactions
von: Sinha, Vidur, et al.
Veröffentlicht: (2025)
von: Sinha, Vidur, et al.
Veröffentlicht: (2025)
MAS-GPT: Training LLMs to Build LLM-based Multi-Agent Systems
von: Ye, Rui, et al.
Veröffentlicht: (2025)
von: Ye, Rui, et al.
Veröffentlicht: (2025)
When KV Cache Reuse Fails in Multi-Agent Systems: Cross-Candidate Interaction is Crucial for LLM Judges
von: Liang, Sichu, et al.
Veröffentlicht: (2026)
von: Liang, Sichu, et al.
Veröffentlicht: (2026)
Beyond Static Tools: Test-Time Tool Evolution for Scientific Reasoning
von: Lu, Jiaxuan, et al.
Veröffentlicht: (2026)
von: Lu, Jiaxuan, et al.
Veröffentlicht: (2026)
Safe Multi-agent Reinforcement Learning with Natural Language Constraints
von: Wang, Ziyan, et al.
Veröffentlicht: (2024)
von: Wang, Ziyan, et al.
Veröffentlicht: (2024)
STAR-PólyaMath: Multi-Agent Reasoning under Persistent Meta-Strategic Supervision
von: Wu, Jiaao, et al.
Veröffentlicht: (2026)
von: Wu, Jiaao, et al.
Veröffentlicht: (2026)
How Brittle is Agent Safety? Rethinking Agent Risk under Intent Concealment and Task Complexity
von: Ma, Zihan, et al.
Veröffentlicht: (2025)
von: Ma, Zihan, et al.
Veröffentlicht: (2025)
One Panel Does Not Fit All: Case-Adaptive Multi-Agent Deliberation for Clinical Prediction
von: Lu, Yuxing, et al.
Veröffentlicht: (2026)
von: Lu, Yuxing, et al.
Veröffentlicht: (2026)
ValueFlow: Measuring the Propagation of Value Perturbations in Multi-Agent LLM Systems
von: Liu, Jinnuo, et al.
Veröffentlicht: (2026)
von: Liu, Jinnuo, et al.
Veröffentlicht: (2026)
Strategic Persuasion with Trait-Conditioned Multi-Agent Systems for Iterative Legal Argumentation
von: Siedler, Philipp D.
Veröffentlicht: (2026)
von: Siedler, Philipp D.
Veröffentlicht: (2026)
LLM Agents Making Agent Tools
von: Wölflein, Georg, et al.
Veröffentlicht: (2025)
von: Wölflein, Georg, et al.
Veröffentlicht: (2025)
QUACK: Questioning, Understanding, and Auditing Communicated Knowledge in Multimodal Social Deduction Agents
von: Yuan, Ye, et al.
Veröffentlicht: (2026)
von: Yuan, Ye, et al.
Veröffentlicht: (2026)
From Pixels to Cooperation Multi Agent Reinforcement Learning based on Multimodal World Models
von: Akin, Sureyya, et al.
Veröffentlicht: (2025)
von: Akin, Sureyya, et al.
Veröffentlicht: (2025)
Trajectory Supervision for Continual Tool-Use Learning in LLMs
von: Reddy, Vishnu Vardhan, et al.
Veröffentlicht: (2026)
von: Reddy, Vishnu Vardhan, et al.
Veröffentlicht: (2026)
Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning
von: Sarkar, Bidipta, et al.
Veröffentlicht: (2025)
von: Sarkar, Bidipta, et al.
Veröffentlicht: (2025)
Preventing Rogue Agents Improves Multi-Agent Collaboration
von: Barbi, Ohav, et al.
Veröffentlicht: (2025)
von: Barbi, Ohav, et al.
Veröffentlicht: (2025)
A Survey on LLM-based Multi-Agent System: Recent Advances and New Frontiers in Application
von: Chen, Shuaihang, et al.
Veröffentlicht: (2024)
von: Chen, Shuaihang, et al.
Veröffentlicht: (2024)
Memory-Augmented Reinforcement Learning Agent for CAD Generation
von: Xiaolong, Yin, et al.
Veröffentlicht: (2026)
von: Xiaolong, Yin, et al.
Veröffentlicht: (2026)
LingxiDiagBench: A Multi-Agent Framework for Benchmarking LLMs in Chinese Psychiatric Consultation and Diagnosis
von: Xu, Shihao, et al.
Veröffentlicht: (2026)
von: Xu, Shihao, et al.
Veröffentlicht: (2026)
Bayesian Ego-graph Inference for Networked Multi-Agent Reinforcement Learning
von: Duan, Wei, et al.
Veröffentlicht: (2025)
von: Duan, Wei, et al.
Veröffentlicht: (2025)
Efficient Agents: Building Effective Agents While Reducing Cost
von: Wang, Ningning, et al.
Veröffentlicht: (2025)
von: Wang, Ningning, et al.
Veröffentlicht: (2025)
SkillMAS: Skill Co-Evolution with LLM-based Multi-Agent System
von: Pan, Shuai, et al.
Veröffentlicht: (2026)
von: Pan, Shuai, et al.
Veröffentlicht: (2026)
Specialists or Generalists? Multi-Agent and Single-Agent LLMs for Essay Grading
von: Idowu, Jamiu Adekunle, et al.
Veröffentlicht: (2026)
von: Idowu, Jamiu Adekunle, et al.
Veröffentlicht: (2026)
Breaking Event Rumor Detection via Stance-Separated Multi-Agent Debate
von: Zhang, Mingqing, et al.
Veröffentlicht: (2024)
von: Zhang, Mingqing, et al.
Veröffentlicht: (2024)
ClinEnv: An Interactive Multi-Stage Long Horizon EHR Environment for Agents
von: Lu, Yuxing, et al.
Veröffentlicht: (2026)
von: Lu, Yuxing, et al.
Veröffentlicht: (2026)
CAF-I: A Collaborative Multi-Agent Framework for Enhanced Irony Detection with Large Language Models
von: Liu, Ziqi., et al.
Veröffentlicht: (2025)
von: Liu, Ziqi., et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
FlowPortrait: Reinforcement Learning for Audio-Driven Portrait Video Generation
von: Tan, Weiting, et al.
Veröffentlicht: (2026) -
Agents that Matter: Optimizing Multi-Agent LLMs via Removal-Based Attribution
von: Lu, Mingyu, et al.
Veröffentlicht: (2026) -
You Only Align Once: Propagating Cooperative Behaviors in Multi-Agent Systems through Seed Agents
von: Hsing, Nicole, et al.
Veröffentlicht: (2026) -
IBSEN: Director-Actor Agent Collaboration for Controllable and Interactive Drama Script Generation
von: Han, Senyu, et al.
Veröffentlicht: (2024) -
Communication to Completion: Modeling Collaborative Workflows with Intelligent Multi-Agent Communication
von: Lu, Yiming, et al.
Veröffentlicht: (2025)