Asymmetric Actor-Critic for Multi-turn LLM Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Jiang, Shuli, Zhang, Zhaoyang, Zhang, Yi, Yang, Shuo, Xia, Wei, Soatto, Stefano |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ACC-Collab: An Actor-Critic Approach to Multi-Agent LLM Collaboration
di: Estornell, Andrew, et al.
Pubblicazione: (2024)
di: Estornell, Andrew, et al.
Pubblicazione: (2024)
Experience Sharing in Mutual Reinforcement Learning for Heterogeneous Language Models
di: Liu, Xiaoze, et al.
Pubblicazione: (2026)
di: Liu, Xiaoze, et al.
Pubblicazione: (2026)
Reinforcement-aware Knowledge Distillation for LLM Reasoning
di: Zhang, Zhaoyang, et al.
Pubblicazione: (2026)
di: Zhang, Zhaoyang, et al.
Pubblicazione: (2026)
AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents
di: Ma, Chang, et al.
Pubblicazione: (2024)
di: Ma, Chang, et al.
Pubblicazione: (2024)
On the Multi-turn Instruction Following for Conversational Web Agents
di: Deng, Yang, et al.
Pubblicazione: (2024)
di: Deng, Yang, et al.
Pubblicazione: (2024)
Data Selection for Multi-turn Dialogue Instruction Tuning
di: Li, Bo, et al.
Pubblicazione: (2026)
di: Li, Bo, et al.
Pubblicazione: (2026)
A Survey on Recent Advances in LLM-Based Multi-turn Dialogue Systems
di: Yi, Zihao, et al.
Pubblicazione: (2024)
di: Yi, Zihao, et al.
Pubblicazione: (2024)
Enhancing Decision-Making of Large Language Models via Actor-Critic
di: Dong, Heng, et al.
Pubblicazione: (2025)
di: Dong, Heng, et al.
Pubblicazione: (2025)
Learning Decentralized LLM Collaboration with Multi-Agent Actor Critic
di: Liu, Shuo, et al.
Pubblicazione: (2026)
di: Liu, Shuo, et al.
Pubblicazione: (2026)
Skill-SD: Skill-Conditioned Self-Distillation for Multi-turn LLM Agents
di: Wang, Hao, et al.
Pubblicazione: (2026)
di: Wang, Hao, et al.
Pubblicazione: (2026)
Musketeer: Joint Training for Multi-task Vision Language Model with Task Explanation Prompts
di: Zhang, Zhaoyang, et al.
Pubblicazione: (2023)
di: Zhang, Zhaoyang, et al.
Pubblicazione: (2023)
Beyond Single-shot Writing: Deep Research Agents are Unreliable at Multi-turn Report Revision
di: Chen, Bingsen, et al.
Pubblicazione: (2026)
di: Chen, Bingsen, et al.
Pubblicazione: (2026)
Token Statistics Reveal Conversational Drift in Multi-turn LLM Interaction
di: Hafez, Wael, et al.
Pubblicazione: (2026)
di: Hafez, Wael, et al.
Pubblicazione: (2026)
REVEAL: Multi-turn Evaluation of Image-Input Harms for Vision LLM
di: Jindal, Madhur, et al.
Pubblicazione: (2025)
di: Jindal, Madhur, et al.
Pubblicazione: (2025)
Foot-In-The-Door: A Multi-turn Jailbreak for LLMs
di: Weng, Zixuan, et al.
Pubblicazione: (2025)
di: Weng, Zixuan, et al.
Pubblicazione: (2025)
MAC: A Multi-Agent Framework for Interactive User Clarification in Multi-turn Conversations
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)
GUI-Actor: Coordinate-Free Visual Grounding for GUI Agents
di: Wu, Qianhui, et al.
Pubblicazione: (2025)
di: Wu, Qianhui, et al.
Pubblicazione: (2025)
Insight Agents: An LLM-Based Multi-Agent System for Data Insights
di: Bai, Jincheng, et al.
Pubblicazione: (2026)
di: Bai, Jincheng, et al.
Pubblicazione: (2026)
SOMA: Efficient Multi-turn LLM Serving via Small Language Model
di: Cheng, Xueqi, et al.
Pubblicazione: (2026)
di: Cheng, Xueqi, et al.
Pubblicazione: (2026)
Igniting Creative Writing in Small Language Models: LLM-as-a-Judge versus Multi-Agent Refined Rewards
di: Wei, Xiaolong, et al.
Pubblicazione: (2025)
di: Wei, Xiaolong, et al.
Pubblicazione: (2025)
M2S: Multi-turn to Single-turn jailbreak in Red Teaming for LLMs
di: Ha, Junwoo, et al.
Pubblicazione: (2025)
di: Ha, Junwoo, et al.
Pubblicazione: (2025)
Improving Multi-turn Dialogue Consistency with Self-Recall Thinking
di: Pang, Renning, et al.
Pubblicazione: (2026)
di: Pang, Renning, et al.
Pubblicazione: (2026)
From Self-Evolving Synthetic Data to Verifiable-Reward RL: Post-Training Multi-turn Interactive Tool-Using Agents
di: Gao, Jiaxuan, et al.
Pubblicazione: (2026)
di: Gao, Jiaxuan, et al.
Pubblicazione: (2026)
CompactRAG: Reducing LLM Calls and Token Overhead in Multi-Hop Question Answering
di: Yang, Hao, et al.
Pubblicazione: (2026)
di: Yang, Hao, et al.
Pubblicazione: (2026)
MARS-Bench: A Multi-turn Athletic Real-world Scenario Benchmark for Dialogue Evaluation
di: Yang, Chenghao, et al.
Pubblicazione: (2025)
di: Yang, Chenghao, et al.
Pubblicazione: (2025)
InfiGUI-R1: Advancing Multimodal GUI Agents from Reactive Actors to Deliberative Reasoners
di: Liu, Yuhang, et al.
Pubblicazione: (2025)
di: Liu, Yuhang, et al.
Pubblicazione: (2025)
Political Actor Agent: Simulating Legislative System for Roll Call Votes Prediction with Large Language Models
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
AgentDropout: Dynamic Agent Elimination for Token-Efficient and High-Performance LLM-Based Multi-Agent Collaboration
di: Wang, Zhexuan, et al.
Pubblicazione: (2025)
di: Wang, Zhexuan, et al.
Pubblicazione: (2025)
X-Teaming Evolutionary M2S: Automated Discovery of Multi-turn to Single-turn Jailbreak Templates
di: Kim, Hyunjun, et al.
Pubblicazione: (2025)
di: Kim, Hyunjun, et al.
Pubblicazione: (2025)
SafeMT: Multi-turn Safety for Multimodal Language Models
di: Zhu, Han, et al.
Pubblicazione: (2025)
di: Zhu, Han, et al.
Pubblicazione: (2025)
Multi-dimensional Data Analysis and Applications Basing on LLM Agents and Knowledge Graph Interactions
di: Wang, Xi, et al.
Pubblicazione: (2025)
di: Wang, Xi, et al.
Pubblicazione: (2025)
LAVE: LLM-Powered Agent Assistance and Language Augmentation for Video Editing
di: Wang, Bryan, et al.
Pubblicazione: (2024)
di: Wang, Bryan, et al.
Pubblicazione: (2024)
MedAction: Towards Active Multi-turn Clinical Diagnostic LLMs
di: Hsu, Hsin-Ling, et al.
Pubblicazione: (2026)
di: Hsu, Hsin-Ling, et al.
Pubblicazione: (2026)
TextBind: Multi-turn Interleaved Multimodal Instruction-following in the Wild
di: Li, Huayang, et al.
Pubblicazione: (2023)
di: Li, Huayang, et al.
Pubblicazione: (2023)
Probabilistic Modeling of Intentions in Socially Intelligent LLM Agents
di: Xia, Feifan, et al.
Pubblicazione: (2025)
di: Xia, Feifan, et al.
Pubblicazione: (2025)
When Agents "Misremember" Collectively: Exploring the Mandela Effect in LLM-based Multi-Agent Systems
di: Xu, Naen, et al.
Pubblicazione: (2026)
di: Xu, Naen, et al.
Pubblicazione: (2026)
Dynamic Generation of Multi-LLM Agents Communication Topologies with Graph Diffusion Models
di: Jiang, Eric Hanchen, et al.
Pubblicazione: (2025)
di: Jiang, Eric Hanchen, et al.
Pubblicazione: (2025)
OpenWebRL: Demystifying Online Multi-turn Reinforcement Learning for Visual Web Agents
di: Yang, Rui, et al.
Pubblicazione: (2026)
di: Yang, Rui, et al.
Pubblicazione: (2026)
Optimizing LLM-Based Multi-Agent System with Textual Feedback: A Case Study on Software Development
di: Shen, Ming, et al.
Pubblicazione: (2025)
di: Shen, Ming, et al.
Pubblicazione: (2025)
Beyond Static Summarization: Proactive Memory Extraction for LLM Agents
di: Yang, Chengyuan, et al.
Pubblicazione: (2026)
di: Yang, Chengyuan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
ACC-Collab: An Actor-Critic Approach to Multi-Agent LLM Collaboration
di: Estornell, Andrew, et al.
Pubblicazione: (2024) -
Experience Sharing in Mutual Reinforcement Learning for Heterogeneous Language Models
di: Liu, Xiaoze, et al.
Pubblicazione: (2026) -
Reinforcement-aware Knowledge Distillation for LLM Reasoning
di: Zhang, Zhaoyang, et al.
Pubblicazione: (2026) -
AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents
di: Ma, Chang, et al.
Pubblicazione: (2024) -
On the Multi-turn Instruction Following for Conversational Web Agents
di: Deng, Yang, et al.
Pubblicazione: (2024)