Controlling Large Language Model-based Agents for Large-Scale Decision-Making: An Actor-Critic Approach
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Bin, Mao, Hangyu, Ruan, Jingqing, Wen, Ying, Li, Yang, Zhang, Shao, Xu, Zhiwei, Li, Dapeng, Li, Ziyue, Zhao, Rui, Li, Lijuan, Fan, Guoliang |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
TPTU: Large Language Model-based AI Agents for Task Planning and Tool Usage
by: Ruan, Jingqing, et al.
Published: (2023)
by: Ruan, Jingqing, et al.
Published: (2023)
CoSLight: Co-optimizing Collaborator Selection and Decision-making to Enhance Traffic Signal Control
by: Ruan, Jingqing, et al.
Published: (2024)
by: Ruan, Jingqing, et al.
Published: (2024)
SQLBench: A Comprehensive Evaluation for Text-to-SQL Capabilities of Large Language Models
by: Zhang, Bin, et al.
Published: (2024)
by: Zhang, Bin, et al.
Published: (2024)
X-Light: Cross-City Traffic Signal Control Using Transformer on Transformer as Meta Multi-Agent Reinforcement Learner
by: Jiang, Haoyuan, et al.
Published: (2024)
by: Jiang, Haoyuan, et al.
Published: (2024)
Enhancing Decision-Making of Large Language Models via Actor-Critic
by: Dong, Heng, et al.
Published: (2025)
by: Dong, Heng, et al.
Published: (2025)
Adaptive parameter sharing for multi-agent reinforcement learning
by: Li, Dapeng, et al.
Published: (2023)
by: Li, Dapeng, et al.
Published: (2023)
Beyond Local Views: Global State Inference with Diffusion Models for Cooperative Multi-Agent Reinforcement Learning
by: Xu, Zhiwei, et al.
Published: (2024)
by: Xu, Zhiwei, et al.
Published: (2024)
GuideLight: "Industrial Solution" Guidance for More Practical Traffic Signal Control Agents
by: Jiang, Haoyuan, et al.
Published: (2024)
by: Jiang, Haoyuan, et al.
Published: (2024)
MetaAgents: Large Language Model Based Agents for Decision-Making on Teaming
by: Li, Yuan, et al.
Published: (2023)
by: Li, Yuan, et al.
Published: (2023)
QPO: Query-dependent Prompt Optimization via Multi-Loop Offline Reinforcement Learning
by: Kong, Yilun, et al.
Published: (2024)
by: Kong, Yilun, et al.
Published: (2024)
Learning Top-k Subtask Planning Tree based on Discriminative Representation Pre-training for Decision Making
by: Ruan, Jingqing, et al.
Published: (2023)
by: Ruan, Jingqing, et al.
Published: (2023)
A Large-Scale Simulation on Large Language Models for Decision-Making in Political Science
by: Yu, Chenxiao, et al.
Published: (2024)
by: Yu, Chenxiao, et al.
Published: (2024)
An Actor-Critic Approach to Boosting Text-to-SQL Large Language Model
by: Zheng, Ziyang, et al.
Published: (2024)
by: Zheng, Ziyang, et al.
Published: (2024)
QSIM: Mitigating Overestimation in Multi-Agent Reinforcement Learning via Action Similarity Weighted Q-Learning
by: Li, Yuanjun, et al.
Published: (2026)
by: Li, Yuanjun, et al.
Published: (2026)
Zeroth-Order Actor-Critic: An Evolutionary Framework for Sequential Decision Problems
by: Lei, Yuheng, et al.
Published: (2022)
by: Lei, Yuheng, et al.
Published: (2022)
Offline Actor-Critic Reinforcement Learning Scales to Large Models
by: Springenberg, Jost Tobias, et al.
Published: (2024)
by: Springenberg, Jost Tobias, et al.
Published: (2024)
Independent Soft Actor‐Critic Deep Reinforcement Learning for UAV Cooperative Air Combat Maneuvering Decision‐Making
by: Haolin Li, et al.
Published: (2025)
by: Haolin Li, et al.
Published: (2025)
D$^3$-Subsidy: Online and Sequential Driver Subsidy Decision-Making for Large-Scale Ride-Hailing Market
by: Chen, Taijie, et al.
Published: (2026)
by: Chen, Taijie, et al.
Published: (2026)
Power Control and Random Serving Mode Allocation for CJT-NCJT Hybrid Mode Enabled Cell-Free Massive MIMO With Limited Fronthauls
by: Zhang, Hangyu, et al.
Published: (2024)
by: Zhang, Hangyu, et al.
Published: (2024)
SQL-to-Schema Enhances Schema Linking in Text-to-SQL
by: Yang, Sun, et al.
Published: (2024)
by: Yang, Sun, et al.
Published: (2024)
PACE: Improving Prompt with Actor-Critic Editing for Large Language Model
by: Dong, Yihong, et al.
Published: (2023)
by: Dong, Yihong, et al.
Published: (2023)
Impact of Large-Scale Structure along Line-of-Sight on Time-Delay Cosmography
by: Lin, Shijie, et al.
Published: (2025)
by: Lin, Shijie, et al.
Published: (2025)
SplitLLM: Hierarchical Split Learning for Large Language Model over Wireless Network
by: Zhang, Songge, et al.
Published: (2025)
by: Zhang, Songge, et al.
Published: (2025)
SpokenWOZ: A Large-Scale Speech-Text Benchmark for Spoken Task-Oriented Dialogue Agents
by: Si, Shuzheng, et al.
Published: (2023)
by: Si, Shuzheng, et al.
Published: (2023)
DeepAnalyze: Agentic Large Language Models for Autonomous Data Science
by: Zhang, Shaolei, et al.
Published: (2025)
by: Zhang, Shaolei, et al.
Published: (2025)
NGENT: Next-Generation AI Agents Must Integrate Multi-Domain Abilities to Achieve Artificial General Intelligence
by: Li, Zhicong, et al.
Published: (2025)
by: Li, Zhicong, et al.
Published: (2025)
Large Model Empowered Embodied AI: A Survey on Decision-Making and Embodied Learning
by: Liang, Wenlong, et al.
Published: (2025)
by: Liang, Wenlong, et al.
Published: (2025)
Embodied Agent Interface: Benchmarking LLMs for Embodied Decision Making
by: Li, Manling, et al.
Published: (2024)
by: Li, Manling, et al.
Published: (2024)
Taming Actor-Observer Asymmetry in Agents via Dialectical Alignment
by: Li, Bobo, et al.
Published: (2026)
by: Li, Bobo, et al.
Published: (2026)
SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning
by: Li, Na, et al.
Published: (2025)
by: Li, Na, et al.
Published: (2025)
DLM: Unified Decision Language Models for Offline Multi-Agent Sequential Decision Making
by: Zhang, Zhuohui, et al.
Published: (2026)
by: Zhang, Zhuohui, et al.
Published: (2026)
New Adaptive Mechanism for Large Neighborhood Search using Dual Actor-Critic
by: Yu, Shaohua, et al.
Published: (2026)
by: Yu, Shaohua, et al.
Published: (2026)
Towards Robust Event-guided Low-Light Image Enhancement: A Large-Scale Real-World Event-Image Dataset and Novel Approach
by: Liang, Guoqiang, et al.
Published: (2024)
by: Liang, Guoqiang, et al.
Published: (2024)
ClinicalAgents: Multi-Agent Orchestration for Clinical Decision Making with Dual-Memory
by: Ge, Zhuohan, et al.
Published: (2026)
by: Ge, Zhuohan, et al.
Published: (2026)
Debt Collection Negotiations with Large Language Models: An Evaluation System and Optimizing Decision Making with Multi-Agent
by: Wang, Xiaofeng, et al.
Published: (2025)
by: Wang, Xiaofeng, et al.
Published: (2025)
Credential Leakage in LLM Agent Skills: A Large-Scale Empirical Study
by: Chen, Zhihao, et al.
Published: (2026)
by: Chen, Zhihao, et al.
Published: (2026)
An Online Review‐Driven Multiattribute Decision‐Making Model Based on Rough‐Cloud‐Integrated Three‐Way Decisions
by: Fan Jia, et al.
Published: (2026)
by: Fan Jia, et al.
Published: (2026)
PET-SQL: A Prompt-Enhanced Two-Round Refinement of Text-to-SQL with Cross-consistency
by: Li, Zhishuai, et al.
Published: (2024)
by: Li, Zhishuai, et al.
Published: (2024)
Memory-Driven Self-Improvement for Decision Making with Large Language Models
by: Yan, Xue, et al.
Published: (2025)
by: Yan, Xue, et al.
Published: (2025)
Finite-Time Global Optimality Convergence in Deep Neural Actor-Critic Methods for Decentralized Multi-Agent Reinforcement Learning
by: Zhang, Zhiyao, et al.
Published: (2025)
by: Zhang, Zhiyao, et al.
Published: (2025)
Similar Items
-
TPTU: Large Language Model-based AI Agents for Task Planning and Tool Usage
by: Ruan, Jingqing, et al.
Published: (2023) -
CoSLight: Co-optimizing Collaborator Selection and Decision-making to Enhance Traffic Signal Control
by: Ruan, Jingqing, et al.
Published: (2024) -
SQLBench: A Comprehensive Evaluation for Text-to-SQL Capabilities of Large Language Models
by: Zhang, Bin, et al.
Published: (2024) -
X-Light: Cross-City Traffic Signal Control Using Transformer on Transformer as Meta Multi-Agent Reinforcement Learner
by: Jiang, Haoyuan, et al.
Published: (2024) -
Enhancing Decision-Making of Large Language Models via Actor-Critic
by: Dong, Heng, et al.
Published: (2025)