Training Task Reasoning LLM Agents for Multi-turn Task Planning via Single-turn Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Hu, Hanjiang, Liu, Changliu, Li, Na, Wang, Yebin |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Safe PDE Boundary Control with Neural Operators
by: Hu, Hanjiang, et al.
Published: (2024)
by: Hu, Hanjiang, et al.
Published: (2024)
Real-Time Safe Control of Neural Network Dynamic Models with Sound Approximation
by: Hu, Hanjiang, et al.
Published: (2024)
by: Hu, Hanjiang, et al.
Published: (2024)
Steering Dialogue Dynamics for Robustness against Multi-turn Jailbreaking Attacks
by: Hu, Hanjiang, et al.
Published: (2025)
by: Hu, Hanjiang, et al.
Published: (2025)
Verification of Neural Control Barrier Functions with Symbolic Derivative Bounds Propagation
by: Hu, Hanjiang, et al.
Published: (2024)
by: Hu, Hanjiang, et al.
Published: (2024)
Optimism as Risk-Seeking in Multi-Agent Reinforcement Learning
by: Zhang, Runyu, et al.
Published: (2025)
by: Zhang, Runyu, et al.
Published: (2025)
Towards Fast Rates for Federated and Multi-Task Reinforcement Learning
by: Zhu, Feng, et al.
Published: (2024)
by: Zhu, Feng, et al.
Published: (2024)
Robust Tracking Control with Neural Network Dynamic Models under Input Perturbations
by: Cheng, Huixuan, et al.
Published: (2024)
by: Cheng, Huixuan, et al.
Published: (2024)
SigmaRL: A Sample-Efficient and Generalizable Multi-Agent Reinforcement Learning Framework for Motion Planning
by: Xu, Jianye, et al.
Published: (2024)
by: Xu, Jianye, et al.
Published: (2024)
Cluster-Based Multi-Agent Task Scheduling for Space-Air-Ground Integrated Networks
by: Wang, Zhiying, et al.
Published: (2024)
by: Wang, Zhiying, et al.
Published: (2024)
Multi-Mode Process Control Using Multi-Task Inverse Reinforcement Learning
by: Lin, Runze, et al.
Published: (2025)
by: Lin, Runze, et al.
Published: (2025)
RL-TIME: Reinforcement Learning-based Task Replication in Multicore Embedded Systems
by: Siyadatzadeh, Roozbeh, et al.
Published: (2025)
by: Siyadatzadeh, Roozbeh, et al.
Published: (2025)
Federated Multi-Agent Deep Reinforcement Learning Approach via Physics-Informed Reward for Multi-Microgrid Energy Management
by: Li, Yuanzheng, et al.
Published: (2022)
by: Li, Yuanzheng, et al.
Published: (2022)
Neural Operators for Multi-Task Control and Adaptation
by: Sewell, David, et al.
Published: (2026)
by: Sewell, David, et al.
Published: (2026)
Leveraging Multi-Task Learning for Multi-Label Power System Security Assessment
by: Za'ter, Muhy Eddin, et al.
Published: (2025)
by: Za'ter, Muhy Eddin, et al.
Published: (2025)
Large-scale Regional Traffic Signal Control Based on Single-Agent Reinforcement Learning
by: Li, Qiang, et al.
Published: (2025)
by: Li, Qiang, et al.
Published: (2025)
Safe Multi-Agent Reinforcement Learning with Convergence to Generalized Nash Equilibrium
by: Li, Zeyang, et al.
Published: (2024)
by: Li, Zeyang, et al.
Published: (2024)
Scalable Fairness Shaping with LLM-Guided Multi-Agent Reinforcement Learning for Peer-to-Peer Electricity Markets
by: Jadhav, Shrenik, et al.
Published: (2025)
by: Jadhav, Shrenik, et al.
Published: (2025)
Generalizing Cooperative Eco-driving via Multi-residual Task Learning
by: Jayawardana, Vindula, et al.
Published: (2024)
by: Jayawardana, Vindula, et al.
Published: (2024)
Alleviating Community Fear in Disasters via Multi-Agent Actor-Critic Reinforcement Learning
by: Hakke, Yashodhan D., et al.
Published: (2026)
by: Hakke, Yashodhan D., et al.
Published: (2026)
Towards Safe Multi-Task Bayesian Optimization
by: Lübsen, Jannis O., et al.
Published: (2023)
by: Lübsen, Jannis O., et al.
Published: (2023)
Accelerating Multi-Task Temporal Difference Learning under Low-Rank Representation
by: Bai, Yitao, et al.
Published: (2025)
by: Bai, Yitao, et al.
Published: (2025)
Adaptive Policy Learning to Additional Tasks
by: Hao, Wenjian, et al.
Published: (2023)
by: Hao, Wenjian, et al.
Published: (2023)
On the Reliability Limits of LLM-Based Multi-Agent Planning
by: Ao, Ruicheng, et al.
Published: (2026)
by: Ao, Ruicheng, et al.
Published: (2026)
AoI-Aware Task Offloading and Transmission Optimization for Industrial IoT Networks: A Branching Deep Reinforcement Learning Approach
by: Chen, Yuang, et al.
Published: (2025)
by: Chen, Yuang, et al.
Published: (2025)
Semi-Supervised Multi-Task Learning Based Framework for Power System Security Assessment
by: Za'ter, Muhy Eddin, et al.
Published: (2024)
by: Za'ter, Muhy Eddin, et al.
Published: (2024)
An Analysis of Safety Guarantees in Multi-Task Bayesian Optimization
by: Luebsen, Jannis O., et al.
Published: (2025)
by: Luebsen, Jannis O., et al.
Published: (2025)
Structured Cooperative Multi-Agent Reinforcement Learning: a Bayesian Network Perspective
by: Syed, Shahbaz P Qadri, et al.
Published: (2025)
by: Syed, Shahbaz P Qadri, et al.
Published: (2025)
Intelligent Communication Planning for Constrained Environmental IoT Sensing with Reinforcement Learning
by: Hu, Yi, et al.
Published: (2023)
by: Hu, Yi, et al.
Published: (2023)
Multi-Agent Reinforcement Learning for Offloading Cellular Communications with Cooperating UAVs
by: Mondal, Abhishek, et al.
Published: (2024)
by: Mondal, Abhishek, et al.
Published: (2024)
A Hierarchical Surrogate Model for Efficient Multi-Task Parameter Learning in Closed-Loop Control
by: Hirt, Sebastian, et al.
Published: (2025)
by: Hirt, Sebastian, et al.
Published: (2025)
Training Verifiably Robust Agents Using Set-Based Reinforcement Learning
by: Wendl, Manuel, et al.
Published: (2024)
by: Wendl, Manuel, et al.
Published: (2024)
Priority-Driven Control and Communication in Decentralized Multi-Agent Systems via Reinforcement Learning
by: Guo, Qingyun, et al.
Published: (2026)
by: Guo, Qingyun, et al.
Published: (2026)
Ablation Study of How Run Time Assurance Impacts the Training and Performance of Reinforcement Learning Agents
by: Hamilton, Nathaniel, et al.
Published: (2022)
by: Hamilton, Nathaniel, et al.
Published: (2022)
The Synergy Between Optimal Transport Theory and Multi-Agent Reinforcement Learning
by: Baheri, Ali, et al.
Published: (2024)
by: Baheri, Ali, et al.
Published: (2024)
A Model-Based Approach to Imitation Learning through Multi-Step Predictions
by: Balim, Haldun, et al.
Published: (2025)
by: Balim, Haldun, et al.
Published: (2025)
CurricuLLM: Automatic Task Curricula Design for Learning Complex Robot Skills using Large Language Models
by: Ryu, Kanghyun, et al.
Published: (2024)
by: Ryu, Kanghyun, et al.
Published: (2024)
WFCRL: A Multi-Agent Reinforcement Learning Benchmark for Wind Farm Control
by: Monroc, Claire Bizon, et al.
Published: (2025)
by: Monroc, Claire Bizon, et al.
Published: (2025)
Sim-to-Real Transfer of Deep Reinforcement Learning Agents for Online Coverage Path Planning
by: Jonnarth, Arvi, et al.
Published: (2024)
by: Jonnarth, Arvi, et al.
Published: (2024)
MPC-Inspired Reinforcement Learning for Verifiable Model-Free Control
by: Lu, Yiwen, et al.
Published: (2023)
by: Lu, Yiwen, et al.
Published: (2023)
Zero-Shot Trajectory Planning for Signal Temporal Logic Tasks
by: Liu, Ruijia, et al.
Published: (2025)
by: Liu, Ruijia, et al.
Published: (2025)
Similar Items
-
Safe PDE Boundary Control with Neural Operators
by: Hu, Hanjiang, et al.
Published: (2024) -
Real-Time Safe Control of Neural Network Dynamic Models with Sound Approximation
by: Hu, Hanjiang, et al.
Published: (2024) -
Steering Dialogue Dynamics for Robustness against Multi-turn Jailbreaking Attacks
by: Hu, Hanjiang, et al.
Published: (2025) -
Verification of Neural Control Barrier Functions with Symbolic Derivative Bounds Propagation
by: Hu, Hanjiang, et al.
Published: (2024) -
Optimism as Risk-Seeking in Multi-Agent Reinforcement Learning
by: Zhang, Runyu, et al.
Published: (2025)