Learning to Orchestrate Agents in Natural Language with the Conductor
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nielsen, Stefan, Cetin, Edoardo, Schwendeman, Peter, Sun, Qi, Xu, Jinglue, Tang, Yujin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TRINITY: An Evolved LLM Coordinator
par: Xu, Jinglue, et autres
Publié: (2025)
par: Xu, Jinglue, et autres
Publié: (2025)
Transformer-Squared: Self-adaptive LLMs
par: Sun, Qi, et autres
Publié: (2025)
par: Sun, Qi, et autres
Publié: (2025)
Large Language Models to Diffusion Finetuning
par: Cetin, Edoardo, et autres
Publié: (2025)
par: Cetin, Edoardo, et autres
Publié: (2025)
An Evolved Universal Transformer Memory
par: Cetin, Edoardo, et autres
Publié: (2024)
par: Cetin, Edoardo, et autres
Publié: (2024)
Reinforcement Learning Teachers of Test Time Scaling
par: Cetin, Edoardo, et autres
Publié: (2025)
par: Cetin, Edoardo, et autres
Publié: (2025)
Evolutionary Context Search for Automated Skill Acquisition
par: Sun, Qi, et autres
Publié: (2026)
par: Sun, Qi, et autres
Publié: (2026)
Text-to-LoRA: Instant Transformer Adaption
par: Charakorn, Rujikorn, et autres
Publié: (2025)
par: Charakorn, Rujikorn, et autres
Publié: (2025)
Learning from Partial Chain-of-Thought via Truncated-Reasoning Self-Distillation
par: Silvestri, Gianluigi, et autres
Publié: (2026)
par: Silvestri, Gianluigi, et autres
Publié: (2026)
HCPO: Hierarchical Conductor-Based Policy Optimization in Multi-Agent Reinforcement Learning
par: Liu, Zejiao, et autres
Publié: (2025)
par: Liu, Zejiao, et autres
Publié: (2025)
PlanDQ: Hierarchical Plan Orchestration via D-Conductor and Q-Performer
par: Chen, Chang, et autres
Publié: (2024)
par: Chen, Chang, et autres
Publié: (2024)
Exploring the Improvement of Evolutionary Computation via Large Language Models
par: Cai, Jinyu, et autres
Publié: (2024)
par: Cai, Jinyu, et autres
Publié: (2024)
Learning to Orchestrate Agents under Uncertainty
par: Oliver, Mary Chriselda Antony, et autres
Publié: (2026)
par: Oliver, Mary Chriselda Antony, et autres
Publié: (2026)
Bridging the Gap Between Natural Language and Market Dynamics via High-Dimensional Representation Learning
par: Jeong, Yujin, et autres
Publié: (2026)
par: Jeong, Yujin, et autres
Publié: (2026)
Finer Behavioral Foundation Models via Auto-Regressive Features and Advantage Weighting
par: Cetin, Edoardo, et autres
Publié: (2024)
par: Cetin, Edoardo, et autres
Publié: (2024)
Large Language Models Synergize with Automated Machine Learning
par: Xu, Jinglue, et autres
Publié: (2024)
par: Xu, Jinglue, et autres
Publié: (2024)
WaterAdmin: Orchestrating Community Water Distribution Optimization via AI Agents
par: Wen, Jiaqi, et autres
Publié: (2026)
par: Wen, Jiaqi, et autres
Publié: (2026)
Co-RedTeam: Orchestrated Security Discovery and Exploitation with LLM Agents
par: He, Pengfei, et autres
Publié: (2026)
par: He, Pengfei, et autres
Publié: (2026)
ShinkaEvolve: Towards Open-Ended And Sample-Efficient Program Evolution
par: Lange, Robert Tjarko, et autres
Publié: (2025)
par: Lange, Robert Tjarko, et autres
Publié: (2025)
Sparser, Faster, Lighter Transformer Language Models
par: Cetin, Edoardo, et autres
Publié: (2026)
par: Cetin, Edoardo, et autres
Publié: (2026)
Multi-Agent Reinforcement Learning for Adaptive Resource Orchestration in Cloud-Native Clusters
par: Yao, Guanzi, et autres
Publié: (2025)
par: Yao, Guanzi, et autres
Publié: (2025)
Abstract Counterfactuals for Language Model Agents
par: Pona, Edoardo, et autres
Publié: (2025)
par: Pona, Edoardo, et autres
Publié: (2025)
Simple Ingredients for Offline Reinforcement Learning
par: Cetin, Edoardo, et autres
Publié: (2024)
par: Cetin, Edoardo, et autres
Publié: (2024)
EDCO: Dynamic Curriculum Orchestration for Domain-specific Large Language Model Fine-tuning
par: Pang, Jing-Cheng, et autres
Publié: (2026)
par: Pang, Jing-Cheng, et autres
Publié: (2026)
Principal-Agent Reinforcement Learning: Orchestrating AI Agents with Contracts
par: Ivanov, Dima, et autres
Publié: (2024)
par: Ivanov, Dima, et autres
Publié: (2024)
An Attention-based Framework for Fair Contrastive Learning
par: Nielsen, Stefan K., et autres
Publié: (2024)
par: Nielsen, Stefan K., et autres
Publié: (2024)
A Geometric Modeling of Occam's Razor in Deep Learning
par: Sun, Ke, et autres
Publié: (2019)
par: Sun, Ke, et autres
Publié: (2019)
PatchMixer: A Patch-Mixing Architecture for Long-Term Time Series Forecasting
par: Gong, Zeying, et autres
Publié: (2023)
par: Gong, Zeying, et autres
Publié: (2023)
Large Language Models As Evolution Strategies
par: Lange, Robert Tjarko, et autres
Publié: (2024)
par: Lange, Robert Tjarko, et autres
Publié: (2024)
CLIMATEAGENT: Multi-Agent Orchestration for Complex Climate Data Science Workflows
par: Kim, Hyeonjae, et autres
Publié: (2025)
par: Kim, Hyeonjae, et autres
Publié: (2025)
In-Context Prompting Obsoletes Agent Orchestration for Procedural Tasks
par: Dennis, Simon, et autres
Publié: (2026)
par: Dennis, Simon, et autres
Publié: (2026)
Simple Recipe Works: Vision-Language-Action Models are Natural Continual Learners with Reinforcement Learning
par: Hu, Jiaheng, et autres
Publié: (2026)
par: Hu, Jiaheng, et autres
Publié: (2026)
From Solo to Symphony: Orchestrating Multi-Agent Collaboration with Single-Agent Demos
par: Wang, Xun, et autres
Publié: (2025)
par: Wang, Xun, et autres
Publié: (2025)
Universal Machine Learning Interatomic Potentials are Ready for Solid Ion Conductors
par: Du, Hongwei, et autres
Publié: (2025)
par: Du, Hongwei, et autres
Publié: (2025)
Data Agent: A Holistic Architecture for Orchestrating Data+AI Ecosystems
par: Sun, Zhaoyan, et autres
Publié: (2025)
par: Sun, Zhaoyan, et autres
Publié: (2025)
Online Continual Learning for Time Series: a Natural Score-driven Approach
par: Urettini, Edoardo, et autres
Publié: (2026)
par: Urettini, Edoardo, et autres
Publié: (2026)
When Should We Orchestrate Multiple Agents?
par: Bhatt, Umang, et autres
Publié: (2025)
par: Bhatt, Umang, et autres
Publié: (2025)
Conformalized Semi-supervised Random Forest for Classification and Abnormality Detection
par: Han, Yujin, et autres
Publié: (2023)
par: Han, Yujin, et autres
Publié: (2023)
Orchestrating Dual-Boundaries: An Arithmetic Intensity Inspired Acceleration Framework for Diffusion Language Models
par: Wei, Linye, et autres
Publié: (2025)
par: Wei, Linye, et autres
Publié: (2025)
From Inference Routing to Agent Orchestration: Declarative Policy Compilation with Cross-Layer Verification
par: Chen, Huamin, et autres
Publié: (2026)
par: Chen, Huamin, et autres
Publié: (2026)
Policy Learning with Competing Agents
par: Sahoo, Roshni, et autres
Publié: (2022)
par: Sahoo, Roshni, et autres
Publié: (2022)
Documents similaires
-
TRINITY: An Evolved LLM Coordinator
par: Xu, Jinglue, et autres
Publié: (2025) -
Transformer-Squared: Self-adaptive LLMs
par: Sun, Qi, et autres
Publié: (2025) -
Large Language Models to Diffusion Finetuning
par: Cetin, Edoardo, et autres
Publié: (2025) -
An Evolved Universal Transformer Memory
par: Cetin, Edoardo, et autres
Publié: (2024) -
Reinforcement Learning Teachers of Test Time Scaling
par: Cetin, Edoardo, et autres
Publié: (2025)