Learning Evolving Latent Strategies for Multi-Agent Language Systems without Model Fine-Tuning
Fuente:
arXiv
Guardado en:
| Autor principal: | Tang, Wenlong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Multi-Level Safety Continual Projection for Fine-Tuned Large Language Models without Retraining
por: Han, Bing, et al.
Publicado: (2025)
por: Han, Bing, et al.
Publicado: (2025)
KALIE: Fine-Tuning Vision-Language Models for Open-World Manipulation without Robot Data
por: Tang, Grace, et al.
Publicado: (2024)
por: Tang, Grace, et al.
Publicado: (2024)
Fine-Tuning without Performance Degradation
por: Wang, Han, et al.
Publicado: (2025)
por: Wang, Han, et al.
Publicado: (2025)
Crafting Efficient Fine-Tuning Strategies for Large Language Models
por: Oliver, Michael, et al.
Publicado: (2024)
por: Oliver, Michael, et al.
Publicado: (2024)
MathSE: Improving Multimodal Mathematical Reasoning via Self-Evolving Iterative Reflection and Reward-Guided Fine-Tuning
por: Chen, Jinhao, et al.
Publicado: (2025)
por: Chen, Jinhao, et al.
Publicado: (2025)
FT-Dojo: Towards Autonomous LLM Fine-Tuning with Language Agents
por: Li, Qizheng, et al.
Publicado: (2026)
por: Li, Qizheng, et al.
Publicado: (2026)
AgentFlux: Decoupled Fine-Tuning & Inference for On-Device Agentic Systems
por: Kadekodi, Rohan, et al.
Publicado: (2025)
por: Kadekodi, Rohan, et al.
Publicado: (2025)
ContextEvolve: Multi-Agent Context Compression for Systems Code Optimization
por: Su, Hongyuan, et al.
Publicado: (2026)
por: Su, Hongyuan, et al.
Publicado: (2026)
Reinforcement Learning Fine-Tunes a Sparse Subnetwork in Large Language Models
por: Balashov, Andrii
Publicado: (2025)
por: Balashov, Andrii
Publicado: (2025)
Fine-Tuning Language Models with Reward Learning on Policy
por: Lang, Hao, et al.
Publicado: (2024)
por: Lang, Hao, et al.
Publicado: (2024)
Linearization Explains Fine-Tuning in Large Language Models
por: Afzal, Zahra Rahimi, et al.
Publicado: (2026)
por: Afzal, Zahra Rahimi, et al.
Publicado: (2026)
MARFT: Multi-Agent Reinforcement Fine-Tuning
por: Liao, Junwei, et al.
Publicado: (2025)
por: Liao, Junwei, et al.
Publicado: (2025)
DARE the Extreme: Revisiting Delta-Parameter Pruning For Fine-Tuned Models
por: Deng, Wenlong, et al.
Publicado: (2024)
por: Deng, Wenlong, et al.
Publicado: (2024)
Robust Reinforcement Learning from Human Feedback for Large Language Models Fine-Tuning
por: Ye, Kai, et al.
Publicado: (2025)
por: Ye, Kai, et al.
Publicado: (2025)
Overcoming Forgetting in LLM Fine-Tuning with Evolution Strategies
por: Schweighofer, Kajetan, et al.
Publicado: (2026)
por: Schweighofer, Kajetan, et al.
Publicado: (2026)
RPO: Fine-Tuning Visual Generative Models via Rich Vision-Language Preferences
por: Zhao, Hanyang, et al.
Publicado: (2025)
por: Zhao, Hanyang, et al.
Publicado: (2025)
Latent Collaboration in Multi-Agent Systems
por: Zou, Jiaru, et al.
Publicado: (2025)
por: Zou, Jiaru, et al.
Publicado: (2025)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
por: Li, Ziniu, et al.
Publicado: (2024)
por: Li, Ziniu, et al.
Publicado: (2024)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
por: Wang, Shumin, et al.
Publicado: (2026)
por: Wang, Shumin, et al.
Publicado: (2026)
Task-Centric Personalized Federated Fine-Tuning of Language Models
por: Talasso, Gabriel U., et al.
Publicado: (2026)
por: Talasso, Gabriel U., et al.
Publicado: (2026)
MaZO: Masked Zeroth-Order Optimization for Multi-Task Fine-Tuning of Large Language Models
por: Zhang, Zhen, et al.
Publicado: (2025)
por: Zhang, Zhen, et al.
Publicado: (2025)
InvEvolve: Evolving White-Box Inventory Policies via Large Language Models with Performance Guarantees
por: Huang, Chenyu, et al.
Publicado: (2026)
por: Huang, Chenyu, et al.
Publicado: (2026)
TodoEvolve: Learning to Architect Agent Planning Systems
por: Liu, Jiaxi, et al.
Publicado: (2026)
por: Liu, Jiaxi, et al.
Publicado: (2026)
Large Language Models for Sequential Decision-Making: Improving In-Context Learning via Supervised Fine-Tuning
por: Zhang, Minmin, et al.
Publicado: (2026)
por: Zhang, Minmin, et al.
Publicado: (2026)
Advancing Learnable Multi-Agent Pathfinding Solvers with Active Fine-Tuning
por: Andreychuk, Anton, et al.
Publicado: (2025)
por: Andreychuk, Anton, et al.
Publicado: (2025)
Self-Evolving Recommendation System: End-To-End Autonomous Model Optimization With LLM Agents
por: Wang, Haochen, et al.
Publicado: (2026)
por: Wang, Haochen, et al.
Publicado: (2026)
SFT-GO: Supervised Fine-Tuning with Group Optimization for Large Language Models
por: Kim, Gyuhak, et al.
Publicado: (2025)
por: Kim, Gyuhak, et al.
Publicado: (2025)
QuZO: Quantized Zeroth-Order Fine-Tuning for Large Language Models
por: Zhou, Jiajun, et al.
Publicado: (2025)
por: Zhou, Jiajun, et al.
Publicado: (2025)
Automated Federated Pipeline for Parameter-Efficient Fine-Tuning of Large Language Models
por: Fang, Zihan, et al.
Publicado: (2024)
por: Fang, Zihan, et al.
Publicado: (2024)
Efficient and Scalable Fine-Tune of Language Models for Genome Understanding
por: Zhan, Huixin, et al.
Publicado: (2024)
por: Zhan, Huixin, et al.
Publicado: (2024)
Navigating the Landscape of Large Language Models: A Comprehensive Review and Analysis of Paradigms and Fine-Tuning Strategies
por: Weng, Benjue
Publicado: (2024)
por: Weng, Benjue
Publicado: (2024)
A Stronger Mixture of Low-Rank Experts for Fine-Tuning Foundation Models
por: Sun, Mengyang, et al.
Publicado: (2025)
por: Sun, Mengyang, et al.
Publicado: (2025)
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
por: Hong, Joey, et al.
Publicado: (2024)
por: Hong, Joey, et al.
Publicado: (2024)
ESSAM: A Novel Competitive Evolution Strategies Approach to Reinforcement Learning for Memory Efficient LLMs Fine-Tuning
por: Sun, Zhishen, et al.
Publicado: (2026)
por: Sun, Zhishen, et al.
Publicado: (2026)
Parameter-Efficient Fine-Tuning for Foundation Models
por: Zhang, Dan, et al.
Publicado: (2025)
por: Zhang, Dan, et al.
Publicado: (2025)
Learning What Reinforcement Learning Can't: Interleaved Online Fine-Tuning for Hardest Questions
por: Ma, Lu, et al.
Publicado: (2025)
por: Ma, Lu, et al.
Publicado: (2025)
Boosting Large Language Models with Mask Fine-Tuning
por: Zhang, Mingyuan, et al.
Publicado: (2025)
por: Zhang, Mingyuan, et al.
Publicado: (2025)
Scaling Sparse Fine-Tuning to Large Language Models
por: Ansell, Alan, et al.
Publicado: (2024)
por: Ansell, Alan, et al.
Publicado: (2024)
Fine-Tuning Improves Information Conveyance in Language Models
por: Cheng, Yuwei, et al.
Publicado: (2026)
por: Cheng, Yuwei, et al.
Publicado: (2026)
Learning from Generalization Patterns: An Evaluation-Driven Approach to Enhanced Data Augmentation for Fine-Tuning Small Language Models
por: Song, Huan, et al.
Publicado: (2025)
por: Song, Huan, et al.
Publicado: (2025)
Ejemplares similares
-
Multi-Level Safety Continual Projection for Fine-Tuned Large Language Models without Retraining
por: Han, Bing, et al.
Publicado: (2025) -
KALIE: Fine-Tuning Vision-Language Models for Open-World Manipulation without Robot Data
por: Tang, Grace, et al.
Publicado: (2024) -
Fine-Tuning without Performance Degradation
por: Wang, Han, et al.
Publicado: (2025) -
Crafting Efficient Fine-Tuning Strategies for Large Language Models
por: Oliver, Michael, et al.
Publicado: (2024) -
MathSE: Improving Multimodal Mathematical Reasoning via Self-Evolving Iterative Reflection and Reward-Guided Fine-Tuning
por: Chen, Jinhao, et al.
Publicado: (2025)