Bridging the Capability Gap: Joint Alignment Tuning for Harmonizing LLM-based Multi-Agent Systems
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhu, Minghang, Shi, Zhengliang, Xu, Zhiwei, Wu, Shiguang, Wang, Lingjie, Ren, Pengjie, Ren, Zhaochun, Chen, Zhumin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evolution without Large Models: Training Language Model with Task Principles
par: Zhu, Minghang, et autres
Publié: (2025)
par: Zhu, Minghang, et autres
Publié: (2025)
Generate-then-Ground in Retrieval-Augmented Generation for Multi-hop Question Answering
par: Shi, Zhengliang, et autres
Publié: (2024)
par: Shi, Zhengliang, et autres
Publié: (2024)
Belief-Calibrated Multi-Agent Consensus Seeking for Complex NLP Tasks
par: Deng, Wentao, et autres
Publié: (2025)
par: Deng, Wentao, et autres
Publié: (2025)
MELoRA: Mini-Ensemble Low-Rank Adapters for Parameter-Efficient Fine-Tuning
par: Ren, Pengjie, et autres
Publié: (2024)
par: Ren, Pengjie, et autres
Publié: (2024)
OpenReward: Learning to Reward Long-form Agentic Tasks via Reinforcement Learning
par: Hu, Ziyou, et autres
Publié: (2025)
par: Hu, Ziyou, et autres
Publié: (2025)
Generative Retrieval as Multi-Vector Dense Retrieval
par: Wu, Shiguang, et autres
Publié: (2024)
par: Wu, Shiguang, et autres
Publié: (2024)
UIPE: Enhancing LLM Unlearning by Removing Knowledge Related to Forgetting Targets
par: Wang, Wenyu, et autres
Publié: (2025)
par: Wang, Wenyu, et autres
Publié: (2025)
Constrained Auto-Regressive Decoding Constrains Generative Retrieval
par: Wu, Shiguang, et autres
Publié: (2025)
par: Wu, Shiguang, et autres
Publié: (2025)
ExcluIR: Exclusionary Neural Information Retrieval
par: Zhang, Wenhao, et autres
Publié: (2024)
par: Zhang, Wenhao, et autres
Publié: (2024)
MEFT: Memory-Efficient Fine-Tuning through Sparse Adapter
par: Hao, Jitai, et autres
Publié: (2024)
par: Hao, Jitai, et autres
Publié: (2024)
A Multi-Agent Conversational Recommender System
par: Fang, Jiabao, et autres
Publié: (2024)
par: Fang, Jiabao, et autres
Publié: (2024)
Self-Supervised Position Debiasing for Large Language Models
par: Liu, Zhongkun, et autres
Publié: (2024)
par: Liu, Zhongkun, et autres
Publié: (2024)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
par: Lyu, Yougang, et autres
Publié: (2024)
par: Lyu, Yougang, et autres
Publié: (2024)
Joint Flashback Adaptation for Forgetting-Resistant Instruction Tuning
par: Zhao, Yukun, et autres
Publié: (2025)
par: Zhao, Yukun, et autres
Publié: (2025)
Is ChatGPT Good at Search? Investigating Large Language Models as Re-Ranking Agents
par: Sun, Weiwei, et autres
Publié: (2023)
par: Sun, Weiwei, et autres
Publié: (2023)
MACPO: Weak-to-Strong Alignment via Multi-Agent Contrastive Preference Optimization
par: Lyu, Yougang, et autres
Publié: (2024)
par: Lyu, Yougang, et autres
Publié: (2024)
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
par: Shi, Zhengliang, et autres
Publié: (2025)
par: Shi, Zhengliang, et autres
Publié: (2025)
Generative News Recommendation
par: Gao, Shen, et autres
Publié: (2024)
par: Gao, Shen, et autres
Publié: (2024)
ASLoRA: Adaptive Sharing Low-Rank Adaptation Across Layers
par: Hu, Junyan, et autres
Publié: (2024)
par: Hu, Junyan, et autres
Publié: (2024)
Disentangling Knowledge Representations for Large Language Model Editing
par: Zhang, Mengqi, et autres
Publié: (2025)
par: Zhang, Mengqi, et autres
Publié: (2025)
Learning to Use Tools via Cooperative and Interactive Agents
par: Shi, Zhengliang, et autres
Publié: (2024)
par: Shi, Zhengliang, et autres
Publié: (2024)
Tool Learning in the Wild: Empowering Language Models as Automatic Tool Agents
par: Shi, Zhengliang, et autres
Publié: (2024)
par: Shi, Zhengliang, et autres
Publié: (2024)
Uncovering Selective State Space Model's Capabilities in Lifelong Sequential Recommendation
par: Yang, Jiyuan, et autres
Publié: (2024)
par: Yang, Jiyuan, et autres
Publié: (2024)
Uncovering Context Reliance in Unstructured Knowledge Editing
par: Zhou, Zisheng, et autres
Publié: (2026)
par: Zhou, Zisheng, et autres
Publié: (2026)
Curriculum Approximate Unlearning for Session-based Recommendation
par: Yang, Liu, et autres
Publié: (2025)
par: Yang, Liu, et autres
Publié: (2025)
A Cooperative Multi-Agent Framework for Zero-Shot Named Entity Recognition
par: Wang, Zihan, et autres
Publié: (2025)
par: Wang, Zihan, et autres
Publié: (2025)
MADS: Model-Aware Diverse Core Set Selection for Instruction Tuning
par: Bai, Yi, et autres
Publié: (2026)
par: Bai, Yi, et autres
Publié: (2026)
Improving Sequential Recommenders through Counterfactual Augmentation of System Exposure
par: Zhao, Ziqi, et autres
Publié: (2025)
par: Zhao, Ziqi, et autres
Publié: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
par: Zhao, Ziqi, et autres
Publié: (2024)
par: Zhao, Ziqi, et autres
Publié: (2024)
Content-Based Collaborative Generation for Recommender Systems
par: Wang, Yidan, et autres
Publié: (2024)
par: Wang, Yidan, et autres
Publié: (2024)
Replication and Exploration of Generative Retrieval over Dynamic Corpora
par: Zhang, Zhen, et autres
Publié: (2025)
par: Zhang, Zhen, et autres
Publié: (2025)
Federated User Behavior Modeling for Privacy-Preserving LLM Recommendation
par: Guo, Lei, et autres
Publié: (2026)
par: Guo, Lei, et autres
Publié: (2026)
Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation
par: Zhu, Dongsheng, et autres
Publié: (2025)
par: Zhu, Dongsheng, et autres
Publié: (2025)
Direct Retrieval-augmented Optimization: Synergizing Knowledge Selection and Language Models
par: Shi, Zhengliang, et autres
Publié: (2025)
par: Shi, Zhengliang, et autres
Publié: (2025)
Beyond Local Views: Global State Inference with Diffusion Models for Cooperative Multi-Agent Reinforcement Learning
par: Xu, Zhiwei, et autres
Publié: (2024)
par: Xu, Zhiwei, et autres
Publié: (2024)
Integrating Chain-of-Thought into Generative Retrieval: A Preliminary Study
par: Zhang, Wenhao, et autres
Publié: (2026)
par: Zhang, Wenhao, et autres
Publié: (2026)
Enhancing Multi-hop Reasoning through Knowledge Erasure in Large Language Model Editing
par: Zhang, Mengqi, et autres
Publié: (2024)
par: Zhang, Mengqi, et autres
Publié: (2024)
Knowledge Graph Enhanced Large Language Model Editing
par: Zhang, Mengqi, et autres
Publié: (2024)
par: Zhang, Mengqi, et autres
Publié: (2024)
Uncovering Overfitting in Large Language Model Editing
par: Zhang, Mengqi, et autres
Publié: (2024)
par: Zhang, Mengqi, et autres
Publié: (2024)
Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers
par: Shi, Zhengliang, et autres
Publié: (2025)
par: Shi, Zhengliang, et autres
Publié: (2025)
Documents similaires
-
Evolution without Large Models: Training Language Model with Task Principles
par: Zhu, Minghang, et autres
Publié: (2025) -
Generate-then-Ground in Retrieval-Augmented Generation for Multi-hop Question Answering
par: Shi, Zhengliang, et autres
Publié: (2024) -
Belief-Calibrated Multi-Agent Consensus Seeking for Complex NLP Tasks
par: Deng, Wentao, et autres
Publié: (2025) -
MELoRA: Mini-Ensemble Low-Rank Adapters for Parameter-Efficient Fine-Tuning
par: Ren, Pengjie, et autres
Publié: (2024) -
OpenReward: Learning to Reward Long-form Agentic Tasks via Reinforcement Learning
par: Hu, Ziyou, et autres
Publié: (2025)