Mixture-of-Agents Enhances Large Language Model Capabilities
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Junlin, Wang, Jue, Athiwaratkun, Ben, Zhang, Ce, Zou, James |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
When Does Divide and Conquer Work for Long Context LLM? A Noise Decomposition Framework
par: Xu, Zhen, et autres
Publié: (2025)
par: Xu, Zhen, et autres
Publié: (2025)
Improving Model Alignment Through Collective Intelligence of Open-Source LLMS
par: Wang, Junlin, et autres
Publié: (2025)
par: Wang, Junlin, et autres
Publié: (2025)
Scaling Instruction-Tuned LLMs to Million-Token Contexts via Hierarchical Synthetic Data Generation
par: He, Linda, et autres
Publié: (2025)
par: He, Linda, et autres
Publié: (2025)
Staircase Streaming for Low-Latency Multi-Agent Inference
par: Wang, Junlin, et autres
Publié: (2025)
par: Wang, Junlin, et autres
Publié: (2025)
Automated Benchmark Auditing for AI Agents and Large Language Models
par: Wang, Junlin, et autres
Publié: (2026)
par: Wang, Junlin, et autres
Publié: (2026)
Reasoning in Token Economies: Budget-Aware Evaluation of LLM Reasoning Strategies
par: Wang, Junlin, et autres
Publié: (2024)
par: Wang, Junlin, et autres
Publié: (2024)
Training-Free Activation Sparsity in Large Language Models
par: Liu, James, et autres
Publié: (2024)
par: Liu, James, et autres
Publié: (2024)
CDLM: Consistency Diffusion Language Models For Faster Sampling
par: Kim, Minseo, et autres
Publié: (2025)
par: Kim, Minseo, et autres
Publié: (2025)
WebAggregator: Enhancing Compositional Reasoning Capabilities of Deep Research Agent Foundation Models
par: Wang, Rui, et autres
Publié: (2025)
par: Wang, Rui, et autres
Publié: (2025)
TReB: A Comprehensive Benchmark for Evaluating Table Reasoning Capabilities of Large Language Models
par: Li, Ce, et autres
Publié: (2025)
par: Li, Ce, et autres
Publié: (2025)
Enhancing Multilingual Capabilities of Large Language Models through Self-Distillation from Resource-Rich Languages
par: Zhang, Yuanchi, et autres
Publié: (2024)
par: Zhang, Yuanchi, et autres
Publié: (2024)
Disentangling Reasoning and Knowledge in Medical Large Language Models
par: Thapa, Rahul, et autres
Publié: (2025)
par: Thapa, Rahul, et autres
Publié: (2025)
Commander-GPT: Fully Unleashing the Sarcasm Detection Capability of Multi-Modal Large Language Models
par: Zhang, Yazhou, et autres
Publié: (2025)
par: Zhang, Yazhou, et autres
Publié: (2025)
Enhancing the Capability and Robustness of Large Language Models through Reinforcement Learning-Driven Query Refinement
par: Wang, Xiaohua, et autres
Publié: (2024)
par: Wang, Xiaohua, et autres
Publié: (2024)
Cooperative Strategic Planning Enhances Reasoning Capabilities in Large Language Models
par: Wang, Danqing, et autres
Publié: (2024)
par: Wang, Danqing, et autres
Publié: (2024)
Evaluating Accounting Reasoning Capabilities of Large Language Models
par: Zhou, Jie, et autres
Publié: (2026)
par: Zhou, Jie, et autres
Publié: (2026)
Squeeze Evolve: Unified Multi-Model Orchestration for Verifier-Free Evolution
par: Maheswaran, Monishwaran, et autres
Publié: (2026)
par: Maheswaran, Monishwaran, et autres
Publié: (2026)
BattleAgentBench: A Benchmark for Evaluating Cooperation and Competition Capabilities of Language Models in Multi-Agent Systems
par: Wang, Wei, et autres
Publié: (2024)
par: Wang, Wei, et autres
Publié: (2024)
Vision-Language Agents for Interactive Forest Change Analysis
par: Brock, James, et autres
Publié: (2026)
par: Brock, James, et autres
Publié: (2026)
Enhancing Complex Instruction Following for Large Language Models with Mixture-of-Contexts Fine-tuning
par: Lu, Yuheng, et autres
Publié: (2025)
par: Lu, Yuheng, et autres
Publié: (2025)
Improving Natural Language Capability of Code Large Language Model
par: Li, Wei, et autres
Publié: (2024)
par: Li, Wei, et autres
Publié: (2024)
Language-Specific Neurons: The Key to Multilingual Capabilities in Large Language Models
par: Tang, Tianyi, et autres
Publié: (2024)
par: Tang, Tianyi, et autres
Publié: (2024)
Understanding and Steering the Cognitive Behaviors of Reasoning Models at Test-Time
par: Zhang, Zhenyu, et autres
Publié: (2025)
par: Zhang, Zhenyu, et autres
Publié: (2025)
StringLLM: Understanding the String Processing Capability of Large Language Models
par: Wang, Xilong, et autres
Publié: (2024)
par: Wang, Xilong, et autres
Publié: (2024)
SinkLoRA: Enhanced Efficiency and Chat Capabilities for Long-Context Large Language Models
par: Zhang, Hengyu
Publié: (2024)
par: Zhang, Hengyu
Publié: (2024)
FEEL: A Framework for Evaluating Emotional Support Capability with Large Language Models
par: Zhang, Huaiwen, et autres
Publié: (2024)
par: Zhang, Huaiwen, et autres
Publié: (2024)
LLMArena: Assessing Capabilities of Large Language Models in Dynamic Multi-Agent Environments
par: Chen, Junzhe, et autres
Publié: (2024)
par: Chen, Junzhe, et autres
Publié: (2024)
Investigating the (De)Composition Capabilities of Large Language Models in Natural-to-Formal Language Conversion
par: Xu, Ziyao, et autres
Publié: (2025)
par: Xu, Ziyao, et autres
Publié: (2025)
Enhancing Text-to-SQL Capabilities of Large Language Models via Domain Database Knowledge Injection
par: Ma, Xingyu, et autres
Publié: (2024)
par: Ma, Xingyu, et autres
Publié: (2024)
Evaluating Large Language Models with Psychometrics
par: Li, Yuan, et autres
Publié: (2024)
par: Li, Yuan, et autres
Publié: (2024)
EvoMoE: Expert Evolution in Mixture of Experts for Multimodal Large Language Models
par: Jing, Linglin, et autres
Publié: (2025)
par: Jing, Linglin, et autres
Publié: (2025)
RedPajama: an Open Dataset for Training Large Language Models
par: Weber, Maurice, et autres
Publié: (2024)
par: Weber, Maurice, et autres
Publié: (2024)
A Survey on Multi-Turn Interaction Capabilities of Large Language Models
par: Zhang, Chen, et autres
Publié: (2025)
par: Zhang, Chen, et autres
Publié: (2025)
Chatlaw: A Multi-Agent Collaborative Legal Assistant with Knowledge Graph Enhanced Mixture-of-Experts Large Language Model
par: Cui, Jiaxi, et autres
Publié: (2023)
par: Cui, Jiaxi, et autres
Publié: (2023)
MING-MOE: Enhancing Medical Multi-Task Learning in Large Language Models with Sparse Mixture of Low-Rank Adapter Experts
par: Liao, Yusheng, et autres
Publié: (2024)
par: Liao, Yusheng, et autres
Publié: (2024)
Forest-Chat: Adapting Vision-Language Agents for Interactive Forest Change Analysis
par: Brock, James, et autres
Publié: (2026)
par: Brock, James, et autres
Publié: (2026)
Disinformation Capabilities of Large Language Models
par: Vykopal, Ivan, et autres
Publié: (2023)
par: Vykopal, Ivan, et autres
Publié: (2023)
DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts
par: Feng, Yuchen, et autres
Publié: (2025)
par: Feng, Yuchen, et autres
Publié: (2025)
Cluster-Driven Expert Pruning for Mixture-of-Experts Large Language Models
par: Guo, Hongcheng, et autres
Publié: (2025)
par: Guo, Hongcheng, et autres
Publié: (2025)
ToolMem: Enhancing Multimodal Agents with Learnable Tool Capability Memory
par: Xiao, Yunzhong, et autres
Publié: (2025)
par: Xiao, Yunzhong, et autres
Publié: (2025)
Documents similaires
-
When Does Divide and Conquer Work for Long Context LLM? A Noise Decomposition Framework
par: Xu, Zhen, et autres
Publié: (2025) -
Improving Model Alignment Through Collective Intelligence of Open-Source LLMS
par: Wang, Junlin, et autres
Publié: (2025) -
Scaling Instruction-Tuned LLMs to Million-Token Contexts via Hierarchical Synthetic Data Generation
par: He, Linda, et autres
Publié: (2025) -
Staircase Streaming for Low-Latency Multi-Agent Inference
par: Wang, Junlin, et autres
Publié: (2025) -
Automated Benchmark Auditing for AI Agents and Large Language Models
par: Wang, Junlin, et autres
Publié: (2026)