Efficient Dynamic Ensembling for Multiple LLM Experts
Fuente:
arXiv
Guardado en:
| Autores principales: | Hu, Jinwu, Wang, Yufeng, Zhang, Shuhai, Zhou, Kai, Chen, Guohao, Hu, Yu, Xiao, Bin, Tan, Mingkui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Dynamic Compressing Prompts for Efficient Inference of Large Language Models
por: Hu, Jinwu, et al.
Publicado: (2025)
por: Hu, Jinwu, et al.
Publicado: (2025)
Continual Knowledge Adaptation for Reinforcement Learning
por: Hu, Jinwu, et al.
Publicado: (2025)
por: Hu, Jinwu, et al.
Publicado: (2025)
Beyond Model Scaling: Test-Time Intervention for Efficient Deep Reasoning
por: Wang, Qianyue, et al.
Publicado: (2026)
por: Wang, Qianyue, et al.
Publicado: (2026)
Enhancing Perception Capabilities of Multimodal LLMs with Training-Free Fusion
por: Chen, Zhuokun, et al.
Publicado: (2024)
por: Chen, Zhuokun, et al.
Publicado: (2024)
Beyond Fast and Slow: Cognitive-Inspired Elastic Reasoning for Large Language Models
por: Hu, Jinwu, et al.
Publicado: (2025)
por: Hu, Jinwu, et al.
Publicado: (2025)
Test-Time Learning for Large Language Models
por: Hu, Jinwu, et al.
Publicado: (2025)
por: Hu, Jinwu, et al.
Publicado: (2025)
EvidFuse: Writing-Time Evidence Learning for Consistent Text-Chart Data Reporting
por: Lin, Huanxiang, et al.
Publicado: (2026)
por: Lin, Huanxiang, et al.
Publicado: (2026)
Enhancing User-Oriented Proactivity in Open-Domain Dialogues with Critic Guidance
por: Wang, Yufeng, et al.
Publicado: (2025)
por: Wang, Yufeng, et al.
Publicado: (2025)
Open-World Drone Active Tracking with Goal-Centered Rewards
por: Sun, Haowei, et al.
Publicado: (2024)
por: Sun, Haowei, et al.
Publicado: (2024)
Precedent-Informed Reasoning: Mitigating Overthinking in Large Reasoning Models via Test-Time Precedent Learning
por: Wang, Qianyue, et al.
Publicado: (2026)
por: Wang, Qianyue, et al.
Publicado: (2026)
Zero-Shot Skeleton-Based Action Recognition With Prototype-Guided Feature Alignment
por: Zhou, Kai, et al.
Publicado: (2025)
por: Zhou, Kai, et al.
Publicado: (2025)
Generating Long-form Story Using Dynamic Hierarchical Outlining with Memory-Enhancement
por: Wang, Qianyue, et al.
Publicado: (2024)
por: Wang, Qianyue, et al.
Publicado: (2024)
Conformal Set-based Human-AI Complementarity with Multiple Experts
por: Paat, Helbert, et al.
Publicado: (2025)
por: Paat, Helbert, et al.
Publicado: (2025)
R-Stitch: Dynamic Trajectory Stitching for Efficient Reasoning
por: Chen, Zhuokun, et al.
Publicado: (2025)
por: Chen, Zhuokun, et al.
Publicado: (2025)
Training-Free Test-Time Contrastive Learning for Large Language Models
por: Zheng, Kaiwen, et al.
Publicado: (2026)
por: Zheng, Kaiwen, et al.
Publicado: (2026)
Fed-EINI: An Efficient and Interpretable Inference Framework for Decision Tree Ensembles in Federated Learning
por: Chen, Xiaolin, et al.
Publicado: (2021)
por: Chen, Xiaolin, et al.
Publicado: (2021)
Klotski: Efficient Mixture-of-Expert Inference via Expert-Aware Multi-Batch Pipeline
por: Fang, Zhiyuan, et al.
Publicado: (2025)
por: Fang, Zhiyuan, et al.
Publicado: (2025)
AutoRPA: Efficient GUI Automation through LLM-Driven Code Synthesis from Interactions
por: Chen, Minghao, et al.
Publicado: (2026)
por: Chen, Minghao, et al.
Publicado: (2026)
Dynamic Mixed-Precision Routing for Efficient Multi-step LLM Interaction
por: Li, Yuanzhe, et al.
Publicado: (2026)
por: Li, Yuanzhe, et al.
Publicado: (2026)
SlimPack: Fine-Grained Asymmetric Packing for Balanced and Efficient Variable-Length LLM Training
por: Liu, Yuliang, et al.
Publicado: (2025)
por: Liu, Yuliang, et al.
Publicado: (2025)
cuPilot: A Strategy-Coordinated Multi-agent Framework for CUDA Kernel Evolution
por: Chen, Jinwu, et al.
Publicado: (2025)
por: Chen, Jinwu, et al.
Publicado: (2025)
FLRC: Fine-grained Low-Rank Compressor for Efficient LLM Inference
por: Lu, Yu-Chen, et al.
Publicado: (2025)
por: Lu, Yu-Chen, et al.
Publicado: (2025)
Doing What They Say, Not What They Reason: Locating the Faithfulness Gap in LLM Agents
por: Wang, Yufeng
Publicado: (2026)
por: Wang, Yufeng
Publicado: (2026)
Guiding LLM Post-training Data Engineering with Model Internals from Sparse Autoencoders
por: Jing, Yi, et al.
Publicado: (2026)
por: Jing, Yi, et al.
Publicado: (2026)
Compass: Navigating Global Marine Lead Data Integration through Expert-Guided LLM Agent
por: Liu, Yiming, et al.
Publicado: (2026)
por: Liu, Yiming, et al.
Publicado: (2026)
Multiple Heads are Better than One: Mixture of Modality Knowledge Experts for Entity Representation Learning
por: Zhang, Yichi, et al.
Publicado: (2024)
por: Zhang, Yichi, et al.
Publicado: (2024)
SpeContext: Enabling Efficient Long-context Reasoning with Speculative Context Sparsity in LLMs
por: Xu, Jiaming, et al.
Publicado: (2025)
por: Xu, Jiaming, et al.
Publicado: (2025)
FCN-LLM: Empower LLM for Brain Functional Connectivity Network Understanding via Graph-level Multi-task Instruction Tuning
por: Hu, Xingcan, et al.
Publicado: (2026)
por: Hu, Xingcan, et al.
Publicado: (2026)
Enabling Intelligent Interactions between an Agent and an LLM: A Reinforcement Learning Approach
por: Hu, Bin, et al.
Publicado: (2023)
por: Hu, Bin, et al.
Publicado: (2023)
Multi-Agent Debate for LLM Judges with Adaptive Stability Detection
por: Hu, Tianyu, et al.
Publicado: (2025)
por: Hu, Tianyu, et al.
Publicado: (2025)
CLPO: Curriculum Learning meets Policy Optimization for LLM Reasoning
por: Zhang, Shijie, et al.
Publicado: (2025)
por: Zhang, Shijie, et al.
Publicado: (2025)
Expert Personas Improve LLM Alignment but Damage Accuracy: Bootstrapping Intent-Based Persona Routing with PRISM
por: Hu, Zizhao, et al.
Publicado: (2026)
por: Hu, Zizhao, et al.
Publicado: (2026)
Dynamic Expert Specialization: Towards Catastrophic Forgetting-Free Multi-Domain MoE Adaptation
por: Li, Junzhuo, et al.
Publicado: (2025)
por: Li, Junzhuo, et al.
Publicado: (2025)
Optimal Expert-Attention Allocation in Mixture-of-Experts: A Scalable Law for Dynamic Model Design
por: Li, Junzhuo, et al.
Publicado: (2026)
por: Li, Junzhuo, et al.
Publicado: (2026)
COGNITION: From Evaluation to Defense against Multimodal LLM CAPTCHA Solvers
por: Wang, Junyu, et al.
Publicado: (2025)
por: Wang, Junyu, et al.
Publicado: (2025)
Do We Truly Need So Many Samples? Multi-LLM Repeated Sampling Efficiently Scales Test-Time Compute
por: Chen, Jianhao, et al.
Publicado: (2025)
por: Chen, Jianhao, et al.
Publicado: (2025)
F5C-finder: An Explainable and Ensemble Biological Language Model for Predicting 5-Formylcytidine Modifications on mRNA
por: Wang, Guohao, et al.
Publicado: (2024)
por: Wang, Guohao, et al.
Publicado: (2024)
EnECG: Efficient Ensemble Learning for Electrocardiogram Multi-task Foundation Model
por: Xu, Yuhao, et al.
Publicado: (2025)
por: Xu, Yuhao, et al.
Publicado: (2025)
Simulating Human-Like Learning Dynamics with LLM-Empowered Agents
por: Yuan, Yu, et al.
Publicado: (2025)
por: Yuan, Yu, et al.
Publicado: (2025)
ECG-MoE: Mixture-of-Expert Electrocardiogram Foundation Model
por: Xu, Yuhao, et al.
Publicado: (2026)
por: Xu, Yuhao, et al.
Publicado: (2026)
Ejemplares similares
-
Dynamic Compressing Prompts for Efficient Inference of Large Language Models
por: Hu, Jinwu, et al.
Publicado: (2025) -
Continual Knowledge Adaptation for Reinforcement Learning
por: Hu, Jinwu, et al.
Publicado: (2025) -
Beyond Model Scaling: Test-Time Intervention for Efficient Deep Reasoning
por: Wang, Qianyue, et al.
Publicado: (2026) -
Enhancing Perception Capabilities of Multimodal LLMs with Training-Free Fusion
por: Chen, Zhuokun, et al.
Publicado: (2024) -
Beyond Fast and Slow: Cognitive-Inspired Elastic Reasoning for Large Language Models
por: Hu, Jinwu, et al.
Publicado: (2025)