When More Experts Hurt: Underfitting in Multi-Expert Learning to Defer
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liu, Shuqi, Cao, Yuzhou, Feng, Lei, An, Bo, Ong, Luke |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
When More Data Hurts: Optimizing Data Coverage While Mitigating Diversity Induced Underfitting in an Ultra-Fast Machine-Learned Potential
von: Gibson, Jason B., et al.
Veröffentlicht: (2024)
von: Gibson, Jason B., et al.
Veröffentlicht: (2024)
Learning-to-Defer with Expert-Conditional Advice
von: Montreuil, Yannis, et al.
Veröffentlicht: (2026)
von: Montreuil, Yannis, et al.
Veröffentlicht: (2026)
Online Learning-to-Defer with Varying Experts
von: Duy, Dang Hoang, et al.
Veröffentlicht: (2026)
von: Duy, Dang Hoang, et al.
Veröffentlicht: (2026)
Deferring Concept Bottleneck Models: Learning to Defer Interventions to Inaccurate Experts
von: Pugnana, Andrea, et al.
Veröffentlicht: (2025)
von: Pugnana, Andrea, et al.
Veröffentlicht: (2025)
Beyond Augmented-Action Surrogates for Multi-Expert Learning-to-Defer
von: Montreuil, Yannis, et al.
Veröffentlicht: (2026)
von: Montreuil, Yannis, et al.
Veröffentlicht: (2026)
Principled Approaches for Learning to Defer with Multiple Experts
von: Mao, Anqi, et al.
Veröffentlicht: (2023)
von: Mao, Anqi, et al.
Veröffentlicht: (2023)
Learning to Defer for Causal Discovery with Imperfect Experts
von: Clivio, Oscar, et al.
Veröffentlicht: (2025)
von: Clivio, Oscar, et al.
Veröffentlicht: (2025)
Why Ask One When You Can Ask $k$? Learning-to-Defer to the Top-$k$ Experts
von: Montreuil, Yannis, et al.
Veröffentlicht: (2025)
von: Montreuil, Yannis, et al.
Veröffentlicht: (2025)
Learning More Generalized Experts by Merging Experts in Mixture-of-Experts
von: Park, Sejik
Veröffentlicht: (2024)
von: Park, Sejik
Veröffentlicht: (2024)
Cost-Sensitive Learning to Defer to Multiple Experts with Workload Constraints
von: Alves, Jean V., et al.
Veröffentlicht: (2024)
von: Alves, Jean V., et al.
Veröffentlicht: (2024)
Graph Representational Learning: When Does More Expressivity Hurt Generalization?
von: Maskey, Sohir, et al.
Veröffentlicht: (2025)
von: Maskey, Sohir, et al.
Veröffentlicht: (2025)
Conformal Prediction Meets Long-tail Classification
von: Liu, Shuqi, et al.
Veröffentlicht: (2025)
von: Liu, Shuqi, et al.
Veröffentlicht: (2025)
Selective Underfitting in Diffusion Models
von: Song, Kiwhan, et al.
Veröffentlicht: (2025)
von: Song, Kiwhan, et al.
Veröffentlicht: (2025)
Mastering Multiple-Expert Routing: Realizable $H$-Consistency and Strong Guarantees for Learning to Defer
von: Mao, Anqi, et al.
Veröffentlicht: (2025)
von: Mao, Anqi, et al.
Veröffentlicht: (2025)
Establishing Linear Surrogate Regret Bounds for Convex Smooth Losses via Convolutional Fenchel-Young Losses
von: Cao, Yuzhou, et al.
Veröffentlicht: (2025)
von: Cao, Yuzhou, et al.
Veröffentlicht: (2025)
Honesty in Causal Forests: When It Helps and When It Hurts
von: Hou, Yanfang, et al.
Veröffentlicht: (2025)
von: Hou, Yanfang, et al.
Veröffentlicht: (2025)
No Need for Learning to Defer? A Training Free Deferral Framework to Multiple Experts through Conformal Prediction
von: Bary, Tim, et al.
Veröffentlicht: (2025)
von: Bary, Tim, et al.
Veröffentlicht: (2025)
More Experts Than Galaxies: Conditionally-overlapping Experts With Biologically-Inspired Fixed Routing
von: Shaier, Sagi, et al.
Veröffentlicht: (2024)
von: Shaier, Sagi, et al.
Veröffentlicht: (2024)
When Learning Hurts: Fixed-Pole RNN for Real-Time Online Training
von: Morgan, Alexander, et al.
Veröffentlicht: (2026)
von: Morgan, Alexander, et al.
Veröffentlicht: (2026)
When to Accept Automated Predictions and When to Defer to Human Judgment?
von: Sikar, Daniel, et al.
Veröffentlicht: (2024)
von: Sikar, Daniel, et al.
Veröffentlicht: (2024)
Bayes without Underfitting: Fully Correlated Deep Learning Posteriors via Alternating Projections
von: Miani, Marco, et al.
Veröffentlicht: (2024)
von: Miani, Marco, et al.
Veröffentlicht: (2024)
Why Do More Experts Fail? A Theoretical Analysis of Model Merging
von: Wang, Zijing, et al.
Veröffentlicht: (2025)
von: Wang, Zijing, et al.
Veröffentlicht: (2025)
Synthetic Augmentation in Imbalanced Learning: When It Helps, When It Hurts, and How Much to Add
von: Ma, Zhengchi, et al.
Veröffentlicht: (2026)
von: Ma, Zhengchi, et al.
Veröffentlicht: (2026)
Mixture Compressor for Mixture-of-Experts LLMs Gains More
von: Huang, Wei, et al.
Veröffentlicht: (2024)
von: Huang, Wei, et al.
Veröffentlicht: (2024)
When More Parameters Hurt: Foundation Model Priors Amplify Worst-Client Disparity Under Extreme Federated Heterogeneity
von: Naseer, Kiran, et al.
Veröffentlicht: (2026)
von: Naseer, Kiran, et al.
Veröffentlicht: (2026)
When Are Experts Misrouted? Counterfactual Routing Analysis in Mixture-of-Experts Language Models
von: Yoon, Youngsik, et al.
Veröffentlicht: (2026)
von: Yoon, Youngsik, et al.
Veröffentlicht: (2026)
The Pitfalls of Memorization: When Memorization Hurts Generalization
von: Bayat, Reza, et al.
Veröffentlicht: (2024)
von: Bayat, Reza, et al.
Veröffentlicht: (2024)
When Correct Demonstrations Hurt: Rethinking the Role of Exemplars in In-Context Learning
von: Qiu, Chenghao, et al.
Veröffentlicht: (2026)
von: Qiu, Chenghao, et al.
Veröffentlicht: (2026)
HoME: Hierarchy of Multi-Gate Experts for Multi-Task Learning at Kuaishou
von: Wang, Xu, et al.
Veröffentlicht: (2024)
von: Wang, Xu, et al.
Veröffentlicht: (2024)
Dynamic Adaptive Shared Experts with Grouped Multi-Head Attention Mixture of Experts
von: Li, Cheng, et al.
Veröffentlicht: (2025)
von: Li, Cheng, et al.
Veröffentlicht: (2025)
Less is More: Undertraining Experts Improves Model Upcycling
von: Horoi, Stefan, et al.
Veröffentlicht: (2025)
von: Horoi, Stefan, et al.
Veröffentlicht: (2025)
Regression with Multi-Expert Deferral
von: Mao, Anqi, et al.
Veröffentlicht: (2024)
von: Mao, Anqi, et al.
Veröffentlicht: (2024)
Multi-Task Reinforcement Learning with Mixture of Orthogonal Experts
von: Hendawy, Ahmed, et al.
Veröffentlicht: (2023)
von: Hendawy, Ahmed, et al.
Veröffentlicht: (2023)
MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts
von: Jin, Peng, et al.
Veröffentlicht: (2024)
von: Jin, Peng, et al.
Veröffentlicht: (2024)
Not All Experts are Equal: Efficient Expert Pruning and Skipping for Mixture-of-Experts Large Language Models
von: Lu, Xudong, et al.
Veröffentlicht: (2024)
von: Lu, Xudong, et al.
Veröffentlicht: (2024)
Theory and Algorithms for Learning with Multi-Class Abstention and Multi-Expert Deferral
von: Mao, Anqi
Veröffentlicht: (2025)
von: Mao, Anqi
Veröffentlicht: (2025)
Deferred is Better: A Framework for Multi-Granularity Deferred Interaction of Heterogeneous Features
von: Xu, Yi, et al.
Veröffentlicht: (2026)
von: Xu, Yi, et al.
Veröffentlicht: (2026)
Harder Tasks Need More Experts: Dynamic Routing in MoE Models
von: Huang, Quzhe, et al.
Veröffentlicht: (2024)
von: Huang, Quzhe, et al.
Veröffentlicht: (2024)
Multi-Subspace Multi-Modal Modeling for Diffusion Models: Estimation, Convergence and Mixture of Experts
von: Yang, Ruofeng, et al.
Veröffentlicht: (2026)
von: Yang, Ruofeng, et al.
Veröffentlicht: (2026)
Distilling A Universal Expert from Clustered Federated Learning
von: Leng, Zeqi, et al.
Veröffentlicht: (2025)
von: Leng, Zeqi, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
When More Data Hurts: Optimizing Data Coverage While Mitigating Diversity Induced Underfitting in an Ultra-Fast Machine-Learned Potential
von: Gibson, Jason B., et al.
Veröffentlicht: (2024) -
Learning-to-Defer with Expert-Conditional Advice
von: Montreuil, Yannis, et al.
Veröffentlicht: (2026) -
Online Learning-to-Defer with Varying Experts
von: Duy, Dang Hoang, et al.
Veröffentlicht: (2026) -
Deferring Concept Bottleneck Models: Learning to Defer Interventions to Inaccurate Experts
von: Pugnana, Andrea, et al.
Veröffentlicht: (2025) -
Beyond Augmented-Action Surrogates for Multi-Expert Learning-to-Defer
von: Montreuil, Yannis, et al.
Veröffentlicht: (2026)