A Memetic Walrus Algorithm with Expert-guided Strategy for Adaptive Curriculum Sequencing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Qionghao, Lu, Lingnuo, Wu, Xuemei, Jiang, Fan, Wang, Xizhe, Wang, Xun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mastering the Minority: An Uncertainty-guided Multi-Expert Framework for Challenging-tailed Sequence Learning
par: Wang, Ye, et autres
Publié: (2026)
par: Wang, Ye, et autres
Publié: (2026)
Multi-Head Mixture-of-Experts
par: Wu, Xun, et autres
Publié: (2024)
par: Wu, Xun, et autres
Publié: (2024)
Expert Race: A Flexible Routing Strategy for Scaling Diffusion Transformer with Mixture of Experts
par: Yuan, Yike, et autres
Publié: (2025)
par: Yuan, Yike, et autres
Publié: (2025)
Walrus: A Cross-Domain Foundation Model for Continuum Dynamics
par: McCabe, Michael, et autres
Publié: (2025)
par: McCabe, Michael, et autres
Publié: (2025)
Finding Fantastic Experts in MoEs: A Unified Study for Expert Dropping Strategies and Observations
par: Jaiswal, Ajay, et autres
Publié: (2025)
par: Jaiswal, Ajay, et autres
Publié: (2025)
Accelerating Mixture-of-Expert Inference with Adaptive Expert Split Mechanism
par: Yan, Jiaming, et autres
Publié: (2025)
par: Yan, Jiaming, et autres
Publié: (2025)
Route Experts by Sequence, not by Token
par: Wen, Tiansheng, et autres
Publié: (2025)
par: Wen, Tiansheng, et autres
Publié: (2025)
MIPS: a Multimodal Infinite Polymer Sequence Pre-training Framework for Polymer Property Prediction
par: Wang, Jiaxi, et autres
Publié: (2025)
par: Wang, Jiaxi, et autres
Publié: (2025)
Curriculum reinforcement learning with measurable task representation learning
par: Wen, Yongyan, et autres
Publié: (2026)
par: Wen, Yongyan, et autres
Publié: (2026)
Pretext Training Algorithms for Event Sequence Data
par: Wang, Yimu, et autres
Publié: (2024)
par: Wang, Yimu, et autres
Publié: (2024)
Seeing Through VisualBERT: A Causal Adventure on Memetic Landscapes
par: Bandyopadhyay, Dibyanayan, et autres
Publié: (2024)
par: Bandyopadhyay, Dibyanayan, et autres
Publié: (2024)
Artificial Intelligence and Deep Learning Algorithms for Epigenetic Sequence Analysis: A Review for Epigeneticists and AI Experts
par: Tahir, Muhammad, et autres
Publié: (2025)
par: Tahir, Muhammad, et autres
Publié: (2025)
FitText: Evolving Agent Tool Ecologies via Memetic Retrieval
par: Zheng, Kyle, et autres
Publié: (2026)
par: Zheng, Kyle, et autres
Publié: (2026)
AnyExperts: On-Demand Expert Allocation for Multimodal Language Models with Mixture of Expert
par: Gao, Yuting, et autres
Publié: (2025)
par: Gao, Yuting, et autres
Publié: (2025)
AceGRPO: Adaptive Curriculum Enhanced Group Relative Policy Optimization for Autonomous Machine Learning Engineering
par: Cai, Yuzhu, et autres
Publié: (2026)
par: Cai, Yuzhu, et autres
Publié: (2026)
Collaborative Adaptive Curriculum for Progressive Knowledge Distillation
par: Liu, Jing, et autres
Publié: (2026)
par: Liu, Jing, et autres
Publié: (2026)
Sharpening the Spear: Adaptive Expert-Guided Adversarial Attack Against DRL-based Autonomous Driving Policies
par: Fan, Junchao, et autres
Publié: (2025)
par: Fan, Junchao, et autres
Publié: (2025)
M$^2$FMoE: Multi-Resolution Multi-View Frequency Mixture-of-Experts for Extreme-Adaptive Time Series Forecasting
par: Huang, Yaohui, et autres
Publié: (2026)
par: Huang, Yaohui, et autres
Publié: (2026)
Machine Learning-Based Genomic Linguistic Analysis (Gene Sequence Feature Learning): A Case Study on Predicting Heavy Metal Response Genes in Rice
par: Yang, Ruiqi, et autres
Publié: (2025)
par: Yang, Ruiqi, et autres
Publié: (2025)
Geometric Mixture-of-Experts with Curvature-Guided Adaptive Routing for Graph Representation Learning
par: Cao, Haifang, et autres
Publié: (2026)
par: Cao, Haifang, et autres
Publié: (2026)
Bandit Guided Submodular Curriculum for Adaptive Subset Selection
par: Chanda, Prateek, et autres
Publié: (2025)
par: Chanda, Prateek, et autres
Publié: (2025)
A Curriculum Learning Approach to Reinforcement Learning: Leveraging RAG for Multimodal Question Answering
par: Zhang, Chenliang, et autres
Publié: (2025)
par: Zhang, Chenliang, et autres
Publié: (2025)
Gradient Descent Algorithm Survey
par: Fucheng, Deng, et autres
Publié: (2025)
par: Fucheng, Deng, et autres
Publié: (2025)
UniPool: A Globally Shared Expert Pool for Mixture-of-Experts
par: Huang, Minbin, et autres
Publié: (2026)
par: Huang, Minbin, et autres
Publié: (2026)
Dynamic Adaptive Shared Experts with Grouped Multi-Head Attention Mixture of Experts
par: Li, Cheng, et autres
Publié: (2025)
par: Li, Cheng, et autres
Publié: (2025)
Automatic Curriculum Expert Iteration for Reliable LLM Reasoning
par: Zhao, Zirui, et autres
Publié: (2024)
par: Zhao, Zirui, et autres
Publié: (2024)
A Comprehensive Survey of Mixture-of-Experts: Algorithms, Theory, and Applications
par: Mu, Siyuan, et autres
Publié: (2025)
par: Mu, Siyuan, et autres
Publié: (2025)
DBES: A Systematic Benchmark and Metric Suite for Evaluating Expert Specialization in Large-Scale MoEs
par: Wang, Jing, et autres
Publié: (2026)
par: Wang, Jing, et autres
Publié: (2026)
AdaCuRL: Adaptive Curriculum Reinforcement Learning with Invalid Sample Mitigation and Historical Revisiting
par: Li, Renda, et autres
Publié: (2025)
par: Li, Renda, et autres
Publié: (2025)
HyperMoE: Towards Better Mixture of Experts via Transferring Among Experts
par: Zhao, Hao, et autres
Publié: (2024)
par: Zhao, Hao, et autres
Publié: (2024)
Klotski: Efficient Mixture-of-Expert Inference via Expert-Aware Multi-Batch Pipeline
par: Fang, Zhiyuan, et autres
Publié: (2025)
par: Fang, Zhiyuan, et autres
Publié: (2025)
A Self-guided Multimodal Approach to Enhancing Graph Representation Learning for Alzheimer's Diseases
par: Wang, Zhepeng, et autres
Publié: (2024)
par: Wang, Zhepeng, et autres
Publié: (2024)
Research on Personalized Medical Intervention Strategy Generation System based on Group Relative Policy Optimization and Time-Series Data Fusion
par: Lu, Dingxin, et autres
Publié: (2025)
par: Lu, Dingxin, et autres
Publié: (2025)
Enhancing DP-SGD through Non-monotonous Adaptive Scaling Gradient Weight
par: Huang, Tao, et autres
Publié: (2024)
par: Huang, Tao, et autres
Publié: (2024)
Retro-Expert: Collaborative Reasoning for Interpretable Retrosynthesis
par: Li, Xinyi, et autres
Publié: (2025)
par: Li, Xinyi, et autres
Publié: (2025)
PDNNet: PDN-Aware GNN-CNN Heterogeneous Network for Dynamic IR Drop Prediction
par: Zhao, Yuxiang, et autres
Publié: (2024)
par: Zhao, Yuxiang, et autres
Publié: (2024)
Learning from B Cell Evolution: Adaptive Multi-Expert Diffusion for Antibody Design via Online Optimization
par: Feng, Hanqi, et autres
Publié: (2025)
par: Feng, Hanqi, et autres
Publié: (2025)
SD-MoE: Spectral Decomposition for Effective Expert Specialization
par: Huang, Ruijun, et autres
Publié: (2026)
par: Huang, Ruijun, et autres
Publié: (2026)
Curriculum Abductive Learning
par: Hu, Wen-Chao, et autres
Publié: (2025)
par: Hu, Wen-Chao, et autres
Publié: (2025)
GenPlan: Generative Sequence Models as Adaptive Planners
par: Karthikeyan, Akash, et autres
Publié: (2024)
par: Karthikeyan, Akash, et autres
Publié: (2024)
Documents similaires
-
Mastering the Minority: An Uncertainty-guided Multi-Expert Framework for Challenging-tailed Sequence Learning
par: Wang, Ye, et autres
Publié: (2026) -
Multi-Head Mixture-of-Experts
par: Wu, Xun, et autres
Publié: (2024) -
Expert Race: A Flexible Routing Strategy for Scaling Diffusion Transformer with Mixture of Experts
par: Yuan, Yike, et autres
Publié: (2025) -
Walrus: A Cross-Domain Foundation Model for Continuum Dynamics
par: McCabe, Michael, et autres
Publié: (2025) -
Finding Fantastic Experts in MoEs: A Unified Study for Expert Dropping Strategies and Observations
par: Jaiswal, Ajay, et autres
Publié: (2025)