Mixture-of-Instructions: Aligning Large Language Models via Mixture Prompting
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Bowen, Wu, Shaoyu, Liu, Kai, Hu, Lulu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
D-CORE: Incentivizing Task Decomposition in Large Reasoning Models for Complex Tool Use
por: Xu, Bowen, et al.
Publicado: (2026)
por: Xu, Bowen, et al.
Publicado: (2026)
La RoSA: Enhancing LLM Efficiency via Layerwise Rotated Sparse Activation
por: Liu, Kai, et al.
Publicado: (2025)
por: Liu, Kai, et al.
Publicado: (2025)
Enhancing Complex Instruction Following for Large Language Models with Mixture-of-Contexts Fine-tuning
por: Lu, Yuheng, et al.
Publicado: (2025)
por: Lu, Yuheng, et al.
Publicado: (2025)
Domain Mixture Design via Log-Likelihood Differences for Aligning Language Models with a Target Model
por: Kishino, Ryo, et al.
Publicado: (2026)
por: Kishino, Ryo, et al.
Publicado: (2026)
ChartMoE: Mixture of Diversely Aligned Expert Connector for Chart Understanding
por: Xu, Zhengzhuo, et al.
Publicado: (2024)
por: Xu, Zhengzhuo, et al.
Publicado: (2024)
Privacy-Preserving Instructions for Aligning Large Language Models
por: Yu, Da, et al.
Publicado: (2024)
por: Yu, Da, et al.
Publicado: (2024)
Mixture-of-Agents Enhances Large Language Model Capabilities
por: Wang, Junlin, et al.
Publicado: (2024)
por: Wang, Junlin, et al.
Publicado: (2024)
Mixture of Experts Made Personalized: Federated Prompt Learning for Vision-Language Models
por: Luo, Jun, et al.
Publicado: (2024)
por: Luo, Jun, et al.
Publicado: (2024)
DIVE into MoE: Diversity-Enhanced Reconstruction of Large Language Models from Dense into Mixture-of-Experts
por: Feng, Yuchen, et al.
Publicado: (2025)
por: Feng, Yuchen, et al.
Publicado: (2025)
Bayesian Mixture of Experts For Large Language Models
por: Dialameh, Maryam, et al.
Publicado: (2025)
por: Dialameh, Maryam, et al.
Publicado: (2025)
Mixture of Reasonings: Teach Large Language Models to Reason with Adaptive Strategies
por: Xiong, Tao, et al.
Publicado: (2025)
por: Xiong, Tao, et al.
Publicado: (2025)
Mixture-of-Prompt-Experts for Multi-modal Semantic Understanding
por: Wu, Zichen, et al.
Publicado: (2024)
por: Wu, Zichen, et al.
Publicado: (2024)
Upcycling Large Language Models into Mixture of Experts
por: He, Ethan, et al.
Publicado: (2024)
por: He, Ethan, et al.
Publicado: (2024)
MoPD: Mixture-of-Prompts Distillation for Vision-Language Models
por: Chen, Yang, et al.
Publicado: (2024)
por: Chen, Yang, et al.
Publicado: (2024)
Learning Attentional Mixture of LoRAs for Language Model Continual Learning
por: Liu, Jialin, et al.
Publicado: (2024)
por: Liu, Jialin, et al.
Publicado: (2024)
Defense against Prompt Injection Attacks via Mixture of Encodings
por: Zhang, Ruiyi, et al.
Publicado: (2025)
por: Zhang, Ruiyi, et al.
Publicado: (2025)
Unveiling Super Experts in Mixture-of-Experts Large Language Models
por: Su, Zunhai, et al.
Publicado: (2025)
por: Su, Zunhai, et al.
Publicado: (2025)
SciDFM: A Large Language Model with Mixture-of-Experts for Science
por: Sun, Liangtai, et al.
Publicado: (2024)
por: Sun, Liangtai, et al.
Publicado: (2024)
Mixture of Heterogeneous Grouped Experts for Language Modeling
por: Ma, Zhicheng, et al.
Publicado: (2026)
por: Ma, Zhicheng, et al.
Publicado: (2026)
LLaVA-CMoE: Towards Continual Mixture of Experts for Large Vision-Language Models
por: Zhao, Hengyuan, et al.
Publicado: (2025)
por: Zhao, Hengyuan, et al.
Publicado: (2025)
AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models
por: Liu, Xiaogeng, et al.
Publicado: (2023)
por: Liu, Xiaogeng, et al.
Publicado: (2023)
Long-Short Chain-of-Thought Mixture Supervised Fine-Tuning Eliciting Efficient Reasoning in Large Language Models
por: Yu, Bin, et al.
Publicado: (2025)
por: Yu, Bin, et al.
Publicado: (2025)
Mixture-of-Skills: Learning to Optimize Data Usage for Fine-Tuning Large Language Models
por: Wu, Minghao, et al.
Publicado: (2024)
por: Wu, Minghao, et al.
Publicado: (2024)
A Survey on Mixture of Experts in Large Language Models
por: Cai, Weilin, et al.
Publicado: (2024)
por: Cai, Weilin, et al.
Publicado: (2024)
LLMSurgeon: Diagnosing Data Mixture of Large Language Models
por: Luo, Yaxin, et al.
Publicado: (2026)
por: Luo, Yaxin, et al.
Publicado: (2026)
Prompt Attack Detection with LLM-as-a-Judge and Mixture-of-Models
por: Le, Hieu Xuan, et al.
Publicado: (2026)
por: Le, Hieu Xuan, et al.
Publicado: (2026)
Routing-Aligned Fine-Tuning for Multilingual Downstream Tasks in Mixture-of-Experts Models
por: Deng, Guanzhi, et al.
Publicado: (2026)
por: Deng, Guanzhi, et al.
Publicado: (2026)
Rethinking Data Mixture for Large Language Models: A Comprehensive Survey and New Perspectives
por: Liu, Yajiao, et al.
Publicado: (2025)
por: Liu, Yajiao, et al.
Publicado: (2025)
Cluster-Driven Expert Pruning for Mixture-of-Experts Large Language Models
por: Guo, Hongcheng, et al.
Publicado: (2025)
por: Guo, Hongcheng, et al.
Publicado: (2025)
A Closer Look into Mixture-of-Experts in Large Language Models
por: Lo, Ka Man, et al.
Publicado: (2024)
por: Lo, Ka Man, et al.
Publicado: (2024)
Black-Box Prompt Optimization: Aligning Large Language Models without Model Training
por: Cheng, Jiale, et al.
Publicado: (2023)
por: Cheng, Jiale, et al.
Publicado: (2023)
PSC: Extending Context Window of Large Language Models via Phase Shift Calibration
por: Zhu, Wenqiao, et al.
Publicado: (2025)
por: Zhu, Wenqiao, et al.
Publicado: (2025)
MoDES: Accelerating Mixture-of-Experts Multimodal Large Language Models via Dynamic Expert Skipping
por: Huang, Yushi, et al.
Publicado: (2025)
por: Huang, Yushi, et al.
Publicado: (2025)
IAPT: Instruction-Aware Prompt Tuning for Large Language Models
por: Zhu, Wei, et al.
Publicado: (2024)
por: Zhu, Wei, et al.
Publicado: (2024)
Enhancing Large Language Models Against Inductive Instructions with Dual-critique Prompting
por: Wang, Rui, et al.
Publicado: (2023)
por: Wang, Rui, et al.
Publicado: (2023)
Causal Prompting for Implicit Sentiment Analysis with Large Language Models
por: Ren, Jing, et al.
Publicado: (2025)
por: Ren, Jing, et al.
Publicado: (2025)
FactorLLM: Factorizing Knowledge via Mixture of Experts for Large Language Models
por: Zhao, Zhongyu, et al.
Publicado: (2024)
por: Zhao, Zhongyu, et al.
Publicado: (2024)
Router Upcycling: Leveraging Mixture-of-Routers in Mixture-of-Experts Upcycling
por: Ran, Junfeng, et al.
Publicado: (2025)
por: Ran, Junfeng, et al.
Publicado: (2025)
SparseDoctor: Towards Efficient Chat Doctor with Mixture of Experts Enhanced Large Language Models
por: Zhang, Jianbin, et al.
Publicado: (2025)
por: Zhang, Jianbin, et al.
Publicado: (2025)
Upcycling Instruction Tuning from Dense to Mixture-of-Experts via Parameter Merging
por: Hui, Tingfeng, et al.
Publicado: (2024)
por: Hui, Tingfeng, et al.
Publicado: (2024)
Ejemplares similares
-
D-CORE: Incentivizing Task Decomposition in Large Reasoning Models for Complex Tool Use
por: Xu, Bowen, et al.
Publicado: (2026) -
La RoSA: Enhancing LLM Efficiency via Layerwise Rotated Sparse Activation
por: Liu, Kai, et al.
Publicado: (2025) -
Enhancing Complex Instruction Following for Large Language Models with Mixture-of-Contexts Fine-tuning
por: Lu, Yuheng, et al.
Publicado: (2025) -
Domain Mixture Design via Log-Likelihood Differences for Aligning Language Models with a Target Model
por: Kishino, Ryo, et al.
Publicado: (2026) -
ChartMoE: Mixture of Diversely Aligned Expert Connector for Chart Understanding
por: Xu, Zhengzhuo, et al.
Publicado: (2024)