One Prompt is not Enough: Automated Construction of a Mixture-of-Expert Prompts
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Ruochen, An, Sohyun, Cheng, Minhao, Zhou, Tianyi, Hwang, Sung Ju, Hsieh, Cho-Jui |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On Discrete Prompt Optimization for Diffusion Models
par: Wang, Ruochen, et autres
Publié: (2024)
par: Wang, Ruochen, et autres
Publié: (2024)
DrAttack: Prompt Decomposition and Reconstruction Makes Powerful LLM Jailbreakers
par: Li, Xirui, et autres
Publié: (2024)
par: Li, Xirui, et autres
Publié: (2024)
RASP-Tuner: Retrieval-Augmented Soft Prompts for Context-Aware Black-Box Optimization in Non-Stationary Environments
par: Pan, Enze
Publié: (2026)
par: Pan, Enze
Publié: (2026)
Optimization before Evaluation: Evaluation with Unoptimised Prompts Can be Misleading
par: Sadjoli, Nicholas, et autres
Publié: (2026)
par: Sadjoli, Nicholas, et autres
Publié: (2026)
Semantic Needles in Document Haystacks: Sensitivity Testing of LLM-as-a-Judge Similarity Scoring
par: Aksoy, Sinan G., et autres
Publié: (2026)
par: Aksoy, Sinan G., et autres
Publié: (2026)
MOSSBench: Is Your Multimodal Language Model Oversensitive to Safe Queries?
par: Li, Xirui, et autres
Publié: (2024)
par: Li, Xirui, et autres
Publié: (2024)
Don't Think Longer, Think Wisely: Optimizing Thinking Dynamics for Large Reasoning Models
par: An, Sohyun, et autres
Publié: (2025)
par: An, Sohyun, et autres
Publié: (2025)
Script-Based Dialog Policy Planning for LLM-Powered Conversational Agents: A Basic Architecture for an "AI Therapist"
par: Wasenmüller, Robert, et autres
Publié: (2024)
par: Wasenmüller, Robert, et autres
Publié: (2024)
On-Premise SLMs vs. Commercial LLMs: Prompt Engineering and Incident Classification in SOCs and CSIRTs
par: Almeida, Gefté, et autres
Publié: (2025)
par: Almeida, Gefté, et autres
Publié: (2025)
ConSensus: Multi-Agent Collaboration for Multimodal Sensing
par: Yoon, Hyungjun, et autres
Publié: (2026)
par: Yoon, Hyungjun, et autres
Publié: (2026)
SEUF: Is Unlearning One Expert Enough for Mixture-of-Experts LLMs?
par: Zhuang, Haomin, et autres
Publié: (2024)
par: Zhuang, Haomin, et autres
Publié: (2024)
Large Language Models are Interpretable Learners
par: Wang, Ruochen, et autres
Publié: (2024)
par: Wang, Ruochen, et autres
Publié: (2024)
Tape: A Cellular Automata Benchmark for Evaluating Rule-Shift Generalization in Reinforcement Learning
par: Pan, Enze
Publié: (2026)
par: Pan, Enze
Publié: (2026)
seqme: a Python library for evaluating biological sequence design
par: Møller-Larsen, Rasmus, et autres
Publié: (2025)
par: Møller-Larsen, Rasmus, et autres
Publié: (2025)
A Theoretical Analysis of Soft-Label vs Hard-Label Training in Neural Networks
par: Mandal, Saptarshi, et autres
Publié: (2024)
par: Mandal, Saptarshi, et autres
Publié: (2024)
System Prompt Optimization with Meta-Learning
par: Choi, Yumin, et autres
Publié: (2025)
par: Choi, Yumin, et autres
Publié: (2025)
Solving for X and Beyond: Can Large Language Models Solve Complex Math Problems with More-Than-Two Unknowns?
par: Kao, Kuei-Chun, et autres
Publié: (2024)
par: Kao, Kuei-Chun, et autres
Publié: (2024)
R1-Zero's "Aha Moment" in Visual Reasoning on a 2B Non-SFT Model
par: Zhou, Hengguang, et autres
Publié: (2025)
par: Zhou, Hengguang, et autres
Publié: (2025)
confopt: A Library for Implementation and Evaluation of Gradient-based One-Shot NAS Methods
par: Jha, Abhash Kumar, et autres
Publié: (2025)
par: Jha, Abhash Kumar, et autres
Publié: (2025)
Can Out-of-Distribution Evaluations Uncover Reliance on Shortcuts? A Case Study in Question Answering
par: Štefánik, Michal, et autres
Publié: (2025)
par: Štefánik, Michal, et autres
Publié: (2025)
Top-Theta Attention: Sparsifying Transformers by Compensated Thresholding
par: Berestizshevsky, Konstantin, et autres
Publié: (2025)
par: Berestizshevsky, Konstantin, et autres
Publié: (2025)
Transformadores: Fundamentos teoricos y Aplicaciones
par: de la Torre, Jordi
Publié: (2023)
par: de la Torre, Jordi
Publié: (2023)
On Adversarial Examples for Text Classification by Perturbing Latent Representations
par: Sooksatra, Korn, et autres
Publié: (2024)
par: Sooksatra, Korn, et autres
Publié: (2024)
Understanding Knowledge Transferability for Transfer Learning: A Survey
par: Wang, Haohua, et autres
Publié: (2025)
par: Wang, Haohua, et autres
Publié: (2025)
Fast, close, non-singular and property-preserving approximations of entropic measures
par: Horenko, Illia, et autres
Publié: (2025)
par: Horenko, Illia, et autres
Publié: (2025)
What is the $\textit{intrinsic}$ dimension of your binary data? -- and how to compute it quickly
par: Hanika, Tom, et autres
Publié: (2024)
par: Hanika, Tom, et autres
Publié: (2024)
Multimodal Prompt Optimization: Why Not Leverage Multiple Modalities for MLLMs
par: Choi, Yumin, et autres
Publié: (2025)
par: Choi, Yumin, et autres
Publié: (2025)
TSDS: Data Selection for Task-Specific Model Finetuning
par: Liu, Zifan, et autres
Publié: (2024)
par: Liu, Zifan, et autres
Publié: (2024)
Exploring Expert Failures Improves LLM Agent Tuning
par: Lan, Li-Cheng, et autres
Publié: (2025)
par: Lan, Li-Cheng, et autres
Publié: (2025)
Creativity in the Age of AI: Rethinking the Role of Intentional Agency
par: Pearson, James S., et autres
Publié: (2026)
par: Pearson, James S., et autres
Publié: (2026)
Mathematical reasoning and the computer
par: Buzzard, Kevin
Publié: (2025)
par: Buzzard, Kevin
Publié: (2025)
Modeling Clinical Concern Trajectories in Language Model Agents
par: Subaharan, Sukesh, et autres
Publié: (2026)
par: Subaharan, Sukesh, et autres
Publié: (2026)
How well can a large language model explain business processes as perceived by users?
par: Fahland, Dirk, et autres
Publié: (2024)
par: Fahland, Dirk, et autres
Publié: (2024)
humancompatible.detect: a Python Toolkit for Detecting Bias in AI Models
par: Matilla, German M., et autres
Publié: (2025)
par: Matilla, German M., et autres
Publié: (2025)
Toward a Dynamic Stackelberg Game-Theoretic Framework for Agentic AI Defense Against LLM Jailbreaking
par: Han, Zhengye, et autres
Publié: (2025)
par: Han, Zhengye, et autres
Publié: (2025)
BernGraph: Probabilistic Graph Neural Networks for EHR-based Medication Recommendations
par: Piao, Xihao, et autres
Publié: (2024)
par: Piao, Xihao, et autres
Publié: (2024)
Benchmarking PNW Model for MedMNIST to 100% Accuracy
par: Deng, Bo
Publié: (2026)
par: Deng, Bo
Publié: (2026)
SATA-BENCH: Select All That Apply Benchmark for Multiple Choice Questions
par: Xu, Weijie, et autres
Publié: (2025)
par: Xu, Weijie, et autres
Publié: (2025)
Compressible Softmax-Attended Language under Incompressible Attention
par: Lee, Wonsuk
Publié: (2026)
par: Lee, Wonsuk
Publié: (2026)
Sparse MeZO: Less Parameters for Better Performance in Zeroth-Order LLM Fine-Tuning
par: Liu, Yong, et autres
Publié: (2024)
par: Liu, Yong, et autres
Publié: (2024)
Documents similaires
-
On Discrete Prompt Optimization for Diffusion Models
par: Wang, Ruochen, et autres
Publié: (2024) -
DrAttack: Prompt Decomposition and Reconstruction Makes Powerful LLM Jailbreakers
par: Li, Xirui, et autres
Publié: (2024) -
RASP-Tuner: Retrieval-Augmented Soft Prompts for Context-Aware Black-Box Optimization in Non-Stationary Environments
par: Pan, Enze
Publié: (2026) -
Optimization before Evaluation: Evaluation with Unoptimised Prompts Can be Misleading
par: Sadjoli, Nicholas, et autres
Publié: (2026) -
Semantic Needles in Document Haystacks: Sensitivity Testing of LLM-as-a-Judge Similarity Scoring
par: Aksoy, Sinan G., et autres
Publié: (2026)