Mixtures of In-Context Learners
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hong, Giwon, van Krieken, Emile, Ponti, Edoardo, Malkin, Nikolay, Minervini, Pasquale |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On the Independence Assumption in Neurosymbolic Learning
par: van Krieken, Emile, et autres
Publié: (2024)
par: van Krieken, Emile, et autres
Publié: (2024)
Probing the Emergence of Cross-lingual Alignment during LLM Training
par: Wang, Hetong, et autres
Publié: (2024)
par: Wang, Hetong, et autres
Publié: (2024)
Neurosymbolic Diffusion Models
par: van Krieken, Emile, et autres
Publié: (2025)
par: van Krieken, Emile, et autres
Publié: (2025)
Neurosymbolic Reasoning Shortcuts under the Independence Assumption
par: van Krieken, Emile, et autres
Publié: (2025)
par: van Krieken, Emile, et autres
Publié: (2025)
Optimisation in Neurosymbolic Learning Systems
par: van Krieken, Emile
Publié: (2024)
par: van Krieken, Emile
Publié: (2024)
SynDARin: Synthesising Datasets for Automated Reasoning in Low-Resource Languages
par: Ghazaryan, Gayane, et autres
Publié: (2024)
par: Ghazaryan, Gayane, et autres
Publié: (2024)
Emergent Communication Pretraining for Few-Shot Machine Translation
par: Li, Yaoyiran, et autres
Publié: (2020)
par: Li, Yaoyiran, et autres
Publié: (2020)
Compositional Steering of Large Language Models with Steering Tokens
par: Radevski, Gorjan, et autres
Publié: (2026)
par: Radevski, Gorjan, et autres
Publié: (2026)
On the Theoretical Limitations of Embedding-based Link Prediction
par: Badreddine, Samy, et autres
Publié: (2025)
par: Badreddine, Samy, et autres
Publié: (2025)
LLMs Are In-Context Bandit Reinforcement Learners
par: Monea, Giovanni, et autres
Publié: (2024)
par: Monea, Giovanni, et autres
Publié: (2024)
V-STaR: Training Verifiers for Self-Taught Reasoners
par: Hosseini, Arian, et autres
Publié: (2024)
par: Hosseini, Arian, et autres
Publié: (2024)
Scaling Sparse Fine-Tuning to Large Language Models
par: Ansell, Alan, et autres
Publié: (2024)
par: Ansell, Alan, et autres
Publié: (2024)
Reward Is Enough: LLMs Are In-Context Reinforcement Learners
par: Song, Kefan, et autres
Publié: (2025)
par: Song, Kefan, et autres
Publié: (2025)
Large Language Models are Miscalibrated In-Context Learners
par: Li, Chengzu, et autres
Publié: (2023)
par: Li, Chengzu, et autres
Publié: (2023)
Model Merging by Uncertainty-Based Gradient Matching
par: Daheim, Nico, et autres
Publié: (2023)
par: Daheim, Nico, et autres
Publié: (2023)
FLARE: Faithful Logic-Aided Reasoning and Exploration
par: Arakelyan, Erik, et autres
Publié: (2024)
par: Arakelyan, Erik, et autres
Publié: (2024)
Spectral Editing of Activations for Large Language Model Alignment
par: Qiu, Yifu, et autres
Publié: (2024)
par: Qiu, Yifu, et autres
Publié: (2024)
MoBA: Mixture of Block Attention for Long-Context LLMs
par: Lu, Enzhe, et autres
Publié: (2025)
par: Lu, Enzhe, et autres
Publié: (2025)
Blending Supervised and Reinforcement Fine-Tuning with Prefix Sampling
par: Huang, Zeyu, et autres
Publié: (2025)
par: Huang, Zeyu, et autres
Publié: (2025)
ULLER: A Unified Language for Learning and Reasoning
par: van Krieken, Emile, et autres
Publié: (2024)
par: van Krieken, Emile, et autres
Publié: (2024)
Self-Improving World Modelling with Latent Actions
par: Qiu, Yifu, et autres
Publié: (2026)
par: Qiu, Yifu, et autres
Publié: (2026)
DashAttention: Differentiable and Adaptive Sparse Hierarchical Attention
par: Huang, Yuxiang, et autres
Publié: (2026)
par: Huang, Yuxiang, et autres
Publié: (2026)
Are We Done with MMLU?
par: Gema, Aryo Pradipta, et autres
Publié: (2024)
par: Gema, Aryo Pradipta, et autres
Publié: (2024)
In-Context Parametric Inference: Point or Distribution Estimators?
par: Mittal, Sarthak, et autres
Publié: (2025)
par: Mittal, Sarthak, et autres
Publié: (2025)
GRAPES: Learning to Sample Graphs for Scalable Graph Neural Networks
par: Younesian, Taraneh, et autres
Publié: (2023)
par: Younesian, Taraneh, et autres
Publié: (2023)
Evaluating and Safeguarding the Adversarial Robustness of Retrieval-Based In-Context Learning
par: Yu, Simon, et autres
Publié: (2024)
par: Yu, Simon, et autres
Publié: (2024)
Fast and Expressive Multi-Token Prediction with Probabilistic Circuits
par: Grivas, Andreas, et autres
Publié: (2025)
par: Grivas, Andreas, et autres
Publié: (2025)
Active Learners as Efficient PRP Rerankers
par: Paschmann, Jeremías Figueiredo, et autres
Publié: (2026)
par: Paschmann, Jeremías Figueiredo, et autres
Publié: (2026)
Large Language Models are Null-Shot Learners
par: Taveekitworachai, Pittawat, et autres
Publié: (2024)
par: Taveekitworachai, Pittawat, et autres
Publié: (2024)
Large Language Models are Biased Reinforcement Learners
par: Hayes, William M., et autres
Publié: (2024)
par: Hayes, William M., et autres
Publié: (2024)
ExpeL: LLM Agents Are Experiential Learners
par: Zhao, Andrew, et autres
Publié: (2023)
par: Zhao, Andrew, et autres
Publié: (2023)
Large Language Models are Good Relational Learners
par: Wu, Fang, et autres
Publié: (2025)
par: Wu, Fang, et autres
Publié: (2025)
Instruction-tuned Language Models are Better Knowledge Learners
par: Jiang, Zhengbao, et autres
Publié: (2024)
par: Jiang, Zhengbao, et autres
Publié: (2024)
In-context Continual Learning Assisted by an External Continual Learner
par: Momeni, Saleh, et autres
Publié: (2024)
par: Momeni, Saleh, et autres
Publié: (2024)
Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models
par: Zhang, Qizheng, et autres
Publié: (2025)
par: Zhang, Qizheng, et autres
Publié: (2025)
Parameter-Efficient Routed Fine-Tuning: Mixture-of-Experts Demands Mixture of Adaptation Modules
par: Liu, Yilun, et autres
Publié: (2025)
par: Liu, Yilun, et autres
Publié: (2025)
BEARS Make Neuro-Symbolic Models Aware of their Reasoning Shortcuts
par: Marconato, Emanuele, et autres
Publié: (2024)
par: Marconato, Emanuele, et autres
Publié: (2024)
Multi-Head Mixture-of-Experts
par: Wu, Xun, et autres
Publié: (2024)
par: Wu, Xun, et autres
Publié: (2024)
Mixture of Attentions For Speculative Decoding
par: Zimmer, Matthieu, et autres
Publié: (2024)
par: Zimmer, Matthieu, et autres
Publié: (2024)
Routing-Free Mixture-of-Experts
par: Liu, Yilun, et autres
Publié: (2026)
par: Liu, Yilun, et autres
Publié: (2026)
Documents similaires
-
On the Independence Assumption in Neurosymbolic Learning
par: van Krieken, Emile, et autres
Publié: (2024) -
Probing the Emergence of Cross-lingual Alignment during LLM Training
par: Wang, Hetong, et autres
Publié: (2024) -
Neurosymbolic Diffusion Models
par: van Krieken, Emile, et autres
Publié: (2025) -
Neurosymbolic Reasoning Shortcuts under the Independence Assumption
par: van Krieken, Emile, et autres
Publié: (2025) -
Optimisation in Neurosymbolic Learning Systems
par: van Krieken, Emile
Publié: (2024)