Escaping the Mode Lottery: Multi-Response Training Improves Language Model Generalization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Amin, Hasan, Ahrabian, Kian, Yin, Ming, Khanna, Rajiv |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Align When They Want, Complement When They Need! Human-Centered Ensembles for Adaptive Human-AI Collaboration
par: Amin, Hasan, et autres
Publié: (2026)
par: Amin, Hasan, et autres
Publié: (2026)
On The Adaptation of Unlimiformer for Decoder-Only Transformers
par: Ahrabian, Kian, et autres
Publié: (2024)
par: Ahrabian, Kian, et autres
Publié: (2024)
Escaping Collapse: The Strength of Weak Data for Large Language Model Training
par: Amin, Kareem, et autres
Publié: (2025)
par: Amin, Kareem, et autres
Publié: (2025)
KS-Lottery: Finding Certified Lottery Tickets for Multilingual Language Models
par: Yuan, Fei, et autres
Publié: (2024)
par: Yuan, Fei, et autres
Publié: (2024)
Early Transformers: A study on Efficient Training of Transformer Models through Early-Bird Lottery Tickets
par: Cheekati, Shravan
Publié: (2024)
par: Cheekati, Shravan
Publié: (2024)
Understanding the Relationship between Prompts and Response Uncertainty in Large Language Models
par: Zhang, Ze Yu, et autres
Publié: (2024)
par: Zhang, Ze Yu, et autres
Publié: (2024)
Consistent Diffusion Language Models
par: Amin, Hasan, et autres
Publié: (2026)
par: Amin, Hasan, et autres
Publié: (2026)
Toward Better Temporal Structures for Geopolitical Events Forecasting
par: Ahrabian, Kian, et autres
Publié: (2026)
par: Ahrabian, Kian, et autres
Publié: (2026)
Global-to-Local Support Spectrums for Language Model Explainability
par: Agussurja, Lucas, et autres
Publié: (2024)
par: Agussurja, Lucas, et autres
Publié: (2024)
Beyond Mode-Seeking RL: Trajectory-Balance Post-Training for Diffusion Language Models
par: Ahmadi, Saba, et autres
Publié: (2026)
par: Ahmadi, Saba, et autres
Publié: (2026)
Fine-tuning Language Models with Generative Adversarial Reward Modelling
par: Yu, Zhang Ze, et autres
Publié: (2023)
par: Yu, Zhang Ze, et autres
Publié: (2023)
SELF-PERCEPT: Introspection Improves Large Language Models' Detection of Multi-Person Mental Manipulation in Conversations
par: Khanna, Danush, et autres
Publié: (2025)
par: Khanna, Danush, et autres
Publié: (2025)
Training Language Models on Synthetic Edit Sequences Improves Code Synthesis
par: Piterbarg, Ulyana, et autres
Publié: (2024)
par: Piterbarg, Ulyana, et autres
Publié: (2024)
Augmenting Human-Annotated Training Data with Large Language Model Generation and Distillation in Open-Response Assessment
par: Borchers, Conrad, et autres
Publié: (2025)
par: Borchers, Conrad, et autres
Publié: (2025)
Data Augmentations for Improved (Large) Language Model Generalization
par: Feder, Amir, et autres
Publié: (2023)
par: Feder, Amir, et autres
Publié: (2023)
EscapeBench: Towards Advancing Creative Intelligence of Language Model Agents
par: Qian, Cheng, et autres
Publié: (2024)
par: Qian, Cheng, et autres
Publié: (2024)
The Curious Case of Nonverbal Abstract Reasoning with Multi-Modal Large Language Models
par: Ahrabian, Kian, et autres
Publié: (2024)
par: Ahrabian, Kian, et autres
Publié: (2024)
Scaling Context, Not Parameters: Training a Compact 7B Language Model for Efficient Long-Context Processing
par: Wu, Chen, et autres
Publié: (2025)
par: Wu, Chen, et autres
Publié: (2025)
A Survey on Training-free Alignment of Large Language Models
par: Pan, Birong, et autres
Publié: (2025)
par: Pan, Birong, et autres
Publié: (2025)
Min-K%++: Improved Baseline for Detecting Pre-Training Data from Large Language Models
par: Zhang, Jingyang, et autres
Publié: (2024)
par: Zhang, Jingyang, et autres
Publié: (2024)
HMS-BERT: Hybrid Multi-Task Self-Training for Multilingual and Multi-Label Cyberbullying Detection
par: Feng, Zixin, et autres
Publié: (2026)
par: Feng, Zixin, et autres
Publié: (2026)
Synthetic Text Generation for Training Large Language Models via Gradient Matching
par: Nguyen, Dang, et autres
Publié: (2025)
par: Nguyen, Dang, et autres
Publié: (2025)
LLMs Plagiarize: Ensuring Responsible Sourcing of Large Language Model Training Data Through Knowledge Graph Comparison
par: Mondal, Devam, et autres
Publié: (2024)
par: Mondal, Devam, et autres
Publié: (2024)
Multi-View Empowered Structural Graph Wordification for Language Models
par: Liu, Zipeng, et autres
Publié: (2024)
par: Liu, Zipeng, et autres
Publié: (2024)
Improving Variable-Length Generation in Diffusion Language Models via Length Regularization
par: Cheng, Zicong, et autres
Publié: (2026)
par: Cheng, Zicong, et autres
Publié: (2026)
A Context-Aware Approach for Enhancing Data Imputation with Pre-trained Language Models
par: Hayat, Ahatsham, et autres
Publié: (2024)
par: Hayat, Ahatsham, et autres
Publié: (2024)
GeoLLM: Extracting Geospatial Knowledge from Large Language Models
par: Manvi, Rohin, et autres
Publié: (2023)
par: Manvi, Rohin, et autres
Publié: (2023)
CASCADE Your Datasets for Cross-Mode Knowledge Retrieval of Language Models
par: Zhou, Runlong, et autres
Publié: (2025)
par: Zhou, Runlong, et autres
Publié: (2025)
Labels Generated by Large Language Models Help Measure People's Empathy in Vitro
par: Hasan, Md Rakibul, et autres
Publié: (2025)
par: Hasan, Md Rakibul, et autres
Publié: (2025)
Hephaestus: Improving Fundamental Agent Capabilities of Large Language Models through Continual Pre-Training
par: Zhuang, Yuchen, et autres
Publié: (2025)
par: Zhuang, Yuchen, et autres
Publié: (2025)
Lying Is Just a Phase: The Hidden Alignment Transition in Language Model Scaling
par: Amin, Adil
Publié: (2026)
par: Amin, Adil
Publié: (2026)
Cascade-Aware Training of Language Models
par: Wang, Congchao, et autres
Publié: (2024)
par: Wang, Congchao, et autres
Publié: (2024)
Training Language Models to Reason Efficiently
par: Arora, Daman, et autres
Publié: (2025)
par: Arora, Daman, et autres
Publié: (2025)
Eliciting Behaviors in Multi-Turn Conversations
par: Huang, Jing, et autres
Publié: (2025)
par: Huang, Jing, et autres
Publié: (2025)
Improving Code Generation by Training with Natural Language Feedback
par: Chen, Angelica, et autres
Publié: (2023)
par: Chen, Angelica, et autres
Publié: (2023)
Enhancing Trust in Large Language Models via Uncertainty-Calibrated Fine-Tuning
par: Krishnan, Ranganath, et autres
Publié: (2024)
par: Krishnan, Ranganath, et autres
Publié: (2024)
On Provable Length and Compositional Generalization
par: Ahuja, Kartik, et autres
Publié: (2024)
par: Ahuja, Kartik, et autres
Publié: (2024)
Multi-Stage Training for Abusive Comment Detection in Indic Languages
par: Rastogi, Pranshu, et autres
Publié: (2026)
par: Rastogi, Pranshu, et autres
Publié: (2026)
Repetition Improves Language Model Embeddings
par: Springer, Jacob Mitchell, et autres
Publié: (2024)
par: Springer, Jacob Mitchell, et autres
Publié: (2024)
Improving Detection of Watermarked Language Models
par: Bahri, Dara, et autres
Publié: (2025)
par: Bahri, Dara, et autres
Publié: (2025)
Documents similaires
-
Align When They Want, Complement When They Need! Human-Centered Ensembles for Adaptive Human-AI Collaboration
par: Amin, Hasan, et autres
Publié: (2026) -
On The Adaptation of Unlimiformer for Decoder-Only Transformers
par: Ahrabian, Kian, et autres
Publié: (2024) -
Escaping Collapse: The Strength of Weak Data for Large Language Model Training
par: Amin, Kareem, et autres
Publié: (2025) -
KS-Lottery: Finding Certified Lottery Tickets for Multilingual Language Models
par: Yuan, Fei, et autres
Publié: (2024) -
Early Transformers: A study on Efficient Training of Transformer Models through Early-Bird Lottery Tickets
par: Cheekati, Shravan
Publié: (2024)