Dual-objective Language Models: Training Efficiency Without Overfitting
Fuente:
arXiv
Guardado en:
| Autores principales: | Samuel, David, Charpentier, Lucas Georges Gabriel |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
More Room for Language: Investigating the Effect of Retrieval on Language Models
por: Samuel, David, et al.
Publicado: (2024)
por: Samuel, David, et al.
Publicado: (2024)
GPT or BERT: why not both?
por: Charpentier, Lucas Georges Gabriel, et al.
Publicado: (2024)
por: Charpentier, Lucas Georges Gabriel, et al.
Publicado: (2024)
ZeroTuning: Unlocking the Initial Token's Power to Enhance Large Language Models Without Training
por: Han, Feijiang, et al.
Publicado: (2025)
por: Han, Feijiang, et al.
Publicado: (2025)
Small Languages, Big Models: A Study of Continual Training on Languages of Norway
por: Samuel, David, et al.
Publicado: (2024)
por: Samuel, David, et al.
Publicado: (2024)
Entropy-aware Masking for Masked Language Modeling
por: Srinivasagan, Gokul, et al.
Publicado: (2026)
por: Srinivasagan, Gokul, et al.
Publicado: (2026)
Improving Training Efficiency and Reducing Maintenance Costs via Language Specific Model Merging
por: Dmonte, Alphaeus, et al.
Publicado: (2026)
por: Dmonte, Alphaeus, et al.
Publicado: (2026)
A Study on Hidden Layer Distillation for Large Language Model Pre-Training
por: Guigon, Maxime, et al.
Publicado: (2026)
por: Guigon, Maxime, et al.
Publicado: (2026)
Systematic Generalization in Language Models Scales with Information Entropy
por: Wold, Sondre, et al.
Publicado: (2025)
por: Wold, Sondre, et al.
Publicado: (2025)
ECCO: Can We Improve Model-Generated Code Efficiency Without Sacrificing Functional Correctness?
por: Waghjale, Siddhant, et al.
Publicado: (2024)
por: Waghjale, Siddhant, et al.
Publicado: (2024)
Assessing Robustness to Spurious Correlations in Post-Training Language Models
por: Shuieh, Julia, et al.
Publicado: (2025)
por: Shuieh, Julia, et al.
Publicado: (2025)
CogniDual Framework: Self-Training Large Language Models within a Dual-System Theoretical Framework for Improving Cognitive Tasks
por: Deng, Yongxin, et al.
Publicado: (2024)
por: Deng, Yongxin, et al.
Publicado: (2024)
Calibrating Verbalized Probabilities for Large Language Models
por: Wang, Cheng, et al.
Publicado: (2024)
por: Wang, Cheng, et al.
Publicado: (2024)
Logit Arithmetic Elicits Long Reasoning Capabilities Without Training
por: Zhang, Yunxiang, et al.
Publicado: (2025)
por: Zhang, Yunxiang, et al.
Publicado: (2025)
DORA Explorer: Improving the Exploration Ability of LLMs Without Training
por: Gurjar, Priya, et al.
Publicado: (2026)
por: Gurjar, Priya, et al.
Publicado: (2026)
REACT: Representation Extraction And Controllable Tuning to Overcome Overfitting in LLM Knowledge Editing
por: Zhong, Haitian, et al.
Publicado: (2025)
por: Zhong, Haitian, et al.
Publicado: (2025)
Efficiency at Scale: Investigating the Performance of Diminutive Language Models in Clinical Tasks
por: Taylor, Niall, et al.
Publicado: (2024)
por: Taylor, Niall, et al.
Publicado: (2024)
Improving the Efficiency of Visually Augmented Language Models
por: Ontalvilla, Paula, et al.
Publicado: (2024)
por: Ontalvilla, Paula, et al.
Publicado: (2024)
Large Language Models as Quasi-crystals: Coherence Without Repetition in Generative Text
por: Guevara-Vela, Jose Manuel
Publicado: (2025)
por: Guevara-Vela, Jose Manuel
Publicado: (2025)
Distilling an End-to-End Voice Assistant Without Instruction Training Data
por: Held, William, et al.
Publicado: (2024)
por: Held, William, et al.
Publicado: (2024)
Plan-Grounded Large Language Models for Dual Goal Conversational Settings
por: Glória-Silva, Diogo, et al.
Publicado: (2024)
por: Glória-Silva, Diogo, et al.
Publicado: (2024)
LLM for Everyone: Representing the Underrepresented in Large Language Models
por: Cahyawijaya, Samuel
Publicado: (2024)
por: Cahyawijaya, Samuel
Publicado: (2024)
Dual Debiasing: Remove Stereotypes and Keep Factual Gender for Fair Language Modeling and Translation
por: Limisiewicz, Tomasz, et al.
Publicado: (2025)
por: Limisiewicz, Tomasz, et al.
Publicado: (2025)
DEPO: Dual-Efficiency Preference Optimization for LLM Agents
por: Chen, Sirui, et al.
Publicado: (2025)
por: Chen, Sirui, et al.
Publicado: (2025)
Source-Aware Training Enables Knowledge Attribution in Language Models
por: Khalifa, Muhammad, et al.
Publicado: (2024)
por: Khalifa, Muhammad, et al.
Publicado: (2024)
Algorithmic Language Models with Neurally Compiled Libraries
por: Saldyt, Lucas, et al.
Publicado: (2024)
por: Saldyt, Lucas, et al.
Publicado: (2024)
Authorship Without Writing: Large Language Models and the Senior Author Analogy
por: Hurshman, Clint, et al.
Publicado: (2025)
por: Hurshman, Clint, et al.
Publicado: (2025)
Stronger Re-identification Attacks through Reasoning and Aggregation
por: Charpentier, Lucas Georges Gabriel, et al.
Publicado: (2025)
por: Charpentier, Lucas Georges Gabriel, et al.
Publicado: (2025)
Re-identification of De-identified Documents with Autoregressive Infilling
por: Charpentier, Lucas Georges Gabriel, et al.
Publicado: (2025)
por: Charpentier, Lucas Georges Gabriel, et al.
Publicado: (2025)
LLMPC: Large Language Model Predictive Control
por: Maher, Gabriel
Publicado: (2025)
por: Maher, Gabriel
Publicado: (2025)
DISPO: Enhancing Training Efficiency and Stability in Reinforcement Learning for Large Language Model Mathematical Reasoning
por: Karaman, Batuhan K., et al.
Publicado: (2026)
por: Karaman, Batuhan K., et al.
Publicado: (2026)
Discovering Latent Knowledge in Language Models Without Supervision
por: Burns, Collin, et al.
Publicado: (2022)
por: Burns, Collin, et al.
Publicado: (2022)
Emergent Languages in Populations of Language Model Agents: From Token Efficiency to Oversight Evasion
por: Beltoft, Stine Lyngsø, et al.
Publicado: (2026)
por: Beltoft, Stine Lyngsø, et al.
Publicado: (2026)
Dual-Space Knowledge Distillation for Large Language Models
por: Zhang, Songming, et al.
Publicado: (2024)
por: Zhang, Songming, et al.
Publicado: (2024)
Evolution of Concepts in Language Model Pre-Training
por: Ge, Xuyang, et al.
Publicado: (2025)
por: Ge, Xuyang, et al.
Publicado: (2025)
Evolving Subnetwork Training for Large Language Models
por: Li, Hanqi, et al.
Publicado: (2024)
por: Li, Hanqi, et al.
Publicado: (2024)
On the Effectiveness of Incremental Training of Large Language Models
por: Li, Miles Q., et al.
Publicado: (2024)
por: Li, Miles Q., et al.
Publicado: (2024)
Post-Training Language Models for Crosslingual Consistency
por: Liu, Tianyu, et al.
Publicado: (2026)
por: Liu, Tianyu, et al.
Publicado: (2026)
Iterative Data Smoothing: Mitigating Reward Overfitting and Overoptimization in RLHF
por: Zhu, Banghua, et al.
Publicado: (2024)
por: Zhu, Banghua, et al.
Publicado: (2024)
Internal Knowledge Without External Expression: Probing the Generalization Boundary of a Classical Chinese Language Model
por: Chen, Jiuting, et al.
Publicado: (2026)
por: Chen, Jiuting, et al.
Publicado: (2026)
Exploitation Without Deception: Dark Triad Feature Steering Reveals Separable Antisocial Circuits in Language Models
por: Berg, Cameron, et al.
Publicado: (2026)
por: Berg, Cameron, et al.
Publicado: (2026)
Ejemplares similares
-
More Room for Language: Investigating the Effect of Retrieval on Language Models
por: Samuel, David, et al.
Publicado: (2024) -
GPT or BERT: why not both?
por: Charpentier, Lucas Georges Gabriel, et al.
Publicado: (2024) -
ZeroTuning: Unlocking the Initial Token's Power to Enhance Large Language Models Without Training
por: Han, Feijiang, et al.
Publicado: (2025) -
Small Languages, Big Models: A Study of Continual Training on Languages of Norway
por: Samuel, David, et al.
Publicado: (2024) -
Entropy-aware Masking for Masked Language Modeling
por: Srinivasagan, Gokul, et al.
Publicado: (2026)