Pre-Trained Language Models Represent Some Geographic Populations Better Than Others
Fuente:
arXiv
Guardado en:
| Autores principales: | Dunn, Jonathan, Adams, Benjamin, Madabushi, Harish Tayyar |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FS-RAG: A Frame Semantics Based Approach for Improved Factual Accuracy in Large Language Models
por: Madabushi, Harish Tayyar
Publicado: (2024)
por: Madabushi, Harish Tayyar
Publicado: (2024)
Scaling Policy Compliance Assessment in Language Models with Policy Reasoning Traces
por: Imperial, Joseph Marvin, et al.
Publicado: (2025)
por: Imperial, Joseph Marvin, et al.
Publicado: (2025)
Code-Mixed Probes Show How Pre-Trained Models Generalise On Code-Switched Text
por: De Leon, Frances A. Laureano, et al.
Publicado: (2024)
por: De Leon, Frances A. Laureano, et al.
Publicado: (2024)
Neither Stochastic Parroting nor AGI: LLMs Solve Tasks through Context-Directed Extrapolation from Training Data Priors
por: Madabushi, Harish Tayyar, et al.
Publicado: (2025)
por: Madabushi, Harish Tayyar, et al.
Publicado: (2025)
Standardize: Aligning Language Models with Expert-Defined Standards for Content Generation
por: Imperial, Joseph Marvin, et al.
Publicado: (2024)
por: Imperial, Joseph Marvin, et al.
Publicado: (2024)
SpeciaLex: A Benchmark for In-Context Specialized Lexicon Learning
por: Imperial, Joseph Marvin, et al.
Publicado: (2024)
por: Imperial, Joseph Marvin, et al.
Publicado: (2024)
Safer Policy Compliance with Dynamic Epistemic Fallback
por: Imperial, Joseph Marvin, et al.
Publicado: (2026)
por: Imperial, Joseph Marvin, et al.
Publicado: (2026)
The Inherent Limits of Pretrained LLMs: The Unexpected Convergence of Instruction Tuning and In-Context Learning Capabilities
por: Bigoulaeva, Irina, et al.
Publicado: (2025)
por: Bigoulaeva, Irina, et al.
Publicado: (2025)
Evaluating CxG Generalisation in LLMs via Construction-Based NLI Fine Tuning
por: Mackintosh, Tom, et al.
Publicado: (2025)
por: Mackintosh, Tom, et al.
Publicado: (2025)
Dancing with Deer: A Constructional Perspective on MWEs in the Era of LLMs
por: Bonial, Claire, et al.
Publicado: (2025)
por: Bonial, Claire, et al.
Publicado: (2025)
Evaluating Large Language Models on Multiword Expressions in Multilingual and Code-Switched Contexts
por: De Leon, Frances Laureano, et al.
Publicado: (2025)
por: De Leon, Frances Laureano, et al.
Publicado: (2025)
Adapting Whisper for Regional Dialects: Enhancing Public Services for Vulnerable Populations in the United Kingdom
por: Torgbi, Melissa, et al.
Publicado: (2025)
por: Torgbi, Melissa, et al.
Publicado: (2025)
Are Emergent Abilities in Large Language Models just In-Context Learning?
por: Lu, Sheng, et al.
Publicado: (2023)
por: Lu, Sheng, et al.
Publicado: (2023)
Word Boundary Information Isn't Useful for Encoder Language Models
por: Gow-Smith, Edward, et al.
Publicado: (2024)
por: Gow-Smith, Edward, et al.
Publicado: (2024)
Standardizing Intelligence: Aligning Generative AI for Regulatory and Operational Compliance
por: Imperial, Joseph Marvin, et al.
Publicado: (2025)
por: Imperial, Joseph Marvin, et al.
Publicado: (2025)
Fine-Tuning on Diverse Reasoning Chains Drives Within-Inference CoT Refinement in LLMs
por: Puerto, Haritz, et al.
Publicado: (2024)
por: Puerto, Haritz, et al.
Publicado: (2024)
Illusion or Algorithm? Investigating Memorization, Emergence, and Symbolic Processing in In-Context Learning
por: Niu, Jingcheng, et al.
Publicado: (2025)
por: Niu, Jingcheng, et al.
Publicado: (2025)
Beyond Memorization: Assessing Semantic Generalization in Large Language Models Using Phrasal Constructions
por: Scivetti, Wesley, et al.
Publicado: (2025)
por: Scivetti, Wesley, et al.
Publicado: (2025)
Geographically-Informed Language Identification
por: Dunn, Jonathan, et al.
Publicado: (2024)
por: Dunn, Jonathan, et al.
Publicado: (2024)
Validating and Exploring Large Geographic Corpora
por: Dunn, Jonathan
Publicado: (2024)
por: Dunn, Jonathan
Publicado: (2024)
Detecting Linguistic Diversity on Social Media
por: Wong, Sidney, et al.
Publicado: (2025)
por: Wong, Sidney, et al.
Publicado: (2025)
Checklists Are Better Than Reward Models For Aligning Language Models
por: Viswanathan, Vijay, et al.
Publicado: (2025)
por: Viswanathan, Vijay, et al.
Publicado: (2025)
Better Language Model Inversion by Compactly Representing Next-Token Distributions
por: Nazir, Murtaza, et al.
Publicado: (2025)
por: Nazir, Murtaza, et al.
Publicado: (2025)
Is Pre-training Truly Better Than Meta-Learning?
por: Miranda, Brando, et al.
Publicado: (2023)
por: Miranda, Brando, et al.
Publicado: (2023)
Language Models Represent Beliefs of Self and Others
por: Zhu, Wentao, et al.
Publicado: (2024)
por: Zhu, Wentao, et al.
Publicado: (2024)
All Claims Are Equal, but Some Claims Are More Equal Than Others: Importance-Sensitive Factuality Evaluation of LLM Generations
por: Wanner, Miriam, et al.
Publicado: (2025)
por: Wanner, Miriam, et al.
Publicado: (2025)
Training Language Model to Critique for Better Refinement
por: Yu, Tianshu, et al.
Publicado: (2025)
por: Yu, Tianshu, et al.
Publicado: (2025)
Byte Latent Transformer: Patches Scale Better Than Tokens
por: Pagnoni, Artidoro, et al.
Publicado: (2024)
por: Pagnoni, Artidoro, et al.
Publicado: (2024)
Synthetic Pre-Pre-Training Improves Language Model Robustness to Noisy Pre-Training Data
por: Guo, Xu, et al.
Publicado: (2026)
por: Guo, Xu, et al.
Publicado: (2026)
No for Some, Yes for Others: Persona Prompts and Other Sources of False Refusal in Language Models
por: Plaza-del-Arco, Flor Miriam, et al.
Publicado: (2025)
por: Plaza-del-Arco, Flor Miriam, et al.
Publicado: (2025)
Verifiable by Design: Aligning Language Models to Quote from Pre-Training Data
por: Zhang, Jingyu, et al.
Publicado: (2024)
por: Zhang, Jingyu, et al.
Publicado: (2024)
Characterizing Learning Curves During Language Model Pre-Training: Learning, Forgetting, and Stability
por: Chang, Tyler A., et al.
Publicado: (2023)
por: Chang, Tyler A., et al.
Publicado: (2023)
Two Heads Are Better Than One: Dual-Model Verbal Reflection at Inference-Time
por: Li, Jiazheng, et al.
Publicado: (2025)
por: Li, Jiazheng, et al.
Publicado: (2025)
Better Safe Than Sorry? Overreaction Problem of Vision Language Models in Visual Emergency Recognition
por: Choi, Dasol, et al.
Publicado: (2025)
por: Choi, Dasol, et al.
Publicado: (2025)
Advantageous Parameter Expansion Training Makes Better Large Language Models
por: Gu, Naibin, et al.
Publicado: (2025)
por: Gu, Naibin, et al.
Publicado: (2025)
On the Interplay of Pre-Training, Mid-Training, and RL on Reasoning Language Models
por: Zhang, Charlie, et al.
Publicado: (2025)
por: Zhang, Charlie, et al.
Publicado: (2025)
UniversalCEFR: Enabling Open Multilingual Research on Language Proficiency Assessment
por: Imperial, Joseph Marvin, et al.
Publicado: (2025)
por: Imperial, Joseph Marvin, et al.
Publicado: (2025)
Exploring Forgetting in Large Language Model Pre-Training
por: Liao, Chonghua, et al.
Publicado: (2024)
por: Liao, Chonghua, et al.
Publicado: (2024)
Evaluation of Geographical Distortions in Language Models
por: Decoupes, Rémy, et al.
Publicado: (2024)
por: Decoupes, Rémy, et al.
Publicado: (2024)
Geographic Adaptation of Pretrained Language Models
por: Hofmann, Valentin, et al.
Publicado: (2022)
por: Hofmann, Valentin, et al.
Publicado: (2022)
Ejemplares similares
-
FS-RAG: A Frame Semantics Based Approach for Improved Factual Accuracy in Large Language Models
por: Madabushi, Harish Tayyar
Publicado: (2024) -
Scaling Policy Compliance Assessment in Language Models with Policy Reasoning Traces
por: Imperial, Joseph Marvin, et al.
Publicado: (2025) -
Code-Mixed Probes Show How Pre-Trained Models Generalise On Code-Switched Text
por: De Leon, Frances A. Laureano, et al.
Publicado: (2024) -
Neither Stochastic Parroting nor AGI: LLMs Solve Tasks through Context-Directed Extrapolation from Training Data Priors
por: Madabushi, Harish Tayyar, et al.
Publicado: (2025) -
Standardize: Aligning Language Models with Expert-Defined Standards for Content Generation
por: Imperial, Joseph Marvin, et al.
Publicado: (2024)