The Sociolinguistic Foundations of Language Modeling
Fuente:
arXiv
Salvato in:
| Autori principali: | Grieve, Jack, Bartl, Sara, Fuoli, Matteo, Grafmiller, Jason, Huang, Weihang, Jawerbaum, Alejandro, Murakami, Akira, Perlman, Marcus, Roemling, Dana, Winter, Bodo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ALMs: Authorial Language Models for Authorship Attribution
di: Huang, Weihang, et al.
Pubblicazione: (2024)
di: Huang, Weihang, et al.
Pubblicazione: (2024)
Metaphor identification using large language models: A comparison of RAG, prompt engineering, and fine-tuning
di: Fuoli, Matteo, et al.
Pubblicazione: (2025)
di: Fuoli, Matteo, et al.
Pubblicazione: (2025)
Whose Voice Counts? Mapping Stakeholder Perspectives on AI Through Public Submissions to the U.S. Government
di: Karakanta, Alina, et al.
Pubblicazione: (2026)
di: Karakanta, Alina, et al.
Pubblicazione: (2026)
Explainability of machine learning approaches in forensic linguistics: a case study in geolinguistic authorship profiling
di: Roemling, Dana, et al.
Pubblicazione: (2024)
di: Roemling, Dana, et al.
Pubblicazione: (2024)
ChatGPT-generated texts show authorship traits that identify them as non-human
di: Dentella, Vittoria, et al.
Pubblicazione: (2025)
di: Dentella, Vittoria, et al.
Pubblicazione: (2025)
Assessing the potential of LLM-assisted annotation for corpus-based pragmatics and discourse analysis: The case of apology
di: Yu, Danni, et al.
Pubblicazione: (2023)
di: Yu, Danni, et al.
Pubblicazione: (2023)
Testimole-Conversational: A 30-Billion-Word Italian Discussion Board Corpus (1996-2024) for Language Modeling and Sociolinguistic Research
di: Rinaldi, Matteo, et al.
Pubblicazione: (2026)
di: Rinaldi, Matteo, et al.
Pubblicazione: (2026)
Collaborative Growth: When Large Language Models Meet Sociolinguistics
di: Dong Nguyen
Pubblicazione: (2025)
di: Dong Nguyen
Pubblicazione: (2025)
Speech Translation with Speech Foundation Models and Large Language Models: What is There and What is Missing?
di: Gaido, Marco, et al.
Pubblicazione: (2024)
di: Gaido, Marco, et al.
Pubblicazione: (2024)
Modeling the Effects of Task Repetition in Second Language Writing: Examining Interindividual and Intraindividual Variability
di: Phil Hiver, et al.
Pubblicazione: (2024)
di: Phil Hiver, et al.
Pubblicazione: (2024)
A Sociolinguistic Analysis of Automatic Speech Recognition Bias in Newcastle English
di: Serditova, Dana, et al.
Pubblicazione: (2026)
di: Serditova, Dana, et al.
Pubblicazione: (2026)
From 'Showgirls' to 'Performers': Fine-tuning with Gender-inclusive Language for Bias Reduction in LLMs
di: Bartl, Marion, et al.
Pubblicazione: (2024)
di: Bartl, Marion, et al.
Pubblicazione: (2024)
Variation is the Norm: Embracing Sociolinguistics in NLP
di: Lutgen, Anne-Marie, et al.
Pubblicazione: (2026)
di: Lutgen, Anne-Marie, et al.
Pubblicazione: (2026)
Sparser, Faster, Lighter Transformer Language Models
di: Cetin, Edoardo, et al.
Pubblicazione: (2026)
di: Cetin, Edoardo, et al.
Pubblicazione: (2026)
Sociolinguistics of the Korean Wave
di: Samosir, Nora, et al.
Pubblicazione: (2025)
di: Samosir, Nora, et al.
Pubblicazione: (2025)
Signature Dynamics of Development in Second Language Sociolinguistic Competence: Evidence From an Intensive Microlongitudinal Study
di: Mason A. Wirtz, et al.
Pubblicazione: (2024)
di: Mason A. Wirtz, et al.
Pubblicazione: (2024)
Code-switching Between Structural and Sociolinguistic Perspectives
Pubblicazione: (2019)
Pubblicazione: (2019)
Interpretable Chinese Metaphor Identification via LLM-Assisted MIPVU Rule Script Generation: A Comparative Protocol Study
di: Huang, Weihang, et al.
Pubblicazione: (2026)
di: Huang, Weihang, et al.
Pubblicazione: (2026)
Data Quality Issues in Multilingual Speech Datasets: The Need for Sociolinguistic Awareness and Proactive Language Planning
di: Lau, Mingfei, et al.
Pubblicazione: (2025)
di: Lau, Mingfei, et al.
Pubblicazione: (2025)
Adapting Psycholinguistic Research for LLMs: Gender-inclusive Language in a Coreference Context
di: Bartl, Marion, et al.
Pubblicazione: (2025)
di: Bartl, Marion, et al.
Pubblicazione: (2025)
Improve Large Language Model Systems with User Logs
di: Wang, Changyue, et al.
Pubblicazione: (2026)
di: Wang, Changyue, et al.
Pubblicazione: (2026)
Southernizing Sociolinguistics
Pubblicazione: (2023)
Pubblicazione: (2023)
Modeling Topics and Sociolinguistic Variation in Code-Switched Discourse: Insights from Spanish-English and Spanish-Guaraní
di: Tyagi, Nemika, et al.
Pubblicazione: (2025)
di: Tyagi, Nemika, et al.
Pubblicazione: (2025)
Do Great Apes Use Iconic Gestures?
di: Marcus Perlman
Pubblicazione: (2026)
di: Marcus Perlman
Pubblicazione: (2026)
Sociolinguistically Informed Interpretability: A Case Study on Hinglish Emotion Classification
di: Tatariya, Kushal, et al.
Pubblicazione: (2024)
di: Tatariya, Kushal, et al.
Pubblicazione: (2024)
Benchmarking Sociolinguistic Diversity in Swahili NLP: A Taxonomy-Guided Approach
di: Oketch, Kezia, et al.
Pubblicazione: (2025)
di: Oketch, Kezia, et al.
Pubblicazione: (2025)
Ramsa: A Large Sociolinguistically Rich Emirati Arabic Speech Corpus for ASR and TTS
di: Al-Sabbagh, Rania
Pubblicazione: (2026)
di: Al-Sabbagh, Rania
Pubblicazione: (2026)
Constructing Concise Characteristic Samples for Acceptors of Omega Regular Languages
di: Angluin, Dana, et al.
Pubblicazione: (2022)
di: Angluin, Dana, et al.
Pubblicazione: (2022)
Linguistic Diversification and Rates of Change: Insights From a Diverse Sample of Sociolinguistic Studies
di: John Mansfield
Pubblicazione: (2025)
di: John Mansfield
Pubblicazione: (2025)
GAIN: A Benchmark for Goal-Aligned Decision-Making of Large Language Models under Imperfect Norms
di: Kawarada, Masayuki, et al.
Pubblicazione: (2026)
di: Kawarada, Masayuki, et al.
Pubblicazione: (2026)
LoCar: Localization-Aware Evaluation of In-Vehicle Assistants through Fine-Grained Sociolinguistic Control
di: Jeong, Seogyeong, et al.
Pubblicazione: (2026)
di: Jeong, Seogyeong, et al.
Pubblicazione: (2026)
Improving Agent Interactions in Virtual Environments with Language Models
di: Zhang, Jack
Pubblicazione: (2024)
di: Zhang, Jack
Pubblicazione: (2024)
Russian and Soviet Sociolinguistics and Taboo Varieties of the Russian Language (Argot, Jargon, Slang and "Mat")
di: von Timroth, Wilhelm
Pubblicazione: (2019)
di: von Timroth, Wilhelm
Pubblicazione: (2019)
DRAGIN: Dynamic Retrieval Augmented Generation based on the Information Needs of Large Language Models
di: Su, Weihang, et al.
Pubblicazione: (2024)
di: Su, Weihang, et al.
Pubblicazione: (2024)
Mitigating Entity-Level Hallucination in Large Language Models
di: Su, Weihang, et al.
Pubblicazione: (2024)
di: Su, Weihang, et al.
Pubblicazione: (2024)
Sociolinguistic Variation in Urban Linguistic Landscapes
Pubblicazione: (2024)
Pubblicazione: (2024)
Relational Programming with Foundation Models
di: Li, Ziyang, et al.
Pubblicazione: (2024)
di: Li, Ziyang, et al.
Pubblicazione: (2024)
Literary Practices of Linguistic Minorities: Sociolinguistic Issues and Implications for Literacy Services.
di: Chu, Clara M.
Pubblicazione: (1999)
di: Chu, Clara M.
Pubblicazione: (1999)
Impact of Preference Noise on the Alignment Performance of Generative Language Models
di: Gao, Yang, et al.
Pubblicazione: (2024)
di: Gao, Yang, et al.
Pubblicazione: (2024)
Emergent Introspective Awareness in Large Language Models
di: Lindsey, Jack
Pubblicazione: (2026)
di: Lindsey, Jack
Pubblicazione: (2026)
Documenti analoghi
-
ALMs: Authorial Language Models for Authorship Attribution
di: Huang, Weihang, et al.
Pubblicazione: (2024) -
Metaphor identification using large language models: A comparison of RAG, prompt engineering, and fine-tuning
di: Fuoli, Matteo, et al.
Pubblicazione: (2025) -
Whose Voice Counts? Mapping Stakeholder Perspectives on AI Through Public Submissions to the U.S. Government
di: Karakanta, Alina, et al.
Pubblicazione: (2026) -
Explainability of machine learning approaches in forensic linguistics: a case study in geolinguistic authorship profiling
di: Roemling, Dana, et al.
Pubblicazione: (2024) -
ChatGPT-generated texts show authorship traits that identify them as non-human
di: Dentella, Vittoria, et al.
Pubblicazione: (2025)