Far Out: Evaluating Language Models on Slang in Australian and Indian English
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dilsiz, Deniz Kaya, Srirag, Dipankar, Joshi, Aditya |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Nek Minit: Harnessing Pragmatic Metacognitive Prompting for Explainable Sarcasm Detection of Australian and Indian English
par: Singh, Ishmanbir, et autres
Publié: (2025)
par: Singh, Ishmanbir, et autres
Publié: (2025)
PAREDA: A Multi-Accent Speech Dataset of Natural Language Processing Research Discussions
par: Jin, Sicheng, et autres
Publié: (2026)
par: Jin, Sicheng, et autres
Publié: (2026)
BESSTIE: A Benchmark for Sentiment and Sarcasm Classification for Varieties of English
par: Srirag, Dipankar, et autres
Publié: (2024)
par: Srirag, Dipankar, et autres
Publié: (2024)
Predicting the Target Word of Game-playing Conversations using a Low-Rank Dialect Adapter for Decoder Models
par: Srirag, Dipankar, et autres
Publié: (2024)
par: Srirag, Dipankar, et autres
Publié: (2024)
Evaluating Dialect Robustness of Language Models via Conversation Understanding
par: Srirag, Dipankar, et autres
Publié: (2024)
par: Srirag, Dipankar, et autres
Publié: (2024)
Experiences from Creating a Benchmark for Sentiment Classification for Varieties of English
par: Srirag, Dipankar, et autres
Publié: (2024)
par: Srirag, Dipankar, et autres
Publié: (2024)
How do Language Models Generate Slang: A Systematic Comparison between Human and Machine-Generated Slang Usages
par: Wu, Siyang, et autres
Publié: (2025)
par: Wu, Siyang, et autres
Publié: (2025)
Advancing Conversational AI with Shona Slang: A Dataset and Hybrid Model for Digital Inclusion
par: Masoka, Happymore
Publié: (2025)
par: Masoka, Happymore
Publié: (2025)
TriageSim: A Conversational Emergency Triage Simulation Framework from Structured Electronic Health Records
par: Srirag, Dipankar, et autres
Publié: (2026)
par: Srirag, Dipankar, et autres
Publié: (2026)
A Taxonomy-Driven Case Study of Australian Web Resources Against Technology-Facilitated Abuse
par: Srirag, Dipankar, et autres
Publié: (2025)
par: Srirag, Dipankar, et autres
Publié: (2025)
The Roles of English in Evaluating Multilingual Language Models
par: Poelman, Wessel, et autres
Publié: (2024)
par: Poelman, Wessel, et autres
Publié: (2024)
Trainable Reference-Based Evaluation Metric for Identifying Quality of English-Gujarati Machine Translation System
par: Joshi, Nisheeth, et autres
Publié: (2025)
par: Joshi, Nisheeth, et autres
Publié: (2025)
Large Language Models for Predictive Analysis: How Far Are They?
par: Chen, Qin, et autres
Publié: (2025)
par: Chen, Qin, et autres
Publié: (2025)
Evaluating Tokenizer Performance of Large Language Models Across Official Indian Languages
par: Tamang, S., et autres
Publié: (2024)
par: Tamang, S., et autres
Publié: (2024)
Decoding Large-Language Models: A Systematic Overview of Socio-Technical Impacts, Constraints, and Emerging Questions
par: Kaya, Zeyneb N., et autres
Publié: (2024)
par: Kaya, Zeyneb N., et autres
Publié: (2024)
Alternatives To Next Token Prediction In Text Generation -- A Survey
par: Wyatt, Charlie, et autres
Publié: (2025)
par: Wyatt, Charlie, et autres
Publié: (2025)
IndicEval: A Bilingual Indian Educational Evaluation Framework for Large Language Models
par: Bharti, Saurabh, et autres
Publié: (2026)
par: Bharti, Saurabh, et autres
Publié: (2026)
ArgLLM-App: An Interactive System for Argumentative Reasoning with Large Language Models
par: Dejl, Adam, et autres
Publié: (2026)
par: Dejl, Adam, et autres
Publié: (2026)
Do Large Language Models Have an English Accent? Evaluating and Improving the Naturalness of Multilingual LLMs
par: Guo, Yanzhu, et autres
Publié: (2024)
par: Guo, Yanzhu, et autres
Publié: (2024)
Narrative Theory-Driven LLM Methods for Automatic Story Generation and Understanding: A Survey
par: Liu, David Y., et autres
Publié: (2026)
par: Liu, David Y., et autres
Publié: (2026)
Truth Knows No Language: Evaluating Truthfulness Beyond English
par: Figueras, Blanca Calvo, et autres
Publié: (2025)
par: Figueras, Blanca Calvo, et autres
Publié: (2025)
On Adversarial Robustness and Out-of-Distribution Robustness of Large Language Models
par: Yang, April, et autres
Publié: (2024)
par: Yang, April, et autres
Publié: (2024)
Neurocache: Efficient Vector Retrieval for Long-range Language Modeling
par: Safaya, Ali, et autres
Publié: (2024)
par: Safaya, Ali, et autres
Publié: (2024)
MotiveBench: How Far Are We From Human-Like Motivational Reasoning in Large Language Models?
par: Yong, Xixian, et autres
Publié: (2025)
par: Yong, Xixian, et autres
Publié: (2025)
ALLaM: Large Language Models for Arabic and English
par: Bari, M Saiful, et autres
Publié: (2024)
par: Bari, M Saiful, et autres
Publié: (2024)
GECKO: Generative Language Model for English, Code and Korean
par: Oh, Sungwoo, et autres
Publié: (2024)
par: Oh, Sungwoo, et autres
Publié: (2024)
Sentiment Analysis Across Languages: Evaluation Before and After Machine Translation to English
par: Kathunia, Aekansh, et autres
Publié: (2024)
par: Kathunia, Aekansh, et autres
Publié: (2024)
Self-Demos: Eliciting Out-of-Demonstration Generalizability in Large Language Models
par: He, Wei, et autres
Publié: (2024)
par: He, Wei, et autres
Publié: (2024)
LLMs Still Can't Plan; Can LRMs? A Preliminary Evaluation of OpenAI's o1 on PlanBench
par: Valmeekam, Karthik, et autres
Publié: (2024)
par: Valmeekam, Karthik, et autres
Publié: (2024)
In Vino Veritas and Vulnerabilities: Examining LLM Safety via Drunk Language Inducement
par: Shetty, Anudeex, et autres
Publié: (2026)
par: Shetty, Anudeex, et autres
Publié: (2026)
ChiEngMixBench: Evaluating Large Language Models on Spontaneous and Natural Chinese-English Code-Mixed Generation
par: Yang, Qingyan, et autres
Publié: (2026)
par: Yang, Qingyan, et autres
Publié: (2026)
MILPaC: A Novel Benchmark for Evaluating Translation of Legal Text to Indian Languages
par: Mahapatra, Sayan, et autres
Publié: (2023)
par: Mahapatra, Sayan, et autres
Publié: (2023)
Indic-TunedLens: Interpreting Multilingual Models in Indian Languages
par: Panchal, Mihir, et autres
Publié: (2026)
par: Panchal, Mihir, et autres
Publié: (2026)
Enabling Precise Topic Alignment in Large Language Models Via Sparse Autoencoders
par: Joshi, Ananya, et autres
Publié: (2025)
par: Joshi, Ananya, et autres
Publié: (2025)
A Survey of Classification Tasks and Approaches for Legal Contracts
par: Singh, Amrita, et autres
Publié: (2025)
par: Singh, Amrita, et autres
Publié: (2025)
Compositional Causal Reasoning Evaluation in Language Models
par: Maasch, Jacqueline R. M. A., et autres
Publié: (2025)
par: Maasch, Jacqueline R. M. A., et autres
Publié: (2025)
Language Models Predict Empathy Gaps Between Social In-groups and Out-groups
par: Hou, Yu, et autres
Publié: (2025)
par: Hou, Yu, et autres
Publié: (2025)
RETUYT-INCO at BEA 2025 Shared Task: How Far Can Lightweight Models Go in AI-powered Tutor Evaluation?
par: Góngora, Santiago, et autres
Publié: (2025)
par: Góngora, Santiago, et autres
Publié: (2025)
From Hallucinations to Facts: Enhancing Language Models with Curated Knowledge Graphs
par: Joshi, Ratnesh Kumar, et autres
Publié: (2024)
par: Joshi, Ratnesh Kumar, et autres
Publié: (2024)
Konkani LLM: Multi-Script Instruction Tuning and Evaluation for a Low-Resource Indian Language
par: Fernandes, Reuben Chagas, et autres
Publié: (2026)
par: Fernandes, Reuben Chagas, et autres
Publié: (2026)
Documents similaires
-
Nek Minit: Harnessing Pragmatic Metacognitive Prompting for Explainable Sarcasm Detection of Australian and Indian English
par: Singh, Ishmanbir, et autres
Publié: (2025) -
PAREDA: A Multi-Accent Speech Dataset of Natural Language Processing Research Discussions
par: Jin, Sicheng, et autres
Publié: (2026) -
BESSTIE: A Benchmark for Sentiment and Sarcasm Classification for Varieties of English
par: Srirag, Dipankar, et autres
Publié: (2024) -
Predicting the Target Word of Game-playing Conversations using a Low-Rank Dialect Adapter for Decoder Models
par: Srirag, Dipankar, et autres
Publié: (2024) -
Evaluating Dialect Robustness of Language Models via Conversation Understanding
par: Srirag, Dipankar, et autres
Publié: (2024)