Assessing Dialect Fairness and Robustness of Large Language Models in Reasoning Tasks
Fuente:
arXiv
Guardado en:
| Autores principales: | Lin, Fangru, Mao, Shaoguang, La Malfa, Emanuele, Hofmann, Valentin, de Wynter, Adrian, Wang, Xun, Chen, Si-Qing, Wooldridge, Michael, Pierrehumbert, Janet B., Wei, Furu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Graph-enhanced Large Language Models in Asynchronous Plan Reasoning
por: Lin, Fangru, et al.
Publicado: (2024)
por: Lin, Fangru, et al.
Publicado: (2024)
Out-of-Context Reasoning in Large Language Models
por: Shaki, Jonathan, et al.
Publicado: (2025)
por: Shaki, Jonathan, et al.
Publicado: (2025)
Tacit Coordination of Large Language Models
por: Aharon, Ido, et al.
Publicado: (2026)
por: Aharon, Ido, et al.
Publicado: (2026)
Code Simulation as a Proxy for High-order Tasks in Large Language Models
por: La Malfa, Emanuele, et al.
Publicado: (2025)
por: La Malfa, Emanuele, et al.
Publicado: (2025)
Code Simulation Challenges for Large Language Models
por: La Malfa, Emanuele, et al.
Publicado: (2024)
por: La Malfa, Emanuele, et al.
Publicado: (2024)
Probing Large Language Models for Scalar Adjective Lexical Semantics and Scalar Diversity Pragmatics
por: Lin, Fangru, et al.
Publicado: (2024)
por: Lin, Fangru, et al.
Publicado: (2024)
LLM as a Mastermind: A Survey of Strategic Reasoning with Large Language Models
por: Zhang, Yadong, et al.
Publicado: (2024)
por: Zhang, Yadong, et al.
Publicado: (2024)
Jailbreaking Large Language Models in Infinitely Many Ways
por: Goldstein, Oliver, et al.
Publicado: (2025)
por: Goldstein, Oliver, et al.
Publicado: (2025)
The Hrunting of AI: Where and How to Improve English Dialectal Fairness
por: Li, Wei, et al.
Publicado: (2026)
por: Li, Wei, et al.
Publicado: (2026)
Large Language Models Miss the Multi-Agent Mark
por: La Malfa, Emanuele, et al.
Publicado: (2025)
por: La Malfa, Emanuele, et al.
Publicado: (2025)
Can Large Language Models Generalize Procedures Across Representations?
por: Lin, Fangru, et al.
Publicado: (2026)
por: Lin, Fangru, et al.
Publicado: (2026)
Fixed Point Explainability
por: La Malfa, Emanuele, et al.
Publicado: (2025)
por: La Malfa, Emanuele, et al.
Publicado: (2025)
K-Level Reasoning: Establishing Higher Order Beliefs in Large Language Models for Strategic Reasoning
por: Zhang, Yadong, et al.
Publicado: (2024)
por: Zhang, Yadong, et al.
Publicado: (2024)
A Scalable Communication Protocol for Networks of Large Language Models
por: Marro, Samuele, et al.
Publicado: (2024)
por: Marro, Samuele, et al.
Publicado: (2024)
An Evaluation on Large Language Model Outputs: Discourse and Memorization
por: de Wynter, Adrian, et al.
Publicado: (2023)
por: de Wynter, Adrian, et al.
Publicado: (2023)
End-to-end PDDL Planning with Hardcoded and Dynamic Agents
por: La Malfa, Emanuele, et al.
Publicado: (2025)
por: La Malfa, Emanuele, et al.
Publicado: (2025)
The Attacker in the Mirror: Breaking Self-Consistency in Safety via Anchored Bipolicy Self-Play
por: La Malfa, Gabriele, et al.
Publicado: (2026)
por: La Malfa, Gabriele, et al.
Publicado: (2026)
Meta Reasoning for Large Language Models
por: Gao, Peizhong, et al.
Publicado: (2024)
por: Gao, Peizhong, et al.
Publicado: (2024)
Language Models Are Implicitly Continuous
por: Marro, Samuele, et al.
Publicado: (2025)
por: Marro, Samuele, et al.
Publicado: (2025)
Derivational Morphology Reveals Analogical Generalization in Large Language Models
por: Hofmann, Valentin, et al.
Publicado: (2024)
por: Hofmann, Valentin, et al.
Publicado: (2024)
Unleashing the Emergent Cognitive Synergy in Large Language Models: A Task-Solving Agent through Multi-Persona Self-Collaboration
por: Wang, Zhenhailong, et al.
Publicado: (2023)
por: Wang, Zhenhailong, et al.
Publicado: (2023)
"I'd Like to Have an Argument, Please": Argumentative Reasoning in Large Language Models
por: de Wynter, Adrian, et al.
Publicado: (2023)
por: de Wynter, Adrian, et al.
Publicado: (2023)
Deep Neural Networks via Complex Network Theory: a Perspective
por: La Malfa, Emanuele, et al.
Publicado: (2024)
por: La Malfa, Emanuele, et al.
Publicado: (2024)
Mind's Eye of LLMs: Visualization-of-Thought Elicits Spatial Reasoning in Large Language Models
por: Wu, Wenshan, et al.
Publicado: (2024)
por: Wu, Wenshan, et al.
Publicado: (2024)
On Meta-Prompting
por: de Wynter, Adrian, et al.
Publicado: (2023)
por: de Wynter, Adrian, et al.
Publicado: (2023)
Fetch.ai: An Architecture for Modern Multi-Agent Systems
por: Wooldridge, Michael J., et al.
Publicado: (2025)
por: Wooldridge, Michael J., et al.
Publicado: (2025)
A Notion of Complexity for Theory of Mind via Discrete World Models
por: Huang, X. Angelo, et al.
Publicado: (2024)
por: Huang, X. Angelo, et al.
Publicado: (2024)
Geographic Adaptation of Pretrained Language Models
por: Hofmann, Valentin, et al.
Publicado: (2022)
por: Hofmann, Valentin, et al.
Publicado: (2022)
ClimateViz: A Benchmark for Statistical Reasoning and Fact Verification on Scientific Charts
por: Su, Ruiran, et al.
Publicado: (2025)
por: Su, Ruiran, et al.
Publicado: (2025)
Enhancing Language Model Rationality with Bi-Directional Deliberation Reasoning
por: Zhang, Yadong, et al.
Publicado: (2024)
por: Zhang, Yadong, et al.
Publicado: (2024)
Empirical Study of Large Language Models as Automated Essay Scoring Tools in English Composition__Taking TOEFL Independent Writing Task for Example
por: Xia, Wei, et al.
Publicado: (2024)
por: Xia, Wei, et al.
Publicado: (2024)
In-context Autoencoder for Context Compression in a Large Language Model
por: Ge, Tao, et al.
Publicado: (2023)
por: Ge, Tao, et al.
Publicado: (2023)
Actors, Frames and Arguments: A Multi-Decade Computational Analysis of Climate Discourse in Financial News using Large Language Models
por: Su, Ruiran, et al.
Publicado: (2026)
por: Su, Ruiran, et al.
Publicado: (2026)
When Dimensionality Hurts: The Role of LLM Embedding Compression for Noisy Regression Tasks
por: Drinkall, Felix, et al.
Publicado: (2025)
por: Drinkall, Felix, et al.
Publicado: (2025)
When Claims Evolve: Evaluating and Enhancing the Robustness of Embedding Models Against Misinformation Edits
por: Magomere, Jabez, et al.
Publicado: (2025)
por: Magomere, Jabez, et al.
Publicado: (2025)
Large Language Models Discriminate Against Speakers of German Dialects
por: Bui, Minh Duc, et al.
Publicado: (2025)
por: Bui, Minh Duc, et al.
Publicado: (2025)
Awes, Laws, and Flaws From Today's LLM Research
por: de Wynter, Adrian
Publicado: (2024)
por: de Wynter, Adrian
Publicado: (2024)
An Algorithm for Learning Smaller Representations of Models With Scarce Data
por: de Wynter, Adrian
Publicado: (2020)
por: de Wynter, Adrian
Publicado: (2020)
Is In-Context Learning Learning?
por: de Wynter, Adrian
Publicado: (2025)
por: de Wynter, Adrian
Publicado: (2025)
Will GPT-4 Run DOOM?
por: de Wynter, Adrian
Publicado: (2024)
por: de Wynter, Adrian
Publicado: (2024)
Ejemplares similares
-
Graph-enhanced Large Language Models in Asynchronous Plan Reasoning
por: Lin, Fangru, et al.
Publicado: (2024) -
Out-of-Context Reasoning in Large Language Models
por: Shaki, Jonathan, et al.
Publicado: (2025) -
Tacit Coordination of Large Language Models
por: Aharon, Ido, et al.
Publicado: (2026) -
Code Simulation as a Proxy for High-order Tasks in Large Language Models
por: La Malfa, Emanuele, et al.
Publicado: (2025) -
Code Simulation Challenges for Large Language Models
por: La Malfa, Emanuele, et al.
Publicado: (2024)