On the Same Wavelength? Evaluating Pragmatic Reasoning in Language Models across Broad Concepts
Fuente:
arXiv
Guardado en:
| Autores principales: | Qiu, Linlu, Zhang, Cedegao E., Tenenbaum, Joshua B., Kim, Yoon, Levy, Roger P. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Implicit Representations of Grammaticality in Language Models
por: Wang, Yingshan Susan, et al.
Publicado: (2026)
por: Wang, Yingshan Susan, et al.
Publicado: (2026)
LINC: A Neurosymbolic Approach for Logical Reasoning by Combining Language Models with First-Order Logic Provers
por: Olausson, Theo X., et al.
Publicado: (2023)
por: Olausson, Theo X., et al.
Publicado: (2023)
Bayesian Teaching Enables Probabilistic Reasoning in Large Language Models
por: Qiu, Linlu, et al.
Publicado: (2025)
por: Qiu, Linlu, et al.
Publicado: (2025)
Code-enabled language models can outperform reasoning models on diverse tasks
por: Zhang, Cedegao E., et al.
Publicado: (2025)
por: Zhang, Cedegao E., et al.
Publicado: (2025)
Language-Informed Synthesis of Rational Agent Models for Grounded Theory-of-Mind Reasoning On-The-Fly
por: Ying, Lance, et al.
Publicado: (2025)
por: Ying, Lance, et al.
Publicado: (2025)
Evaluating Language Models' Evaluations of Games
por: Collins, Katherine M., et al.
Publicado: (2025)
por: Collins, Katherine M., et al.
Publicado: (2025)
Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks
por: Wu, Zhaofeng, et al.
Publicado: (2023)
por: Wu, Zhaofeng, et al.
Publicado: (2023)
Pragmatic Instruction Following and Goal Assistance via Cooperative Language-Guided Inverse Planning
por: Zhi-Xuan, Tan, et al.
Publicado: (2024)
por: Zhi-Xuan, Tan, et al.
Publicado: (2024)
Scaling up the think-aloud method
por: Wurgaft, Daniel, et al.
Publicado: (2025)
por: Wurgaft, Daniel, et al.
Publicado: (2025)
Conditional and Modal Reasoning in Large Language Models
por: Holliday, Wesley H., et al.
Publicado: (2024)
por: Holliday, Wesley H., et al.
Publicado: (2024)
Is Safety Standard Same for Everyone? User-Specific Safety Evaluation of Large Language Models
por: In, Yeonjun, et al.
Publicado: (2025)
por: In, Yeonjun, et al.
Publicado: (2025)
Same Task, More Tokens: the Impact of Input Length on the Reasoning Performance of Large Language Models
por: Levy, Mosh, et al.
Publicado: (2024)
por: Levy, Mosh, et al.
Publicado: (2024)
Finding structure in logographic writing with library learning
por: Jiang, Guangyuan, et al.
Publicado: (2024)
por: Jiang, Guangyuan, et al.
Publicado: (2024)
Neuro-Symbolic Concepts
por: Mao, Jiayuan, et al.
Publicado: (2025)
por: Mao, Jiayuan, et al.
Publicado: (2025)
Controlled Evaluation of Syntactic Knowledge in Multilingual Language Models
por: Kryvosheieva, Daria, et al.
Publicado: (2024)
por: Kryvosheieva, Daria, et al.
Publicado: (2024)
CEI: A Benchmark for Evaluating Pragmatic Reasoning in Language Models
por: Chun, Jon, et al.
Publicado: (2026)
por: Chun, Jon, et al.
Publicado: (2026)
Phenomenal Yet Puzzling: Testing Inductive Reasoning Capabilities of Language Models with Hypothesis Refinement
por: Qiu, Linlu, et al.
Publicado: (2023)
por: Qiu, Linlu, et al.
Publicado: (2023)
Evaluating Pragmatic Reasoning in Large Language Models: Evidence from Scalar Diversity
por: Cho, Ye-eun
Publicado: (2026)
por: Cho, Ye-eun
Publicado: (2026)
Lookback Lens: Detecting and Mitigating Contextual Hallucinations in Large Language Models Using Only Attention Maps
por: Chuang, Yung-Sung, et al.
Publicado: (2024)
por: Chuang, Yung-Sung, et al.
Publicado: (2024)
Diagnosing Moral Reasoning Acquisition in Language Models: Pragmatics and Generalization
por: Liu, Guangliang, et al.
Publicado: (2025)
por: Liu, Guangliang, et al.
Publicado: (2025)
Hypothesis-Driven Theory-of-Mind Reasoning for Large Language Models
por: Kim, Hyunwoo, et al.
Publicado: (2025)
por: Kim, Hyunwoo, et al.
Publicado: (2025)
Pragmatic Competence Evaluation of Large Language Models for the Korean Language
por: Park, Dojun, et al.
Publicado: (2024)
por: Park, Dojun, et al.
Publicado: (2024)
Learning to Reason via Program Generation, Emulation, and Search
por: Weir, Nathaniel, et al.
Publicado: (2024)
por: Weir, Nathaniel, et al.
Publicado: (2024)
Accounting Reasoning in Large Language Models: Concepts, Evaluation, and Empirical Analysis
por: Zhou, Jie, et al.
Publicado: (2025)
por: Zhou, Jie, et al.
Publicado: (2025)
Modeling Open-World Cognition as On-Demand Synthesis of Probabilistic Models
por: Wong, Lionel, et al.
Publicado: (2025)
por: Wong, Lionel, et al.
Publicado: (2025)
ELF: Embedded Language Flows
por: Hu, Keya, et al.
Publicado: (2026)
por: Hu, Keya, et al.
Publicado: (2026)
N-gram-like Language Models Predict Reading Time Best
por: Michaelov, James A., et al.
Publicado: (2026)
por: Michaelov, James A., et al.
Publicado: (2026)
AmbigDocs: Reasoning across Documents on Different Entities under the Same Name
por: Lee, Yoonsang, et al.
Publicado: (2024)
por: Lee, Yoonsang, et al.
Publicado: (2024)
Towards an Analysis of Discourse and Interactional Pragmatic Reasoning Capabilities of Large Language Models
por: Robrecht, Amelie, et al.
Publicado: (2024)
por: Robrecht, Amelie, et al.
Publicado: (2024)
Evaluating Large Vision-and-Language Models on Children's Mathematical Olympiads
por: Cherian, Anoop, et al.
Publicado: (2024)
por: Cherian, Anoop, et al.
Publicado: (2024)
MultiPragEval: Multilingual Pragmatic Evaluation of Large Language Models
por: Park, Dojun, et al.
Publicado: (2024)
por: Park, Dojun, et al.
Publicado: (2024)
M3-SLU: Evaluating Speaker-Attributed Reasoning in Multimodal Large Language Models
por: Kwon, Yejin, et al.
Publicado: (2025)
por: Kwon, Yejin, et al.
Publicado: (2025)
Self-Steering Language Models
por: Grand, Gabriel, et al.
Publicado: (2025)
por: Grand, Gabriel, et al.
Publicado: (2025)
RPM: Reasoning-Level Personalization for Black-Box Large Language Models
por: Kim, Jieyong, et al.
Publicado: (2025)
por: Kim, Jieyong, et al.
Publicado: (2025)
Bias Amplification in Language Model Evolution: An Iterated Learning Perspective
por: Ren, Yi, et al.
Publicado: (2024)
por: Ren, Yi, et al.
Publicado: (2024)
The Pragmatic Mind of Machines: Tracing the Emergence of Pragmatic Competence in Large Language Models
por: Yu, Kefan, et al.
Publicado: (2025)
por: Yu, Kefan, et al.
Publicado: (2025)
Loose LIPS Sink Ships: Asking Questions in Battleship with Language-Informed Program Sampling
por: Grand, Gabriel, et al.
Publicado: (2024)
por: Grand, Gabriel, et al.
Publicado: (2024)
On Emergent Social World Models -- Evidence for Functional Integration of Theory of Mind and Pragmatic Reasoning in Language Models
por: Tsvilodub, Polina, et al.
Publicado: (2026)
por: Tsvilodub, Polina, et al.
Publicado: (2026)
STAR: A Benchmark for Situated Reasoning in Real-World Videos
por: Wu, Bo, et al.
Publicado: (2024)
por: Wu, Bo, et al.
Publicado: (2024)
Pragmatics in the Era of Large Language Models: A Survey on Datasets, Evaluation, Opportunities and Challenges
por: Ma, Bolei, et al.
Publicado: (2025)
por: Ma, Bolei, et al.
Publicado: (2025)
Ejemplares similares
-
Implicit Representations of Grammaticality in Language Models
por: Wang, Yingshan Susan, et al.
Publicado: (2026) -
LINC: A Neurosymbolic Approach for Logical Reasoning by Combining Language Models with First-Order Logic Provers
por: Olausson, Theo X., et al.
Publicado: (2023) -
Bayesian Teaching Enables Probabilistic Reasoning in Large Language Models
por: Qiu, Linlu, et al.
Publicado: (2025) -
Code-enabled language models can outperform reasoning models on diverse tasks
por: Zhang, Cedegao E., et al.
Publicado: (2025) -
Language-Informed Synthesis of Rational Agent Models for Grounded Theory-of-Mind Reasoning On-The-Fly
por: Ying, Lance, et al.
Publicado: (2025)