STEER-ME: Assessing the Microeconomic Reasoning of Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Raman, Narun, Lundy, Taylor, Amin, Thiago, Perla, Jesse, Leyton-Brown, Kevin |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
STEER: Assessing the Economic Rationality of Large Language Models
by: Raman, Narun, et al.
Published: (2024)
by: Raman, Narun, et al.
Published: (2024)
Reasoning Models are Test Exploiters: Rethinking Multiple-Choice
by: Raman, Narun, et al.
Published: (2025)
by: Raman, Narun, et al.
Published: (2025)
QuickScope: Certifying Hard Questions in Dynamic LLM Benchmarks
by: Lundy, Taylor, et al.
Published: (2026)
by: Lundy, Taylor, et al.
Published: (2026)
NFTs as a Data-Rich Test Bed: Conspicuous Consumption and its Determinants
by: Lundy, Taylor, et al.
Published: (2025)
by: Lundy, Taylor, et al.
Published: (2025)
Understanding Understanding: A Pragmatic Framework Motivated by Large Language Models
by: Leyton-Brown, Kevin, et al.
Published: (2024)
by: Leyton-Brown, Kevin, et al.
Published: (2024)
STEER-BENCH: A Benchmark for Evaluating the Steerability of Large Language Models
by: Chen, Kai, et al.
Published: (2025)
by: Chen, Kai, et al.
Published: (2025)
STEER: Structured Event Evidence for Video Reasoning via Multi-Objective Reinforcement Learning
by: Li, Zinuo, et al.
Published: (2026)
by: Li, Zinuo, et al.
Published: (2026)
Assessing Dialect Fairness and Robustness of Large Language Models in Reasoning Tasks
by: Lin, Fangru, et al.
Published: (2024)
by: Lin, Fangru, et al.
Published: (2024)
CLadder: Assessing Causal Reasoning in Language Models
by: Jin, Zhijing, et al.
Published: (2023)
by: Jin, Zhijing, et al.
Published: (2023)
Assessing Language Models' Worldview for Fiction Generation
by: Khatun, Aisha, et al.
Published: (2024)
by: Khatun, Aisha, et al.
Published: (2024)
PsycholexTherapy: Simulating Reasoning in Psychotherapy with Small Language Models in Persian
by: Abbasi, Mohammad Amin, et al.
Published: (2025)
by: Abbasi, Mohammad Amin, et al.
Published: (2025)
PDDL-Mind: Large Language Models are Capable on Belief Reasoning with Reliable State Tracking
by: Zhu, Wang Bill, et al.
Published: (2026)
by: Zhu, Wang Bill, et al.
Published: (2026)
Leveraging Large Language Models in Human-Robot Interaction: A Critical Analysis of Potential and Pitfalls
by: Atuhurra, Jesse
Published: (2024)
by: Atuhurra, Jesse
Published: (2024)
Assessing Judging Bias in Large Reasoning Models: An Empirical Study
by: Wang, Qian, et al.
Published: (2025)
by: Wang, Qian, et al.
Published: (2025)
Rethinking the Outlier Distribution in Large Language Models: An In-depth Study
by: Raman, Rahul, et al.
Published: (2025)
by: Raman, Rahul, et al.
Published: (2025)
Generating Benchmarks for Factuality Evaluation of Language Models
by: Muhlgay, Dor, et al.
Published: (2023)
by: Muhlgay, Dor, et al.
Published: (2023)
Assessing the Emergent Symbolic Reasoning Abilities of Llama Large Language Models
by: Petruzzellis, Flavio, et al.
Published: (2024)
by: Petruzzellis, Flavio, et al.
Published: (2024)
Pula: Training Large Language Models for Setswana
by: Brown, Nathan, et al.
Published: (2024)
by: Brown, Nathan, et al.
Published: (2024)
Assessing and Enhancing the Robustness of Large Language Models with Task Structure Variations for Logical Reasoning
by: Bao, Qiming, et al.
Published: (2023)
by: Bao, Qiming, et al.
Published: (2023)
Investigating Human-Aligned Large Language Model Uncertainty
by: Moore, Kyle, et al.
Published: (2025)
by: Moore, Kyle, et al.
Published: (2025)
Emergent Symbolic Mechanisms Support Abstract Reasoning in Large Language Models
by: Yang, Yukang, et al.
Published: (2025)
by: Yang, Yukang, et al.
Published: (2025)
Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition
by: Kiruluta, Andrew, et al.
Published: (2025)
by: Kiruluta, Andrew, et al.
Published: (2025)
DiversityMedQA: Assessing Demographic Biases in Medical Diagnosis using Large Language Models
by: Rawat, Rajat, et al.
Published: (2024)
by: Rawat, Rajat, et al.
Published: (2024)
Assessing "Implicit" Retrieval Robustness of Large Language Models
by: Shen, Xiaoyu, et al.
Published: (2024)
by: Shen, Xiaoyu, et al.
Published: (2024)
Remember This Event That Year? Assessing Temporal Information and Reasoning in Large Language Models
by: Beniwal, Himanshu, et al.
Published: (2024)
by: Beniwal, Himanshu, et al.
Published: (2024)
Finance Language Model Evaluation (FLaME)
by: Matlin, Glenn, et al.
Published: (2025)
by: Matlin, Glenn, et al.
Published: (2025)
Computational Reasoning of Large Language Models
by: Wu, Haitao, et al.
Published: (2025)
by: Wu, Haitao, et al.
Published: (2025)
Meta Reasoning for Large Language Models
by: Gao, Peizhong, et al.
Published: (2024)
by: Gao, Peizhong, et al.
Published: (2024)
Structured Reasoning for Large Language Models
by: Han, Jinyi, et al.
Published: (2026)
by: Han, Jinyi, et al.
Published: (2026)
Beyond Memorization: Assessing Semantic Generalization in Large Language Models Using Phrasal Constructions
by: Scivetti, Wesley, et al.
Published: (2025)
by: Scivetti, Wesley, et al.
Published: (2025)
Eliciting Reasoning in Language Models with Cognitive Tools
by: Ebouky, Brown, et al.
Published: (2025)
by: Ebouky, Brown, et al.
Published: (2025)
Rosetta-PL: Propositional Logic as a Benchmark for Large Language Model Reasoning
by: Baek, Shaun, et al.
Published: (2025)
by: Baek, Shaun, et al.
Published: (2025)
When the Pure Reasoner Meets the Impossible Object: Analytic vs. Synthetic Fine-Tuning and the Suppression of Genesis in Language Models
by: Amouhadi, Amin
Published: (2026)
by: Amouhadi, Amin
Published: (2026)
ME-Switch: A Memory-Efficient Expert Switching Framework for Large Language Models
by: Liu, Jing, et al.
Published: (2024)
by: Liu, Jing, et al.
Published: (2024)
Assessing Agentic Large Language Models in Multilingual National Bias
by: Liu, Qianying, et al.
Published: (2025)
by: Liu, Qianying, et al.
Published: (2025)
PsychoLex: Unveiling the Psychological Mind of Large Language Models
by: Abbasi, Mohammad Amin, et al.
Published: (2024)
by: Abbasi, Mohammad Amin, et al.
Published: (2024)
Assessing the Impact of Conspiracy Theories Using Large Language Models
by: Jiang, Bohan, et al.
Published: (2024)
by: Jiang, Bohan, et al.
Published: (2024)
Assessing and Understanding Creativity in Large Language Models
by: Zhao, Yunpu, et al.
Published: (2024)
by: Zhao, Yunpu, et al.
Published: (2024)
Assessing Political Bias in Large Language Models
by: Rettenberger, Luca, et al.
Published: (2024)
by: Rettenberger, Luca, et al.
Published: (2024)
Reasoning Capabilities and Invariability of Large Language Models
by: Raganato, Alessandro, et al.
Published: (2025)
by: Raganato, Alessandro, et al.
Published: (2025)
Similar Items
-
STEER: Assessing the Economic Rationality of Large Language Models
by: Raman, Narun, et al.
Published: (2024) -
Reasoning Models are Test Exploiters: Rethinking Multiple-Choice
by: Raman, Narun, et al.
Published: (2025) -
QuickScope: Certifying Hard Questions in Dynamic LLM Benchmarks
by: Lundy, Taylor, et al.
Published: (2026) -
NFTs as a Data-Rich Test Bed: Conspicuous Consumption and its Determinants
by: Lundy, Taylor, et al.
Published: (2025) -
Understanding Understanding: A Pragmatic Framework Motivated by Large Language Models
by: Leyton-Brown, Kevin, et al.
Published: (2024)