Rationality Check! Benchmarking the Rationality of Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhou, Zhilun, Wang, Jing Yi, Sukiennik, Nicholas, Gao, Chen, Xu, Fengli, Li, Yong, Evans, James |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
An Evaluation of Cultural Value Alignment in LLM
por: Sukiennik, Nicholas, et al.
Publicado: (2025)
por: Sukiennik, Nicholas, et al.
Publicado: (2025)
Simulating Filter Bubble on Short-video Recommender System with Large Language Model Agents
por: Sukiennik, Nicholas, et al.
Publicado: (2025)
por: Sukiennik, Nicholas, et al.
Publicado: (2025)
Large Language Model for Participatory Urban Planning
por: Zhou, Zhilun, et al.
Publicado: (2024)
por: Zhou, Zhilun, et al.
Publicado: (2024)
A Survey on Human-Centric LLMs
por: Wang, Jing Yi, et al.
Publicado: (2024)
por: Wang, Jing Yi, et al.
Publicado: (2024)
Large language model empowered participatory urban planning
por: Zhou, Zhilun, et al.
Publicado: (2024)
por: Zhou, Zhilun, et al.
Publicado: (2024)
Uncovering the Deep Filter Bubble: Narrow Exposure in Short-Video Recommendation
por: Sukiennik, Nicholas, et al.
Publicado: (2024)
por: Sukiennik, Nicholas, et al.
Publicado: (2024)
Token Signature: Predicting Chain-of-Thought Gains with Token Decoding Feature in Large Language Models
por: Liu, Peijie, et al.
Publicado: (2025)
por: Liu, Peijie, et al.
Publicado: (2025)
Synergizing LLM Agents and Knowledge Graph for Socioeconomic Prediction in LBSN
por: Zhou, Zhilun, et al.
Publicado: (2024)
por: Zhou, Zhilun, et al.
Publicado: (2024)
Rational Metareasoning for Large Language Models
por: De Sabbata, C. Nicolò, et al.
Publicado: (2024)
por: De Sabbata, C. Nicolò, et al.
Publicado: (2024)
Route-and-Reason: Scaling Large Language Model Reasoning with Reinforced Model Router
por: Shao, Chenyang, et al.
Publicado: (2025)
por: Shao, Chenyang, et al.
Publicado: (2025)
AgentStealth: Reinforcing Large Language Model for Anonymizing User-generated Text
por: Shao, Chenyang, et al.
Publicado: (2025)
por: Shao, Chenyang, et al.
Publicado: (2025)
ResMAS: Resilience Optimization in LLM-based Multi-agent Systems
por: Zhou, Zhilun, et al.
Publicado: (2026)
por: Zhou, Zhilun, et al.
Publicado: (2026)
A Survey of Large Language Model-Powered Spatial Intelligence Across Scales: Advances in Embodied Agents, Smart Cities, and Earth Science
por: Feng, Jie, et al.
Publicado: (2025)
por: Feng, Jie, et al.
Publicado: (2025)
MirrorMind: Empowering OmniScientist with the Expert Perspectives and Collective Knowledge of Human Scientists
por: Zeng, Qingbin, et al.
Publicado: (2025)
por: Zeng, Qingbin, et al.
Publicado: (2025)
Debiasing International Attitudes: LLM Agents for Simulating US-China Perception Changes
por: Sukiennik, Nicholas, et al.
Publicado: (2025)
por: Sukiennik, Nicholas, et al.
Publicado: (2025)
Enterprise Large Language Model Evaluation Benchmark
por: Wang, Liya, et al.
Publicado: (2025)
por: Wang, Liya, et al.
Publicado: (2025)
Characterizing Large Language Models as Rationalizers of Knowledge-intensive Tasks
por: Mishra, Aditi, et al.
Publicado: (2023)
por: Mishra, Aditi, et al.
Publicado: (2023)
Rational ANOVA Networks
por: Zhang, Jusheng, et al.
Publicado: (2026)
por: Zhang, Jusheng, et al.
Publicado: (2026)
Exploring the Potential for Large Language Models to Demonstrate Rational Probabilistic Beliefs
por: Freedman, Gabriel, et al.
Publicado: (2025)
por: Freedman, Gabriel, et al.
Publicado: (2025)
RationAnomaly: Log Anomaly Detection with Rationality via Chain-of-Thought and Reinforcement Learning
por: Xu, Song, et al.
Publicado: (2025)
por: Xu, Song, et al.
Publicado: (2025)
Improving Rationality in the Reasoning Process of Language Models through Self-playing Game
por: Wang, Pinzheng, et al.
Publicado: (2025)
por: Wang, Pinzheng, et al.
Publicado: (2025)
Synergy-of-Thoughts: Eliciting Efficient Reasoning in Hybrid Language Models
por: Shang, Yu, et al.
Publicado: (2024)
por: Shang, Yu, et al.
Publicado: (2024)
Are More Tokens Rational? Inference-Time Scaling in Language Models as Adaptive Resource Rationality
por: Hu, Zhimin, et al.
Publicado: (2026)
por: Hu, Zhimin, et al.
Publicado: (2026)
A Rational Model of Dimension-reduced Human Categorization
por: Hong, Yifan, et al.
Publicado: (2023)
por: Hong, Yifan, et al.
Publicado: (2023)
RealFactBench: A Benchmark for Evaluating Large Language Models in Real-World Fact-Checking
por: Yang, Shuo, et al.
Publicado: (2025)
por: Yang, Shuo, et al.
Publicado: (2025)
Cooperative Classification and Rationalization for Graph Generalization
por: Yue, Linan, et al.
Publicado: (2024)
por: Yue, Linan, et al.
Publicado: (2024)
Understanding World or Predicting Future? A Comprehensive Survey of World Models
por: Ding, Jingtao, et al.
Publicado: (2024)
por: Ding, Jingtao, et al.
Publicado: (2024)
Rational Inference in Formal Concept Analysis
por: Carr, Lucas, et al.
Publicado: (2025)
por: Carr, Lucas, et al.
Publicado: (2025)
Beyond Rational Illusion: Behaviorally Realistic Strategic Classification
por: Lv, Xinpeng, et al.
Publicado: (2026)
por: Lv, Xinpeng, et al.
Publicado: (2026)
Adversarial Cooperative Rationalization: The Risk of Spurious Correlations in Even Clean Datasets
por: Liu, Wei, et al.
Publicado: (2025)
por: Liu, Wei, et al.
Publicado: (2025)
Towards Faithful Explanations: Boosting Rationalization with Shortcuts Discovery
por: Yue, Linan, et al.
Publicado: (2024)
por: Yue, Linan, et al.
Publicado: (2024)
Reason-to-Recommend: Using Interaction-of-Thought Reasoning to Enhance LLM Recommendation
por: Zhao, Keyu, et al.
Publicado: (2025)
por: Zhao, Keyu, et al.
Publicado: (2025)
Rationalization Models for Text-to-SQL
por: Rossiello, Gaetano, et al.
Publicado: (2025)
por: Rossiello, Gaetano, et al.
Publicado: (2025)
MedFact: Benchmarking the Fact-Checking Capabilities of Large Language Models on Chinese Medical Texts
por: He, Jiayi, et al.
Publicado: (2025)
por: He, Jiayi, et al.
Publicado: (2025)
Rational Inverse Reasoning
por: Zandonati, Ben, et al.
Publicado: (2025)
por: Zandonati, Ben, et al.
Publicado: (2025)
Fact-Checking with Large Language Models via Probabilistic Certainty and Consistency
por: Wang, Haoran, et al.
Publicado: (2026)
por: Wang, Haoran, et al.
Publicado: (2026)
SPM-Bench: Benchmarking Large Language Models for Scanning Probe Microscopy
por: Xiao, Peiyao, et al.
Publicado: (2026)
por: Xiao, Peiyao, et al.
Publicado: (2026)
Large Language Models Assume People are More Rational than We Really are
por: Liu, Ryan, et al.
Publicado: (2024)
por: Liu, Ryan, et al.
Publicado: (2024)
Boosting Explainability through Selective Rationalization in Pre-trained Language Models
por: Yuan, Libing, et al.
Publicado: (2025)
por: Yuan, Libing, et al.
Publicado: (2025)
Uncommon Belief in Rationality
por: Shi, Qi, et al.
Publicado: (2024)
por: Shi, Qi, et al.
Publicado: (2024)
Ejemplares similares
-
An Evaluation of Cultural Value Alignment in LLM
por: Sukiennik, Nicholas, et al.
Publicado: (2025) -
Simulating Filter Bubble on Short-video Recommender System with Large Language Model Agents
por: Sukiennik, Nicholas, et al.
Publicado: (2025) -
Large Language Model for Participatory Urban Planning
por: Zhou, Zhilun, et al.
Publicado: (2024) -
A Survey on Human-Centric LLMs
por: Wang, Jing Yi, et al.
Publicado: (2024) -
Large language model empowered participatory urban planning
por: Zhou, Zhilun, et al.
Publicado: (2024)