LOGICAL-COMMONSENSEQA: A Benchmark for Logical Commonsense Reasoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Junias, Obed, Pacheco, Maria Leonor |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Complex Reasoning over Logical Queries on Commonsense Knowledge Graphs
por: Fang, Tianqing, et al.
Publicado: (2024)
por: Fang, Tianqing, et al.
Publicado: (2024)
Benchmarking Chinese Commonsense Reasoning with a Multi-hop Reasoning Perspective
por: You, Wangjie, et al.
Publicado: (2025)
por: You, Wangjie, et al.
Publicado: (2025)
GRASP: A Grid-Based Benchmark for Evaluating Commonsense Spatial Reasoning
por: Tang, Zhisheng, et al.
Publicado: (2024)
por: Tang, Zhisheng, et al.
Publicado: (2024)
Plausibly Problematic Questions in Multiple-Choice Benchmarks for Commonsense Reasoning
por: Palta, Shramay, et al.
Publicado: (2024)
por: Palta, Shramay, et al.
Publicado: (2024)
Assessing Algorithmic Bias in Language-Based Depression Detection: A Comparison of DNN and LLM Approaches
por: Junias, Obed, et al.
Publicado: (2025)
por: Junias, Obed, et al.
Publicado: (2025)
MultiZebraLogic: A Multilingual Logical Reasoning Benchmark
por: Bruun, Sofie Helene, et al.
Publicado: (2025)
por: Bruun, Sofie Helene, et al.
Publicado: (2025)
Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models
por: Xiong, Kai, et al.
Publicado: (2025)
por: Xiong, Kai, et al.
Publicado: (2025)
Detecting Emotional Incongruity of Sarcasm by Commonsense Reasoning
por: Qiu, Ziqi, et al.
Publicado: (2024)
por: Qiu, Ziqi, et al.
Publicado: (2024)
Zero-shot Commonsense Reasoning over Machine Imagination
por: Park, Hyuntae, et al.
Publicado: (2024)
por: Park, Hyuntae, et al.
Publicado: (2024)
Mapping the Course for Prompt-based Structured Prediction
por: Pauk, Matt, et al.
Publicado: (2025)
por: Pauk, Matt, et al.
Publicado: (2025)
Plausibility as Commonsense Reasoning: Humans Succeed, Large Language Models Do not
por: Karakaş, Sercan
Publicado: (2026)
por: Karakaş, Sercan
Publicado: (2026)
BrainBench: Exposing the Commonsense Reasoning Gap in Large Language Models
por: Tang, Yuzhe
Publicado: (2026)
por: Tang, Yuzhe
Publicado: (2026)
Towards Quantifying Commonsense Reasoning with Mechanistic Insights
por: Joshi, Abhinav, et al.
Publicado: (2025)
por: Joshi, Abhinav, et al.
Publicado: (2025)
ConstraintChecker: A Plugin for Large Language Models to Reason on Commonsense Knowledge Bases
por: Do, Quyet V., et al.
Publicado: (2024)
por: Do, Quyet V., et al.
Publicado: (2024)
Focus on Your Question! Interpreting and Mitigating Toxic CoT Problems in Commonsense Reasoning
por: Li, Jiachun, et al.
Publicado: (2024)
por: Li, Jiachun, et al.
Publicado: (2024)
Cross-Cultural Transfer of Commonsense Reasoning in LLMs: Evidence from the Arab World
por: Almheiri, Saeed, et al.
Publicado: (2025)
por: Almheiri, Saeed, et al.
Publicado: (2025)
MIDGARD: Self-Consistency Using Minimum Description Length for Structured Commonsense Reasoning
por: Nair, Inderjeet, et al.
Publicado: (2024)
por: Nair, Inderjeet, et al.
Publicado: (2024)
LINKED: Eliciting, Filtering and Integrating Knowledge in Large Language Model for Commonsense Reasoning
por: Li, Jiachun, et al.
Publicado: (2024)
por: Li, Jiachun, et al.
Publicado: (2024)
LogicSkills: A Structured Benchmark for Formal Reasoning in Large Language Models
por: Rabern, Brian, et al.
Publicado: (2026)
por: Rabern, Brian, et al.
Publicado: (2026)
Meta-RTL: Reinforcement-Based Meta-Transfer Learning for Low-Resource Commonsense Reasoning
por: Fu, Yu, et al.
Publicado: (2024)
por: Fu, Yu, et al.
Publicado: (2024)
What Really is Commonsense Knowledge?
por: Do, Quyet V., et al.
Publicado: (2024)
por: Do, Quyet V., et al.
Publicado: (2024)
LogicGame: Benchmarking Rule-Based Reasoning Abilities of Large Language Models
por: Gui, Jiayi, et al.
Publicado: (2024)
por: Gui, Jiayi, et al.
Publicado: (2024)
Normative Reasoning in Large Language Models: A Comparative Benchmark from Logical and Modal Perspectives
por: Ozeki, Kentaro, et al.
Publicado: (2025)
por: Ozeki, Kentaro, et al.
Publicado: (2025)
DivLogicEval: A Framework for Benchmarking Logical Reasoning Evaluation in Large Language Models
por: Chung, Tsz Ting, et al.
Publicado: (2025)
por: Chung, Tsz Ting, et al.
Publicado: (2025)
G-SAP: Graph-based Structure-Aware Prompt Learning over Heterogeneous Knowledge for Commonsense Reasoning
por: Dai, Ruiting, et al.
Publicado: (2024)
por: Dai, Ruiting, et al.
Publicado: (2024)
Gemini in Reasoning: Unveiling Commonsense in Multimodal Large Language Models
por: Wang, Yuqing, et al.
Publicado: (2023)
por: Wang, Yuqing, et al.
Publicado: (2023)
Towards LogiGLUE: A Brief Survey and A Benchmark for Analyzing Logical Reasoning Capabilities of Language Models
por: Luo, Man, et al.
Publicado: (2023)
por: Luo, Man, et al.
Publicado: (2023)
SynLogic: Synthesizing Verifiable Reasoning Data at Scale for Learning Logical Reasoning and Beyond
por: Liu, Junteng, et al.
Publicado: (2025)
por: Liu, Junteng, et al.
Publicado: (2025)
From Data to Commonsense Reasoning: The Use of Large Language Models for Explainable AI
por: Krause, Stefanie, et al.
Publicado: (2024)
por: Krause, Stefanie, et al.
Publicado: (2024)
Estimating Commonsense Plausibility through Semantic Shifts
por: Cui, Wanqing, et al.
Publicado: (2025)
por: Cui, Wanqing, et al.
Publicado: (2025)
Learning to Correction: Explainable Feedback Generation for Visual Commonsense Reasoning Distractor
por: Chen, Jiali, et al.
Publicado: (2024)
por: Chen, Jiali, et al.
Publicado: (2024)
Zero-Shot Commonsense Validation and Reasoning with Large Language Models: An Evaluation on SemEval-2020 Task 4 Dataset
por: Alfugaha, Rawand, et al.
Publicado: (2025)
por: Alfugaha, Rawand, et al.
Publicado: (2025)
ADAPT: Benchmarking Commonsense Planning under Unspecified Affordance Constraints
por: Chen, Pei-An, et al.
Publicado: (2026)
por: Chen, Pei-An, et al.
Publicado: (2026)
Reason from Fallacy: Enhancing Large Language Models' Logical Reasoning through Logical Fallacy Understanding
por: Li, Yanda, et al.
Publicado: (2024)
por: Li, Yanda, et al.
Publicado: (2024)
Modelling Commonsense Commonalities with Multi-Facet Concept Embeddings
por: Kteich, Hanane, et al.
Publicado: (2024)
por: Kteich, Hanane, et al.
Publicado: (2024)
Acquiring and Modelling Abstract Commonsense Knowledge via Conceptualization
por: He, Mutian, et al.
Publicado: (2022)
por: He, Mutian, et al.
Publicado: (2022)
Commonsense Knowledge Editing Based on Free-Text in LLMs
por: Huang, Xiusheng, et al.
Publicado: (2024)
por: Huang, Xiusheng, et al.
Publicado: (2024)
Multimodal Commonsense Knowledge Distillation for Visual Question Answering
por: Yang, Shuo, et al.
Publicado: (2024)
por: Yang, Shuo, et al.
Publicado: (2024)
Every Answer Matters: Evaluating Commonsense with Probabilistic Measures
por: Cheng, Qi, et al.
Publicado: (2024)
por: Cheng, Qi, et al.
Publicado: (2024)
Empowering LLMs with Logical Reasoning: A Comprehensive Survey
por: Cheng, Fengxiang, et al.
Publicado: (2025)
por: Cheng, Fengxiang, et al.
Publicado: (2025)
Ejemplares similares
-
Complex Reasoning over Logical Queries on Commonsense Knowledge Graphs
por: Fang, Tianqing, et al.
Publicado: (2024) -
Benchmarking Chinese Commonsense Reasoning with a Multi-hop Reasoning Perspective
por: You, Wangjie, et al.
Publicado: (2025) -
GRASP: A Grid-Based Benchmark for Evaluating Commonsense Spatial Reasoning
por: Tang, Zhisheng, et al.
Publicado: (2024) -
Plausibly Problematic Questions in Multiple-Choice Benchmarks for Commonsense Reasoning
por: Palta, Shramay, et al.
Publicado: (2024) -
Assessing Algorithmic Bias in Language-Based Depression Detection: A Comparison of DNN and LLM Approaches
por: Junias, Obed, et al.
Publicado: (2025)