MIDGARD: Self-Consistency Using Minimum Description Length for Structured Commonsense Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nair, Inderjeet, Wang, Lu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Do Language Models Think Consistently? A Study of Value Preferences Across Varying Response Lengths
par: Nair, Inderjeet, et autres
Publié: (2025)
par: Nair, Inderjeet, et autres
Publié: (2025)
Value-Conflict Diagnostics Reveal Widespread Alignment Faking in Language Models
par: Nair, Inderjeet, et autres
Publié: (2026)
par: Nair, Inderjeet, et autres
Publié: (2026)
Context Over Content: Exposing Evaluation Faking in Automated Judges
par: Gupta, Manan, et autres
Publié: (2026)
par: Gupta, Manan, et autres
Publié: (2026)
Closing the Loop: Learning to Generate Writing Feedback via Language Model Simulated Student Revisions
par: Nair, Inderjeet, et autres
Publié: (2024)
par: Nair, Inderjeet, et autres
Publié: (2024)
Benchmarking Chinese Commonsense Reasoning with a Multi-hop Reasoning Perspective
par: You, Wangjie, et autres
Publié: (2025)
par: You, Wangjie, et autres
Publié: (2025)
Detecting Emotional Incongruity of Sarcasm by Commonsense Reasoning
par: Qiu, Ziqi, et autres
Publié: (2024)
par: Qiu, Ziqi, et autres
Publié: (2024)
Zero-shot Commonsense Reasoning over Machine Imagination
par: Park, Hyuntae, et autres
Publié: (2024)
par: Park, Hyuntae, et autres
Publié: (2024)
LOGICAL-COMMONSENSEQA: A Benchmark for Logical Commonsense Reasoning
par: Junias, Obed, et autres
Publié: (2026)
par: Junias, Obed, et autres
Publié: (2026)
Beyond Self-Consistency: Ensemble Reasoning Boosts Consistency and Accuracy of LLMs in Cancer Staging
par: Chang, Chia-Hsuan, et autres
Publié: (2024)
par: Chang, Chia-Hsuan, et autres
Publié: (2024)
Self-Consistency Boosts Calibration for Math Reasoning
par: Wang, Ante, et autres
Publié: (2024)
par: Wang, Ante, et autres
Publié: (2024)
G-SAP: Graph-based Structure-Aware Prompt Learning over Heterogeneous Knowledge for Commonsense Reasoning
par: Dai, Ruiting, et autres
Publié: (2024)
par: Dai, Ruiting, et autres
Publié: (2024)
Complex Reasoning over Logical Queries on Commonsense Knowledge Graphs
par: Fang, Tianqing, et autres
Publié: (2024)
par: Fang, Tianqing, et autres
Publié: (2024)
Plausibly Problematic Questions in Multiple-Choice Benchmarks for Commonsense Reasoning
par: Palta, Shramay, et autres
Publié: (2024)
par: Palta, Shramay, et autres
Publié: (2024)
Cross-Cultural Transfer of Commonsense Reasoning in LLMs: Evidence from the Arab World
par: Almheiri, Saeed, et autres
Publié: (2025)
par: Almheiri, Saeed, et autres
Publié: (2025)
Focus on Your Question! Interpreting and Mitigating Toxic CoT Problems in Commonsense Reasoning
par: Li, Jiachun, et autres
Publié: (2024)
par: Li, Jiachun, et autres
Publié: (2024)
LINKED: Eliciting, Filtering and Integrating Knowledge in Large Language Model for Commonsense Reasoning
par: Li, Jiachun, et autres
Publié: (2024)
par: Li, Jiachun, et autres
Publié: (2024)
GRASP: A Grid-Based Benchmark for Evaluating Commonsense Spatial Reasoning
par: Tang, Zhisheng, et autres
Publié: (2024)
par: Tang, Zhisheng, et autres
Publié: (2024)
Plausibility as Commonsense Reasoning: Humans Succeed, Large Language Models Do not
par: Karakaş, Sercan
Publié: (2026)
par: Karakaş, Sercan
Publié: (2026)
BrainBench: Exposing the Commonsense Reasoning Gap in Large Language Models
par: Tang, Yuzhe
Publié: (2026)
par: Tang, Yuzhe
Publié: (2026)
ConstraintChecker: A Plugin for Large Language Models to Reason on Commonsense Knowledge Bases
par: Do, Quyet V., et autres
Publié: (2024)
par: Do, Quyet V., et autres
Publié: (2024)
Towards Quantifying Commonsense Reasoning with Mechanistic Insights
par: Joshi, Abhinav, et autres
Publié: (2025)
par: Joshi, Abhinav, et autres
Publié: (2025)
What Really is Commonsense Knowledge?
par: Do, Quyet V., et autres
Publié: (2024)
par: Do, Quyet V., et autres
Publié: (2024)
Commonsense-T2I Challenge: Can Text-to-Image Generation Models Understand Commonsense?
par: Fu, Xingyu, et autres
Publié: (2024)
par: Fu, Xingyu, et autres
Publié: (2024)
Gemini in Reasoning: Unveiling Commonsense in Multimodal Large Language Models
par: Wang, Yuqing, et autres
Publié: (2023)
par: Wang, Yuqing, et autres
Publié: (2023)
Reasoning Aware Self-Consistency: Leveraging Reasoning Paths for Efficient LLM Sampling
par: Wan, Guangya, et autres
Publié: (2024)
par: Wan, Guangya, et autres
Publié: (2024)
Meta-RTL: Reinforcement-Based Meta-Transfer Learning for Low-Resource Commonsense Reasoning
par: Fu, Yu, et autres
Publié: (2024)
par: Fu, Yu, et autres
Publié: (2024)
Consistent Paths Lead to Truth: Self-Rewarding Reinforcement Learning for LLM Reasoning
par: Zhang, Kongcheng, et autres
Publié: (2025)
par: Zhang, Kongcheng, et autres
Publié: (2025)
Escape Sky-high Cost: Early-stopping Self-Consistency for Multi-step Reasoning
par: Li, Yiwei, et autres
Publié: (2024)
par: Li, Yiwei, et autres
Publié: (2024)
Commonsense Knowledge Editing Based on Free-Text in LLMs
par: Huang, Xiusheng, et autres
Publié: (2024)
par: Huang, Xiusheng, et autres
Publié: (2024)
Acquiring and Modelling Abstract Commonsense Knowledge via Conceptualization
par: He, Mutian, et autres
Publié: (2022)
par: He, Mutian, et autres
Publié: (2022)
Anti-Length Shift: Dynamic Outlier Truncation for Training Efficient Reasoning Models
par: Wu, Wei, et autres
Publié: (2026)
par: Wu, Wei, et autres
Publié: (2026)
Make Every Penny Count: Difficulty-Adaptive Self-Consistency for Cost-Efficient Reasoning
par: Wang, Xinglin, et autres
Publié: (2024)
par: Wang, Xinglin, et autres
Publié: (2024)
Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models
par: Xiong, Kai, et autres
Publié: (2025)
par: Xiong, Kai, et autres
Publié: (2025)
Decoding Memories: An Efficient Pipeline for Self-Consistency Hallucination Detection
par: Gao, Weizhi, et autres
Publié: (2025)
par: Gao, Weizhi, et autres
Publié: (2025)
ViCor: Bridging Visual Understanding and Commonsense Reasoning with Large Language Models
par: Zhou, Kaiwen, et autres
Publié: (2023)
par: Zhou, Kaiwen, et autres
Publié: (2023)
From Data to Commonsense Reasoning: The Use of Large Language Models for Explainable AI
par: Krause, Stefanie, et autres
Publié: (2024)
par: Krause, Stefanie, et autres
Publié: (2024)
On the Step Length Confounding in LLM Reasoning Data Selection
par: Wang, Bing, et autres
Publié: (2026)
par: Wang, Bing, et autres
Publié: (2026)
Estimating Commonsense Plausibility through Semantic Shifts
par: Cui, Wanqing, et autres
Publié: (2025)
par: Cui, Wanqing, et autres
Publié: (2025)
LAPO: Internalizing Reasoning Efficiency via Length-Adaptive Policy Optimization
par: Wu, Xingyu, et autres
Publié: (2025)
par: Wu, Xingyu, et autres
Publié: (2025)
Optimizing Length Compression in Large Reasoning Models
par: Cheng, Zhengxiang, et autres
Publié: (2025)
par: Cheng, Zhengxiang, et autres
Publié: (2025)
Documents similaires
-
Do Language Models Think Consistently? A Study of Value Preferences Across Varying Response Lengths
par: Nair, Inderjeet, et autres
Publié: (2025) -
Value-Conflict Diagnostics Reveal Widespread Alignment Faking in Language Models
par: Nair, Inderjeet, et autres
Publié: (2026) -
Context Over Content: Exposing Evaluation Faking in Automated Judges
par: Gupta, Manan, et autres
Publié: (2026) -
Closing the Loop: Learning to Generate Writing Feedback via Language Model Simulated Student Revisions
par: Nair, Inderjeet, et autres
Publié: (2024) -
Benchmarking Chinese Commonsense Reasoning with a Multi-hop Reasoning Perspective
par: You, Wangjie, et autres
Publié: (2025)