The Odyssey of Commonsense Causality: From Foundational Benchmarks to Cutting-Edge Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Cui, Shaobo, Jin, Zhijing, Schölkopf, Bernhard, Faltings, Boi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Nuance Matters: Probing Epistemic Consistency in Causal Reasoning
di: Cui, Shaobo, et al.
Pubblicazione: (2024)
di: Cui, Shaobo, et al.
Pubblicazione: (2024)
Exploring Defeasibility in Causal Reasoning
di: Cui, Shaobo, et al.
Pubblicazione: (2024)
di: Cui, Shaobo, et al.
Pubblicazione: (2024)
Unraveling Misinformation Propagation in LLM Reasoning
di: Feng, Yiyang, et al.
Pubblicazione: (2025)
di: Feng, Yiyang, et al.
Pubblicazione: (2025)
Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning
di: Paul, Debjit, et al.
Pubblicazione: (2024)
di: Paul, Debjit, et al.
Pubblicazione: (2024)
A Logical Fallacy-Informed Framework for Argument Generation
di: Mouchel, Luca, et al.
Pubblicazione: (2024)
di: Mouchel, Luca, et al.
Pubblicazione: (2024)
How Robust Are Router-LLMs? Analysis of the Fragility of LLM Routing Capabilities
di: Kassem, Aly M., et al.
Pubblicazione: (2025)
di: Kassem, Aly M., et al.
Pubblicazione: (2025)
Do LLMs Think Fast and Slow? A Causal Study on Sentiment Analysis
di: Lyu, Zhiheng, et al.
Pubblicazione: (2024)
di: Lyu, Zhiheng, et al.
Pubblicazione: (2024)
Corrupted by Reasoning: Reasoning Language Models Become Free-Riders in Public Goods Games
di: Piedrahita, David Guzman, et al.
Pubblicazione: (2025)
di: Piedrahita, David Guzman, et al.
Pubblicazione: (2025)
CausalCite: A Causal Formulation of Paper Citations
di: Kumar, Ishan, et al.
Pubblicazione: (2023)
di: Kumar, Ishan, et al.
Pubblicazione: (2023)
Are Language Models Consequentialist or Deontological Moral Reasoners?
di: Samway, Keenan, et al.
Pubblicazione: (2025)
di: Samway, Keenan, et al.
Pubblicazione: (2025)
Improving Large Language Model Safety with Contrastive Representation Learning
di: Simko, Samuel, et al.
Pubblicazione: (2025)
di: Simko, Samuel, et al.
Pubblicazione: (2025)
REFINER: Reasoning Feedback on Intermediate Representations
di: Paul, Debjit, et al.
Pubblicazione: (2023)
di: Paul, Debjit, et al.
Pubblicazione: (2023)
Causal Responsibility Attribution for Human-AI Collaboration
di: Qi, Yahang, et al.
Pubblicazione: (2024)
di: Qi, Yahang, et al.
Pubblicazione: (2024)
Foundations of a Developmental Design Paradigm for Integrated Continual Learning, Deliberative Behavior, and Comprehensibility
di: Erden, Zeki Doruk, et al.
Pubblicazione: (2025)
di: Erden, Zeki Doruk, et al.
Pubblicazione: (2025)
Evolutionary Developmental Biology Can Serve as the Conceptual Foundation for a New Design Paradigm in Artificial Intelligence
di: Erden, Zeki Doruk, et al.
Pubblicazione: (2025)
di: Erden, Zeki Doruk, et al.
Pubblicazione: (2025)
Tracing Multilingual Representations in LLMs with Cross-Layer Transcoders
di: Harrasse, Abir, et al.
Pubblicazione: (2025)
di: Harrasse, Abir, et al.
Pubblicazione: (2025)
Democratic or Authoritarian? Probing a New Dimension of Political Biases in Large Language Models
di: Piedrahita, David Guzman, et al.
Pubblicazione: (2025)
di: Piedrahita, David Guzman, et al.
Pubblicazione: (2025)
DARS: Dynamic Action Re-Sampling to Enhance Coding Agent Performance by Adaptive Tree Traversal
di: Aggarwal, Vaibhav, et al.
Pubblicazione: (2025)
di: Aggarwal, Vaibhav, et al.
Pubblicazione: (2025)
CLadder: Assessing Causal Reasoning in Language Models
di: Jin, Zhijing, et al.
Pubblicazione: (2023)
di: Jin, Zhijing, et al.
Pubblicazione: (2023)
Causality for Natural Language Processing
di: Jin, Zhijing
Pubblicazione: (2025)
di: Jin, Zhijing
Pubblicazione: (2025)
Competition of Mechanisms: Tracing How Language Models Handle Facts and Counterfactuals
di: Ortu, Francesco, et al.
Pubblicazione: (2024)
di: Ortu, Francesco, et al.
Pubblicazione: (2024)
Benchmarking Chinese Commonsense Reasoning of LLMs: From Chinese-Specifics to Reasoning-Memorization Correlations
di: Sun, Jiaxing, et al.
Pubblicazione: (2024)
di: Sun, Jiaxing, et al.
Pubblicazione: (2024)
Cooperate or Collapse: Emergence of Sustainable Cooperation in a Society of LLM Agents
di: Piatti, Giorgio, et al.
Pubblicazione: (2024)
di: Piatti, Giorgio, et al.
Pubblicazione: (2024)
Exploring the Jungle of Bias: Political Bias Attribution in Language Models via Dependency Analysis
di: Jenny, David F., et al.
Pubblicazione: (2023)
di: Jenny, David F., et al.
Pubblicazione: (2023)
When Ethics and Payoffs Diverge: LLM Agents in Morally Charged Social Dilemmas
di: Backmann, Steffen, et al.
Pubblicazione: (2025)
di: Backmann, Steffen, et al.
Pubblicazione: (2025)
Thai Winograd Schemas: A Benchmark for Thai Commonsense Reasoning
di: Artkaew, Phakphum
Pubblicazione: (2024)
di: Artkaew, Phakphum
Pubblicazione: (2024)
SCoRE: Benchmarking Long-Chain Reasoning in Commonsense Scenarios
di: Zhan, Weidong, et al.
Pubblicazione: (2025)
di: Zhan, Weidong, et al.
Pubblicazione: (2025)
Com$^2$: A Causal-Guided Benchmark for Exploring Complex Commonsense Reasoning in Large Language Models
di: Xiong, Kai, et al.
Pubblicazione: (2025)
di: Xiong, Kai, et al.
Pubblicazione: (2025)
When Do Language Models Endorse Limitations on Human Rights Principles?
di: Samway, Keenan, et al.
Pubblicazione: (2026)
di: Samway, Keenan, et al.
Pubblicazione: (2026)
Quriosity: Analyzing Human Questioning Behavior and Causal Inquiry through Curiosity-Driven Queries
di: Ceraolo, Roberto, et al.
Pubblicazione: (2024)
di: Ceraolo, Roberto, et al.
Pubblicazione: (2024)
LOGICAL-COMMONSENSEQA: A Benchmark for Logical Commonsense Reasoning
di: Junias, Obed, et al.
Pubblicazione: (2026)
di: Junias, Obed, et al.
Pubblicazione: (2026)
Enhancing Retrieval Systems with Inference-Time Logical Reasoning
di: Faltings, Felix, et al.
Pubblicazione: (2025)
di: Faltings, Felix, et al.
Pubblicazione: (2025)
Doing Good or Doing Right? Exploring the Weakness of Commonsense Causal Reasoning Models
di: Han, Mingyue, et al.
Pubblicazione: (2021)
di: Han, Mingyue, et al.
Pubblicazione: (2021)
Benchmarking Chinese Commonsense Reasoning with a Multi-hop Reasoning Perspective
di: You, Wangjie, et al.
Pubblicazione: (2025)
di: You, Wangjie, et al.
Pubblicazione: (2025)
Are LLMs Good Safety Agents or a Propaganda Engine?
di: Yadav, Neemesh, et al.
Pubblicazione: (2025)
di: Yadav, Neemesh, et al.
Pubblicazione: (2025)
A diverse Multilingual News Headlines Dataset from around the World
di: Leeb, Felix, et al.
Pubblicazione: (2024)
di: Leeb, Felix, et al.
Pubblicazione: (2024)
On the Parallels Between Evolutionary Theory and the State of AI
di: Erden, Zeki Doruk, et al.
Pubblicazione: (2025)
di: Erden, Zeki Doruk, et al.
Pubblicazione: (2025)
Rethinking Easy-to-Hard: Limits of Curriculum Learning in Post-Training for Deductive Reasoning
di: Mordig, Maximilian, et al.
Pubblicazione: (2026)
di: Mordig, Maximilian, et al.
Pubblicazione: (2026)
Plausibly Problematic Questions in Multiple-Choice Benchmarks for Commonsense Reasoning
di: Palta, Shramay, et al.
Pubblicazione: (2024)
di: Palta, Shramay, et al.
Pubblicazione: (2024)
Causality can systematically address the monsters under the bench(marks)
di: Leeb, Felix, et al.
Pubblicazione: (2025)
di: Leeb, Felix, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Nuance Matters: Probing Epistemic Consistency in Causal Reasoning
di: Cui, Shaobo, et al.
Pubblicazione: (2024) -
Exploring Defeasibility in Causal Reasoning
di: Cui, Shaobo, et al.
Pubblicazione: (2024) -
Unraveling Misinformation Propagation in LLM Reasoning
di: Feng, Yiyang, et al.
Pubblicazione: (2025) -
Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning
di: Paul, Debjit, et al.
Pubblicazione: (2024) -
A Logical Fallacy-Informed Framework for Argument Generation
di: Mouchel, Luca, et al.
Pubblicazione: (2024)