Compositional Causal Reasoning Evaluation in Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Maasch, Jacqueline R. M. A., Hüyük, Alihan, Xu, Xinnuo, Nori, Aditya V., Gonzalez, Javier |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Reasoning Elicitation in Language Models via Counterfactual Feedback
par: Hüyük, Alihan, et autres
Publié: (2024)
par: Hüyük, Alihan, et autres
Publié: (2024)
CausalARC: Abstract Reasoning with Causal World Models
par: Maasch, Jacqueline, et autres
Publié: (2025)
par: Maasch, Jacqueline, et autres
Publié: (2025)
Query-Dependent Prompt Evaluation and Optimization with Offline Inverse RL
par: Sun, Hao, et autres
Publié: (2023)
par: Sun, Hao, et autres
Publié: (2023)
When is Off-Policy Evaluation (Reward Modeling) Useful in Contextual Bandits? A Data-Centric Perspective
par: Sun, Hao, et autres
Publié: (2023)
par: Sun, Hao, et autres
Publié: (2023)
Defining Expertise: Applications to Treatment Effect Estimation
par: Hüyük, Alihan, et autres
Publié: (2024)
par: Hüyük, Alihan, et autres
Publié: (2024)
RE-IMAGINE: Symbolic Benchmark Synthesis for Reasoning Evaluation
par: Xu, Xinnuo, et autres
Publié: (2025)
par: Xu, Xinnuo, et autres
Publié: (2025)
Causal Evaluation of Language Models
par: Chen, Sirui, et autres
Publié: (2024)
par: Chen, Sirui, et autres
Publié: (2024)
CLadder: Assessing Causal Reasoning in Language Models
par: Jin, Zhijing, et autres
Publié: (2023)
par: Jin, Zhijing, et autres
Publié: (2023)
CausalVLBench: Benchmarking Visual Causal Reasoning in Large Vision-Language Models
par: Komanduri, Aneesh, et autres
Publié: (2025)
par: Komanduri, Aneesh, et autres
Publié: (2025)
Unveiling Causal Reasoning in Large Language Models: Reality or Mirage?
par: Chi, Haoang, et autres
Publié: (2025)
par: Chi, Haoang, et autres
Publié: (2025)
Mitigating Hallucinations in Large Language Models via Causal Reasoning
par: Li, Yuangang, et autres
Publié: (2025)
par: Li, Yuangang, et autres
Publié: (2025)
Recursive Concept Evolution for Compositional Reasoning in Large Language Models
par: Chaudhry, Sarim
Publié: (2026)
par: Chaudhry, Sarim
Publié: (2026)
Enhancing Causal Reasoning in Large Language Models: A Causal Attribution Model for Precision Fine-Tuning
par: Cai, Hengrui, et autres
Publié: (2023)
par: Cai, Hengrui, et autres
Publié: (2023)
Bypassing the Rationale: Causal Auditing of Implicit Reasoning in Language Models
par: Sathyanarayanan, Anish, et autres
Publié: (2026)
par: Sathyanarayanan, Anish, et autres
Publié: (2026)
Evaluating Computational Accuracy of Large Language Models in Numerical Reasoning Tasks for Healthcare Applications
par: Malghan, Arjun R.
Publié: (2025)
par: Malghan, Arjun R.
Publié: (2025)
Strategically Linked Decisions in Long-Term Planning and Reinforcement Learning
par: Hüyük, Alihan, et autres
Publié: (2025)
par: Hüyük, Alihan, et autres
Publié: (2025)
Evaluating the Robustness of Analogical Reasoning in Large Language Models
par: Lewis, Martha, et autres
Publié: (2024)
par: Lewis, Martha, et autres
Publié: (2024)
Generative Evaluation of Complex Reasoning in Large Language Models
par: Lin, Haowei, et autres
Publié: (2025)
par: Lin, Haowei, et autres
Publié: (2025)
Elephants Never Forget: Memorization and Learning of Tabular Data in Large Language Models
par: Bordt, Sebastian, et autres
Publié: (2024)
par: Bordt, Sebastian, et autres
Publié: (2024)
How Causal Abstraction Underpins Computational Explanation
par: Geiger, Atticus, et autres
Publié: (2025)
par: Geiger, Atticus, et autres
Publié: (2025)
Causality for Large Language Models
par: Wu, Anpeng, et autres
Publié: (2024)
par: Wu, Anpeng, et autres
Publié: (2024)
Graph-of-Causal Evolution: Challenging Chain-of-Model for Reasoning
par: Wang, Libo
Publié: (2025)
par: Wang, Libo
Publié: (2025)
BeyondBench: Contamination-Resistant Evaluation of Reasoning in Language Models
par: Srivastava, Gaurav, et autres
Publié: (2025)
par: Srivastava, Gaurav, et autres
Publié: (2025)
Evaluating the Limits of Large Language Models in Multilingual Legal Reasoning
par: Ioannou, Antreas, et autres
Publié: (2025)
par: Ioannou, Antreas, et autres
Publié: (2025)
A Meta-Learning Perspective on Transformers for Causal Language Modeling
par: Wu, Xinbo, et autres
Publié: (2023)
par: Wu, Xinbo, et autres
Publié: (2023)
DISPO: Enhancing Training Efficiency and Stability in Reinforcement Learning for Large Language Model Mathematical Reasoning
par: Karaman, Batuhan K., et autres
Publié: (2026)
par: Karaman, Batuhan K., et autres
Publié: (2026)
DyVal: Dynamic Evaluation of Large Language Models for Reasoning Tasks
par: Zhu, Kaijie, et autres
Publié: (2023)
par: Zhu, Kaijie, et autres
Publié: (2023)
Does Reasoning Emerge? Examining the Probabilities of Causation in Large Language Models
par: González, Javier, et autres
Publié: (2024)
par: González, Javier, et autres
Publié: (2024)
Better Think Thrice: Learning to Reason Causally with Double Counterfactual Consistency
par: Lin, Victoria, et autres
Publié: (2026)
par: Lin, Victoria, et autres
Publié: (2026)
Evaluating Interventional Reasoning Capabilities of Large Language Models
par: Kasetty, Tejas, et autres
Publié: (2024)
par: Kasetty, Tejas, et autres
Publié: (2024)
AdapThink: Adaptive Thinking Preferences for Reasoning Language Model
par: Wan, Xu, et autres
Publié: (2025)
par: Wan, Xu, et autres
Publié: (2025)
Non-Markovian Discrete Diffusion with Causal Language Models
par: Zhang, Yangtian, et autres
Publié: (2025)
par: Zhang, Yangtian, et autres
Publié: (2025)
Memorize and Rank: Elevating Large Language Models for Clinical Diagnosis Prediction
par: Ma, Mingyu Derek, et autres
Publié: (2025)
par: Ma, Mingyu Derek, et autres
Publié: (2025)
Causal Inference for Human-Language Model Collaboration
par: Zhang, Bohan, et autres
Publié: (2024)
par: Zhang, Bohan, et autres
Publié: (2024)
LLM4Causal: Democratized Causal Tools for Everyone via Large Language Model
par: Jiang, Haitao, et autres
Publié: (2023)
par: Jiang, Haitao, et autres
Publié: (2023)
Synergy-of-Thoughts: Eliciting Efficient Reasoning in Hybrid Language Models
par: Shang, Yu, et autres
Publié: (2024)
par: Shang, Yu, et autres
Publié: (2024)
Do Large Language Models Show Biases in Causal Learning?
par: Carro, Maria Victoria, et autres
Publié: (2024)
par: Carro, Maria Victoria, et autres
Publié: (2024)
Probing the Decision Boundaries of In-context Learning in Large Language Models
par: Zhao, Siyan, et autres
Publié: (2024)
par: Zhao, Siyan, et autres
Publié: (2024)
G-Loss: Graph-Guided Fine-Tuning of Language Models
par: Sharma, Aditya, et autres
Publié: (2026)
par: Sharma, Aditya, et autres
Publié: (2026)
Evaluating Mathematical Reasoning of Large Language Models: A Focus on Error Identification and Correction
par: Li, Xiaoyuan, et autres
Publié: (2024)
par: Li, Xiaoyuan, et autres
Publié: (2024)
Documents similaires
-
Reasoning Elicitation in Language Models via Counterfactual Feedback
par: Hüyük, Alihan, et autres
Publié: (2024) -
CausalARC: Abstract Reasoning with Causal World Models
par: Maasch, Jacqueline, et autres
Publié: (2025) -
Query-Dependent Prompt Evaluation and Optimization with Offline Inverse RL
par: Sun, Hao, et autres
Publié: (2023) -
When is Off-Policy Evaluation (Reward Modeling) Useful in Contextual Bandits? A Data-Centric Perspective
par: Sun, Hao, et autres
Publié: (2023) -
Defining Expertise: Applications to Treatment Effect Estimation
par: Hüyük, Alihan, et autres
Publié: (2024)