On the Eligibility of LLMs for Counterfactual Reasoning: A Decompositional Study
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Shuai, Yang, Qi, Tang, Luoxi, Meng, Yuqiao, Guo, Nancy, Blackburn, Jeremy, Xi, Zhaohan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Adversarial Network Imagination: Causal LLMs and Digital Twins for Proactive Telecom Mitigation
por: Sriram, Vignesh, et al.
Publicado: (2026)
por: Sriram, Vignesh, et al.
Publicado: (2026)
Smart Privacy Policy Assistant: An LLM-Powered System for Transparent and Actionable Privacy Notices
por: Kalvakuntla, Sriharshini, et al.
Publicado: (2026)
por: Kalvakuntla, Sriharshini, et al.
Publicado: (2026)
SafeGPT: Preventing Data Leakage and Unethical Outputs in Enterprise LLM Use
por: Desai, Pratyush, et al.
Publicado: (2026)
por: Desai, Pratyush, et al.
Publicado: (2026)
Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting
por: Meng, Yuqiao, et al.
Publicado: (2025)
por: Meng, Yuqiao, et al.
Publicado: (2025)
POLAR: Automating Cyber Threat Prioritization through LLM-Powered Assessment
por: Tang, Luoxi, et al.
Publicado: (2025)
por: Tang, Luoxi, et al.
Publicado: (2025)
RiskBridge: Turning CVEs into Business-Aligned Patch Priorities
por: Sheikh, Yelena Mujibur, et al.
Publicado: (2026)
por: Sheikh, Yelena Mujibur, et al.
Publicado: (2026)
Small Agent Group is the Future of Digital Health
por: Meng, Yuqiao, et al.
Publicado: (2026)
por: Meng, Yuqiao, et al.
Publicado: (2026)
Uncovering Vulnerabilities of LLM-Assisted Cyber Threat Intelligence
por: Meng, Yuqiao, et al.
Publicado: (2025)
por: Meng, Yuqiao, et al.
Publicado: (2025)
From Test-taking to Cognitive Scaffolding: A Pedagogical Diagnostic Benchmark for LLMs on English Standardized Tests
por: Tang, Luoxi, et al.
Publicado: (2025)
por: Tang, Luoxi, et al.
Publicado: (2025)
EquiMem: Calibrating Shared Memory in Multi-Agent Debate via Game-Theoretic Equilibrium
por: Meng, Yuqiao, et al.
Publicado: (2026)
por: Meng, Yuqiao, et al.
Publicado: (2026)
Data to Defense: The Role of Curation in Customizing LLMs Against Jailbreaking Attacks
por: Liu, Xiaoqun, et al.
Publicado: (2024)
por: Liu, Xiaoqun, et al.
Publicado: (2024)
The Trap of Trajectory: Towards Understanding and Mitigating Spurious Correlations in Agentic Memory
por: Tang, Luoxi, et al.
Publicado: (2026)
por: Tang, Luoxi, et al.
Publicado: (2026)
Schema-Grounded LLM Extraction for FHIR Patient Digital Twins
por: Brens, Rafael, et al.
Publicado: (2026)
por: Brens, Rafael, et al.
Publicado: (2026)
Improving Clinical Data Accessibility Through Automated FHIR Data Transformation Tools
por: Pawar, Adarsh, et al.
Publicado: (2026)
por: Pawar, Adarsh, et al.
Publicado: (2026)
The Value of Variance: Mitigating Debate Collapse in Multi-Agent Systems via Uncertainty-Driven Policy Optimization
por: Tang, Luoxi, et al.
Publicado: (2026)
por: Tang, Luoxi, et al.
Publicado: (2026)
Triplet-Structured Knowledge Integration for Multi-Turn Medical Reasoning
por: Meng, Zhaohan, et al.
Publicado: (2025)
por: Meng, Zhaohan, et al.
Publicado: (2025)
Counterfactual Language Reasoning for Explainable Recommendation Systems
por: Li, Guanrong, et al.
Publicado: (2025)
por: Li, Guanrong, et al.
Publicado: (2025)
Can LLMs Reconcile Knowledge Conflicts in Counterfactual Reasoning
por: Yamin, Khurram, et al.
Publicado: (2025)
por: Yamin, Khurram, et al.
Publicado: (2025)
MEDEQUALQA: Evaluating Biases in LLMs with Counterfactual Reasoning
por: Ghosh, Rajarshi, et al.
Publicado: (2025)
por: Ghosh, Rajarshi, et al.
Publicado: (2025)
LLMs for Generating and Evaluating Counterfactuals: A Comprehensive Study
por: Nguyen, Van Bach, et al.
Publicado: (2024)
por: Nguyen, Van Bach, et al.
Publicado: (2024)
Vision Language Models Can Parse Floor Plan Maps
por: DeFazio, David, et al.
Publicado: (2024)
por: DeFazio, David, et al.
Publicado: (2024)
The Zero-Step Thinking: An Empirical Study of Mode Selection as Harder Early Exit in Reasoning Models
por: Tan, Yuqiao, et al.
Publicado: (2025)
por: Tan, Yuqiao, et al.
Publicado: (2025)
Rethinking Reasoning: A Survey on Reasoning-based Backdoors in LLMs
por: Hu, Man, et al.
Publicado: (2025)
por: Hu, Man, et al.
Publicado: (2025)
Counterfactual Reasoning in Automated Planning
por: Pozanco, Alberto, et al.
Publicado: (2026)
por: Pozanco, Alberto, et al.
Publicado: (2026)
Proving Olympiad Inequalities by Synergizing LLMs and Symbolic Reasoning
por: Li, Zenan, et al.
Publicado: (2025)
por: Li, Zenan, et al.
Publicado: (2025)
InfiAlign: A Scalable and Sample-Efficient Framework for Aligning LLMs to Enhance Reasoning Capabilities
por: Cai, Shuo, et al.
Publicado: (2025)
por: Cai, Shuo, et al.
Publicado: (2025)
An Identifiable Cost-Aware Causal Decision-Making Framework Using Counterfactual Reasoning
por: Cai, Ruichu, et al.
Publicado: (2025)
por: Cai, Ruichu, et al.
Publicado: (2025)
A Decomposition Perspective to Long-context Reasoning for LLMs
por: Xiao, Yanling, et al.
Publicado: (2026)
por: Xiao, Yanling, et al.
Publicado: (2026)
Robustifying Safety-Aligned Large Language Models through Clean Data Curation
por: Liu, Xiaoqun, et al.
Publicado: (2024)
por: Liu, Xiaoqun, et al.
Publicado: (2024)
Aligning Deep Implicit Preferences by Learning to Reason Defensively
por: Li, Peiming, et al.
Publicado: (2025)
por: Li, Peiming, et al.
Publicado: (2025)
Certifying Counterfactual Bias in LLMs
por: Chaudhary, Isha, et al.
Publicado: (2024)
por: Chaudhary, Isha, et al.
Publicado: (2024)
POET: Protocol Optimization via Eligibility Tuning
por: Das, Trisha, et al.
Publicado: (2026)
por: Das, Trisha, et al.
Publicado: (2026)
ARCHE: A Novel Task to Evaluate LLMs on Latent Reasoning Chain Extraction
por: Li, Pengze, et al.
Publicado: (2025)
por: Li, Pengze, et al.
Publicado: (2025)
Learning Spatiotemporal Sensitivity in Video LLMs via Counterfactual Reinforcement Learning
por: Du, Dazhao, et al.
Publicado: (2026)
por: Du, Dazhao, et al.
Publicado: (2026)
Think before You Simulate: Symbolic Reasoning to Orchestrate Neural Computation for Counterfactual Question Answering
por: Ishay, Adam, et al.
Publicado: (2025)
por: Ishay, Adam, et al.
Publicado: (2025)
Does Using Counterfactual Help LLMs Explain Textual Importance in Classification?
por: Tan, Nelvin, et al.
Publicado: (2025)
por: Tan, Nelvin, et al.
Publicado: (2025)
DIANOIA: Diagnostic Decomposition and Joint Optimization for Multi-Agent Reasoning
por: Yang, Yiming, et al.
Publicado: (2026)
por: Yang, Yiming, et al.
Publicado: (2026)
Decoding Decision Reasoning: A Counterfactual-Powered Model for Knowledge Discovery
por: Fang, Yingying, et al.
Publicado: (2024)
por: Fang, Yingying, et al.
Publicado: (2024)
Do LLMs Build World Models From Text? A Multilingual Diagnostic of Spatial Reasoning
por: Pan, Zhikai, et al.
Publicado: (2026)
por: Pan, Zhikai, et al.
Publicado: (2026)
Stepwise Reasoning Error Disruption Attack of LLMs
por: Peng, Jingyu, et al.
Publicado: (2024)
por: Peng, Jingyu, et al.
Publicado: (2024)
Ejemplares similares
-
Adversarial Network Imagination: Causal LLMs and Digital Twins for Proactive Telecom Mitigation
por: Sriram, Vignesh, et al.
Publicado: (2026) -
Smart Privacy Policy Assistant: An LLM-Powered System for Transparent and Actionable Privacy Notices
por: Kalvakuntla, Sriharshini, et al.
Publicado: (2026) -
SafeGPT: Preventing Data Leakage and Unethical Outputs in Enterprise LLM Use
por: Desai, Pratyush, et al.
Publicado: (2026) -
Benchmarking LLM-Assisted Blue Teaming via Standardized Threat Hunting
por: Meng, Yuqiao, et al.
Publicado: (2025) -
POLAR: Automating Cyber Threat Prioritization through LLM-Powered Assessment
por: Tang, Luoxi, et al.
Publicado: (2025)