Bypassing the Rationale: Causal Auditing of Implicit Reasoning in Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Sathyanarayanan, Anish, Nagarsekar, Aditya, Rathore, Aarush |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
$\texttt{lrnnx}$: A library for Linear RNNs
por: Bania, Karan, et al.
Publicado: (2026)
por: Bania, Karan, et al.
Publicado: (2026)
GMLM: Bridging Graph Neural Networks and Language Models for Heterophilic Node Classification
por: Sinha, Aarush
Publicado: (2025)
por: Sinha, Aarush
Publicado: (2025)
Compositional Causal Reasoning Evaluation in Language Models
por: Maasch, Jacqueline R. M. A., et al.
Publicado: (2025)
por: Maasch, Jacqueline R. M. A., et al.
Publicado: (2025)
Languages are Modalities: Cross-Lingual Alignment via Encoder Injection
por: Agarwal, Rajan, et al.
Publicado: (2025)
por: Agarwal, Rajan, et al.
Publicado: (2025)
Causal Manifold Fairness: Enforcing Geometric Invariance in Representation Learning
por: Rathore, Vidhi
Publicado: (2026)
por: Rathore, Vidhi
Publicado: (2026)
RL for Reasoning by Adaptively Revealing Rationales
por: Amani, Mohammad Hossein, et al.
Publicado: (2025)
por: Amani, Mohammad Hossein, et al.
Publicado: (2025)
Rethinking Dimensional Rationale in Graph Contrastive Learning from Causal Perspective
por: Ji, Qirui, et al.
Publicado: (2023)
por: Ji, Qirui, et al.
Publicado: (2023)
CAMA: Enhancing Mathematical Reasoning in Large Language Models with Causal Knowledge
por: Zan, Lei, et al.
Publicado: (2025)
por: Zan, Lei, et al.
Publicado: (2025)
BlackBoxToBlueprint: Extracting Interpretable Logic from Legacy Systems using Reinforcement Learning and Counterfactual Analysis
por: Rathore, Vidhi
Publicado: (2025)
por: Rathore, Vidhi
Publicado: (2025)
CLadder: Assessing Causal Reasoning in Language Models
por: Jin, Zhijing, et al.
Publicado: (2023)
por: Jin, Zhijing, et al.
Publicado: (2023)
Structural Rationale Distillation via Reasoning Space Compression
por: Yang, Jialin, et al.
Publicado: (2026)
por: Yang, Jialin, et al.
Publicado: (2026)
Do Large Language Models Reason Causally Like Us? Even Better?
por: Dettki, Hanna M., et al.
Publicado: (2025)
por: Dettki, Hanna M., et al.
Publicado: (2025)
Discovering and Reasoning of Causality in the Hidden World with Large Language Models
por: Liu, Chenxi, et al.
Publicado: (2024)
por: Liu, Chenxi, et al.
Publicado: (2024)
Causality-Driven Audits of Model Robustness
por: Drenkow, Nathan, et al.
Publicado: (2024)
por: Drenkow, Nathan, et al.
Publicado: (2024)
Transferable Delay-Aware Reinforcement Learning via Implicit Causal Graph Modeling
por: Zhao, Chenran, et al.
Publicado: (2026)
por: Zhao, Chenran, et al.
Publicado: (2026)
Auditing Language Model Unlearning via Information Decomposition
por: Goel, Anmol, et al.
Publicado: (2026)
por: Goel, Anmol, et al.
Publicado: (2026)
CausalVLBench: Benchmarking Visual Causal Reasoning in Large Vision-Language Models
por: Komanduri, Aneesh, et al.
Publicado: (2025)
por: Komanduri, Aneesh, et al.
Publicado: (2025)
NoiseFormer -- Noise Diffused Symmetric Attention Transformer
por: Kumar, Phani, et al.
Publicado: (2026)
por: Kumar, Phani, et al.
Publicado: (2026)
Linear Transformers Implicitly Discover Unified Numerical Algorithms
por: Lutz, Patrick, et al.
Publicado: (2025)
por: Lutz, Patrick, et al.
Publicado: (2025)
Unveiling Causal Reasoning in Large Language Models: Reality or Mirage?
por: Chi, Haoang, et al.
Publicado: (2025)
por: Chi, Haoang, et al.
Publicado: (2025)
Mitigating Hallucinations in Large Language Models via Causal Reasoning
por: Li, Yuangang, et al.
Publicado: (2025)
por: Li, Yuangang, et al.
Publicado: (2025)
Implicit Language Models are RNNs: Balancing Parallelization and Expressivity
por: Schöne, Mark, et al.
Publicado: (2025)
por: Schöne, Mark, et al.
Publicado: (2025)
Privacy Auditing of Large Language Models
por: Panda, Ashwinee, et al.
Publicado: (2025)
por: Panda, Ashwinee, et al.
Publicado: (2025)
Reasoning Elicitation in Language Models via Counterfactual Feedback
por: Hüyük, Alihan, et al.
Publicado: (2024)
por: Hüyük, Alihan, et al.
Publicado: (2024)
CausalARC: Abstract Reasoning with Causal World Models
por: Maasch, Jacqueline, et al.
Publicado: (2025)
por: Maasch, Jacqueline, et al.
Publicado: (2025)
Towards Interpretable Hate Speech Detection using Large Language Model-extracted Rationales
por: Nirmal, Ayushi, et al.
Publicado: (2024)
por: Nirmal, Ayushi, et al.
Publicado: (2024)
Auditing Reasoning-Trace Memorization Claims after Unlearning with Head-Conditioned Canaries
por: Li, Yanhang, et al.
Publicado: (2026)
por: Li, Yanhang, et al.
Publicado: (2026)
Enhancing Causal Reasoning in Large Language Models: A Causal Attribution Model for Precision Fine-Tuning
por: Cai, Hengrui, et al.
Publicado: (2023)
por: Cai, Hengrui, et al.
Publicado: (2023)
Self-Training Meets Consistency: Improving LLMs' Reasoning with Consistency-Driven Rationale Evaluation
por: Lee, Jaehyeok, et al.
Publicado: (2024)
por: Lee, Jaehyeok, et al.
Publicado: (2024)
TEPI: Taxonomy-aware Embedding and Pseudo-Imaging for Scarcely-labeled Zero-shot Genome Classification
por: Aakur, Sathyanarayanan, et al.
Publicado: (2024)
por: Aakur, Sathyanarayanan, et al.
Publicado: (2024)
Revealing Multimodal Causality with Large Language Models
por: Li, Jin, et al.
Publicado: (2025)
por: Li, Jin, et al.
Publicado: (2025)
CausalTAD: Injecting Causal Knowledge into Large Language Models for Tabular Anomaly Detection
por: Wang, Ruiqi, et al.
Publicado: (2026)
por: Wang, Ruiqi, et al.
Publicado: (2026)
A Single Neuron Is Sufficient to Bypass Safety Alignment in Large Language Models
por: Kazemi, Hamid, et al.
Publicado: (2026)
por: Kazemi, Hamid, et al.
Publicado: (2026)
Identity Bridge: Enabling Implicit Reasoning via Shared Latent Memory
por: Lin, Pengxiao, et al.
Publicado: (2025)
por: Lin, Pengxiao, et al.
Publicado: (2025)
From Implicit Exploration to Structured Reasoning: Leveraging Guideline and Refinement for LLMs
por: Chen, Jiaxiang, et al.
Publicado: (2025)
por: Chen, Jiaxiang, et al.
Publicado: (2025)
TimeMKG: Knowledge-Infused Causal Reasoning for Multivariate Time Series Modeling
por: Sun, Yifei, et al.
Publicado: (2025)
por: Sun, Yifei, et al.
Publicado: (2025)
CARE: Turning LLMs Into Causal Reasoning Expert
por: Dong, Juncheng, et al.
Publicado: (2025)
por: Dong, Juncheng, et al.
Publicado: (2025)
The Extrapolation Power of Implicit Models
por: Decugis, Juliette, et al.
Publicado: (2024)
por: Decugis, Juliette, et al.
Publicado: (2024)
Native Reasoning Models: Training Language Models to Reason on Unverifiable Data
por: Wang, Yuanfu, et al.
Publicado: (2026)
por: Wang, Yuanfu, et al.
Publicado: (2026)
Language Agents Meet Causality -- Bridging LLMs and Causal World Models
por: Gkountouras, John, et al.
Publicado: (2024)
por: Gkountouras, John, et al.
Publicado: (2024)
Ejemplares similares
-
$\texttt{lrnnx}$: A library for Linear RNNs
por: Bania, Karan, et al.
Publicado: (2026) -
GMLM: Bridging Graph Neural Networks and Language Models for Heterophilic Node Classification
por: Sinha, Aarush
Publicado: (2025) -
Compositional Causal Reasoning Evaluation in Language Models
por: Maasch, Jacqueline R. M. A., et al.
Publicado: (2025) -
Languages are Modalities: Cross-Lingual Alignment via Encoder Injection
por: Agarwal, Rajan, et al.
Publicado: (2025) -
Causal Manifold Fairness: Enforcing Geometric Invariance in Representation Learning
por: Rathore, Vidhi
Publicado: (2026)