ExpliCa: Evaluating Explicit Causal Reasoning in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Miliani, Martina, Auriemma, Serena, Bondielli, Alessandro, Chersoni, Emmanuele, Passaro, Lucia, Sucameli, Irene, Lenci, Alessandro |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Prompting Encoder Models for Zero-Shot Classification: A Cross-Domain Study in Italian
par: Auriemma, Serena, et autres
Publié: (2024)
par: Auriemma, Serena, et autres
Publié: (2024)
Charting a Decade of Computational Linguistics in Italy: The CLiC-it Corpus
par: Alzetta, Chiara, et autres
Publié: (2025)
par: Alzetta, Chiara, et autres
Publié: (2025)
Rethinking the Multilingual Reasoning Gap with Layer Swap
par: Lasbordes, Maxence, et autres
Publié: (2026)
par: Lasbordes, Maxence, et autres
Publié: (2026)
CLMN: Concept based Language Models via Neural Symbolic Reasoning
par: Yang, Yibo
Publié: (2025)
par: Yang, Yibo
Publié: (2025)
When Does Content-Based Routing Work? Representation Requirements for Selective Attention in Hybrid Sequence Models
par: Basu, Abhinaba
Publié: (2026)
par: Basu, Abhinaba
Publié: (2026)
MedMemoryBench: Benchmarking Agent Memory in Personalized Healthcare
par: Wang, Yihao, et autres
Publié: (2026)
par: Wang, Yihao, et autres
Publié: (2026)
NOTAI.AI: Explainable Detection of Machine-Generated Text via Curvature and Feature Attribution
par: Breneur, Oleksandr Marchenko, et autres
Publié: (2026)
par: Breneur, Oleksandr Marchenko, et autres
Publié: (2026)
Harnessing non-adversarial robustness in large language models
par: Zhou, Qinghua, et autres
Publié: (2026)
par: Zhou, Qinghua, et autres
Publié: (2026)
Context Aware Lemmatization and Morphological Tagging Method in Turkish
par: Sayallar, Cagri
Publié: (2025)
par: Sayallar, Cagri
Publié: (2025)
MetaCheckGPT -- A Multi-task Hallucination Detector Using LLM Uncertainty and Meta-models
par: Mehta, Rahul, et autres
Publié: (2024)
par: Mehta, Rahul, et autres
Publié: (2024)
Cache-to-Cache: Direct Semantic Communication Between Large Language Models
par: Fu, Tianyu, et autres
Publié: (2025)
par: Fu, Tianyu, et autres
Publié: (2025)
The GPT-4o Shock Emotional Attachment to AI Models and Its Impact on Regulatory Acceptance: A Cross-Cultural Analysis of the Immediate Transition from GPT-4o to GPT-5
par: Naito, Hiroki
Publié: (2025)
par: Naito, Hiroki
Publié: (2025)
JAM: Controllable and Responsible Text Generation via Causal Reasoning and Latent Vector Manipulation
par: Huang, Yingbing, et autres
Publié: (2025)
par: Huang, Yingbing, et autres
Publié: (2025)
Causal Dimensionality of Transformer Representations: Measurement, Scaling, and Layer Structure
par: Sarkar, Nilesh, et autres
Publié: (2026)
par: Sarkar, Nilesh, et autres
Publié: (2026)
ProactBench: Beyond What The User Asked For
par: Harfi, Sepehr, et autres
Publié: (2026)
par: Harfi, Sepehr, et autres
Publié: (2026)
Mechanistic Analysis of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning
par: Imanov, Olaf Yunus Laitinen
Publié: (2026)
par: Imanov, Olaf Yunus Laitinen
Publié: (2026)
Latent Object Permanence: Topological Phase Transitions, Free-Energy Principles, and Renormalization Group Flows in Deep Transformer Manifolds
par: Alpay, Faruk, et autres
Publié: (2026)
par: Alpay, Faruk, et autres
Publié: (2026)
Inference acceleration for large language models using "stairs" assisted greedy generation
par: Grigaliūnas, Domas, et autres
Publié: (2024)
par: Grigaliūnas, Domas, et autres
Publié: (2024)
Strategic Doctrine Language Models (sdLM): A Learning-System Framework for Doctrinal Consistency and Geopolitical Forecasting
par: Imanov, Olaf Yunus Laitinen, et autres
Publié: (2026)
par: Imanov, Olaf Yunus Laitinen, et autres
Publié: (2026)
How Pruning Reshapes Features: Sparse Autoencoder Analysis of Weight-Pruned Language Models
par: Borobia, Hector, et autres
Publié: (2026)
par: Borobia, Hector, et autres
Publié: (2026)
AIPsy-Affect: A Keyword-Free Clinical Stimulus Battery for Mechanistic Interpretability of Emotion in Language Models
par: Keeman, Michael
Publié: (2026)
par: Keeman, Michael
Publié: (2026)
The Concept Allocation Zone: Tracking How Concepts Form Across Transformer Depth
par: Henry, James
Publié: (2026)
par: Henry, James
Publié: (2026)
Large Language Models Report Subjective Experience Under Self-Referential Processing
par: Berg, Cameron, et autres
Publié: (2025)
par: Berg, Cameron, et autres
Publié: (2025)
Product-of-Experts Training Reduces Dataset Artifacts in Natural Language Inference
par: Mathew, Aby Mammen
Publié: (2026)
par: Mathew, Aby Mammen
Publié: (2026)
Do Reasoning Models Enhance Embedding Models?
par: Chan, Wun Yu, et autres
Publié: (2026)
par: Chan, Wun Yu, et autres
Publié: (2026)
A Survey on Collaborating Small and Large Language Models for Performance, Cost-effectiveness, Cloud-edge Privacy, and Trustworthiness
par: Wang, Fali, et autres
Publié: (2025)
par: Wang, Fali, et autres
Publié: (2025)
Approaching I/O-optimality for Approximate Attention
par: Papp, Pál András, et autres
Publié: (2026)
par: Papp, Pál András, et autres
Publié: (2026)
PennyCoder: Efficient Domain-Specific LLMs for PennyLane-Based Quantum Code Generation
par: Basit, Abdul, et autres
Publié: (2025)
par: Basit, Abdul, et autres
Publié: (2025)
Vis-CoT: A Human-in-the-Loop Framework for Interactive Visualization and Intervention in LLM Chain-of-Thought Reasoning
par: Pather, Kaviraj, et autres
Publié: (2025)
par: Pather, Kaviraj, et autres
Publié: (2025)
$δ$-STEAL: LLM Stealing Attack with Local Differential Privacy
par: Dang, Kieu, et autres
Publié: (2025)
par: Dang, Kieu, et autres
Publié: (2025)
SAGE: Sign-Adaptive Gradient for Memory-Efficient LLM Optimization
par: Lee, Wooin, et autres
Publié: (2026)
par: Lee, Wooin, et autres
Publié: (2026)
Multi-Agent Synergy-Driven Iterative Visual Narrative Synthesis
par: Xi, Wang, et autres
Publié: (2025)
par: Xi, Wang, et autres
Publié: (2025)
TableMoE: Neuro-Symbolic Routing for Structured Expert Reasoning in Multimodal Table Understanding
par: Zhang, Junwen, et autres
Publié: (2025)
par: Zhang, Junwen, et autres
Publié: (2025)
SafeAnchor: Preventing Cumulative Safety Erosion in Continual Domain Adaptation of Large Language Models
par: Guo, Dongxin, et autres
Publié: (2026)
par: Guo, Dongxin, et autres
Publié: (2026)
TowerVision: Understanding and Improving Multilinguality in Vision-Language Models
par: Viveiros, André G., et autres
Publié: (2025)
par: Viveiros, André G., et autres
Publié: (2025)
Reference-Guided Verdict: LLMs-as-Judges in Automatic Evaluation of Free-Form QA
par: Badshah, Sher, et autres
Publié: (2024)
par: Badshah, Sher, et autres
Publié: (2024)
Unpacking Hateful Memes: Presupposed Context and False Claims
par: Cai, Weibin, et autres
Publié: (2025)
par: Cai, Weibin, et autres
Publié: (2025)
mHC-SSM: Manifold-Constrained Hyper-Connections for State Space Language Models with Stream-Specialized Adapters
par: Mutlu, Abdulvahap, et autres
Publié: (2026)
par: Mutlu, Abdulvahap, et autres
Publié: (2026)
Extracting Sentence Embeddings from Pretrained Transformer Models
par: Stankevičius, Lukas, et autres
Publié: (2024)
par: Stankevičius, Lukas, et autres
Publié: (2024)
Sentiment Analysis of Lithuanian Online Reviews Using Large Language Models
par: Vileikytė, Brigita, et autres
Publié: (2024)
par: Vileikytė, Brigita, et autres
Publié: (2024)
Documents similaires
-
Prompting Encoder Models for Zero-Shot Classification: A Cross-Domain Study in Italian
par: Auriemma, Serena, et autres
Publié: (2024) -
Charting a Decade of Computational Linguistics in Italy: The CLiC-it Corpus
par: Alzetta, Chiara, et autres
Publié: (2025) -
Rethinking the Multilingual Reasoning Gap with Layer Swap
par: Lasbordes, Maxence, et autres
Publié: (2026) -
CLMN: Concept based Language Models via Neural Symbolic Reasoning
par: Yang, Yibo
Publié: (2025) -
When Does Content-Based Routing Work? Representation Requirements for Selective Attention in Hybrid Sequence Models
par: Basu, Abhinaba
Publié: (2026)