Causal Evaluation of Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chen, Sirui, Peng, Bo, Chen, Meiqi, Wang, Ruiqi, Xu, Mengying, Zeng, Xingyu, Zhao, Rui, Zhao, Shengjie, Qiao, Yu, Lu, Chaochao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
CLEAR: Can Language Models Really Understand Causal Graphs?
von: Chen, Sirui, et al.
Veröffentlicht: (2024)
von: Chen, Sirui, et al.
Veröffentlicht: (2024)
CauScientist: Teaching LLMs to Respect Data for Causal Discovery
von: Peng, Bo, et al.
Veröffentlicht: (2026)
von: Peng, Bo, et al.
Veröffentlicht: (2026)
Can Post-Training Transform LLMs into Causal Reasoners?
von: Chen, Junqi, et al.
Veröffentlicht: (2026)
von: Chen, Junqi, et al.
Veröffentlicht: (2026)
CauScale: Neural Causal Discovery at Scale
von: Peng, Bo, et al.
Veröffentlicht: (2026)
von: Peng, Bo, et al.
Veröffentlicht: (2026)
From Imitation to Introspection: Probing Self-Consciousness in Language Models
von: Chen, Sirui, et al.
Veröffentlicht: (2024)
von: Chen, Sirui, et al.
Veröffentlicht: (2024)
DEPO: Dual-Efficiency Preference Optimization for LLM Agents
von: Chen, Sirui, et al.
Veröffentlicht: (2025)
von: Chen, Sirui, et al.
Veröffentlicht: (2025)
Metacognition as Reward: Reinforcing LLM Reasoning via Knowledge and Regulation Signals
von: Chen, Sirui, et al.
Veröffentlicht: (2026)
von: Chen, Sirui, et al.
Veröffentlicht: (2026)
Enhancing Causal Reasoning in Large Language Models: A Causal Attribution Model for Precision Fine-Tuning
von: Cai, Hengrui, et al.
Veröffentlicht: (2023)
von: Cai, Hengrui, et al.
Veröffentlicht: (2023)
Beyond Surface Structure: A Causal Assessment of LLMs' Comprehension Ability
von: Han, Yujin, et al.
Veröffentlicht: (2024)
von: Han, Yujin, et al.
Veröffentlicht: (2024)
Synthesis by Design: Controlled Data Generation via Structural Guidance
von: Xu, Lei, et al.
Veröffentlicht: (2025)
von: Xu, Lei, et al.
Veröffentlicht: (2025)
Generalization of RLVR Using Causal Reasoning as a Testbed
von: Lu, Brian, et al.
Veröffentlicht: (2025)
von: Lu, Brian, et al.
Veröffentlicht: (2025)
Compositional Causal Reasoning Evaluation in Language Models
von: Maasch, Jacqueline R. M. A., et al.
Veröffentlicht: (2025)
von: Maasch, Jacqueline R. M. A., et al.
Veröffentlicht: (2025)
ARise: Towards Knowledge-Augmented Reasoning via Risk-Adaptive Search
von: Zhang, Yize, et al.
Veröffentlicht: (2025)
von: Zhang, Yize, et al.
Veröffentlicht: (2025)
Exploring Consciousness in LLMs: A Systematic Survey of Theories, Implementations, and Frontier Risks
von: Chen, Sirui, et al.
Veröffentlicht: (2025)
von: Chen, Sirui, et al.
Veröffentlicht: (2025)
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
von: Xu, Peng, et al.
Veröffentlicht: (2024)
von: Xu, Peng, et al.
Veröffentlicht: (2024)
ADAM: An Embodied Causal Agent in Open-World Environments
von: Yu, Shu, et al.
Veröffentlicht: (2024)
von: Yu, Shu, et al.
Veröffentlicht: (2024)
Integration of Large Language Models and Federated Learning
von: Chen, Chaochao, et al.
Veröffentlicht: (2023)
von: Chen, Chaochao, et al.
Veröffentlicht: (2023)
A Survey on Multimodal Large Language Models
von: Yin, Shukang, et al.
Veröffentlicht: (2023)
von: Yin, Shukang, et al.
Veröffentlicht: (2023)
DIDS: Domain Impact-aware Data Sampling for Large Language Model Training
von: Shi, Weijie, et al.
Veröffentlicht: (2025)
von: Shi, Weijie, et al.
Veröffentlicht: (2025)
A Neuro-inspired Interpretation of Unlearning in Large Language Models through Sample-level Unlearning Difficulty
von: Feng, Xiaohua, et al.
Veröffentlicht: (2025)
von: Feng, Xiaohua, et al.
Veröffentlicht: (2025)
PromptBench: A Unified Library for Evaluation of Large Language Models
von: Zhu, Kaijie, et al.
Veröffentlicht: (2023)
von: Zhu, Kaijie, et al.
Veröffentlicht: (2023)
Causality for Large Language Models
von: Wu, Anpeng, et al.
Veröffentlicht: (2024)
von: Wu, Anpeng, et al.
Veröffentlicht: (2024)
LLM4Causal: Democratized Causal Tools for Everyone via Large Language Model
von: Jiang, Haitao, et al.
Veröffentlicht: (2023)
von: Jiang, Haitao, et al.
Veröffentlicht: (2023)
Mitigating Hallucinations in Large Language Models via Causal Reasoning
von: Li, Yuangang, et al.
Veröffentlicht: (2025)
von: Li, Yuangang, et al.
Veröffentlicht: (2025)
CausalTAD: Injecting Causal Knowledge into Large Language Models for Tabular Anomaly Detection
von: Wang, Ruiqi, et al.
Veröffentlicht: (2026)
von: Wang, Ruiqi, et al.
Veröffentlicht: (2026)
Dynamic Evaluation of Large Language Models by Meta Probing Agents
von: Zhu, Kaijie, et al.
Veröffentlicht: (2024)
von: Zhu, Kaijie, et al.
Veröffentlicht: (2024)
NeSTR: A Neuro-Symbolic Abductive Framework for Temporal Reasoning in Large Language Models
von: Liang, Feng, et al.
Veröffentlicht: (2025)
von: Liang, Feng, et al.
Veröffentlicht: (2025)
Do Retrieval-Augmented Language Models Adapt to Varying User Needs?
von: Wu, Peilin, et al.
Veröffentlicht: (2025)
von: Wu, Peilin, et al.
Veröffentlicht: (2025)
Non-Markovian Discrete Diffusion with Causal Language Models
von: Zhang, Yangtian, et al.
Veröffentlicht: (2025)
von: Zhang, Yangtian, et al.
Veröffentlicht: (2025)
Systematic Outliers in Large Language Models
von: An, Yongqi, et al.
Veröffentlicht: (2025)
von: An, Yongqi, et al.
Veröffentlicht: (2025)
Exploring Multilingual Probing in Large Language Models: A Cross-Language Analysis
von: Li, Daoyang, et al.
Veröffentlicht: (2024)
von: Li, Daoyang, et al.
Veröffentlicht: (2024)
CLadder: Assessing Causal Reasoning in Language Models
von: Jin, Zhijing, et al.
Veröffentlicht: (2023)
von: Jin, Zhijing, et al.
Veröffentlicht: (2023)
Epistemic Traps: Rational Misalignment Driven by Model Misspecification
von: Xu, Xingcheng, et al.
Veröffentlicht: (2026)
von: Xu, Xingcheng, et al.
Veröffentlicht: (2026)
Unveiling Causal Reasoning in Large Language Models: Reality or Mirage?
von: Chi, Haoang, et al.
Veröffentlicht: (2025)
von: Chi, Haoang, et al.
Veröffentlicht: (2025)
Rethinking Data Mixing from the Perspective of Large Language Models
von: Xu, Yuanjian, et al.
Veröffentlicht: (2026)
von: Xu, Yuanjian, et al.
Veröffentlicht: (2026)
Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting
von: Chen, Wei, et al.
Veröffentlicht: (2025)
von: Chen, Wei, et al.
Veröffentlicht: (2025)
AECBench: A Hierarchical Benchmark for Knowledge Evaluation of Large Language Models in the AEC Field
von: Liang, Chen, et al.
Veröffentlicht: (2025)
von: Liang, Chen, et al.
Veröffentlicht: (2025)
Boosting Protein Language Models with Negative Sample Mining
von: Xu, Yaoyao, et al.
Veröffentlicht: (2024)
von: Xu, Yaoyao, et al.
Veröffentlicht: (2024)
Explaining Datasets in Words: Statistical Models with Natural Language Parameters
von: Zhong, Ruiqi, et al.
Veröffentlicht: (2024)
von: Zhong, Ruiqi, et al.
Veröffentlicht: (2024)
LORE: A Large Generative Model for Search Relevance
von: Lu, Chenji, et al.
Veröffentlicht: (2025)
von: Lu, Chenji, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
CLEAR: Can Language Models Really Understand Causal Graphs?
von: Chen, Sirui, et al.
Veröffentlicht: (2024) -
CauScientist: Teaching LLMs to Respect Data for Causal Discovery
von: Peng, Bo, et al.
Veröffentlicht: (2026) -
Can Post-Training Transform LLMs into Causal Reasoners?
von: Chen, Junqi, et al.
Veröffentlicht: (2026) -
CauScale: Neural Causal Discovery at Scale
von: Peng, Bo, et al.
Veröffentlicht: (2026) -
From Imitation to Introspection: Probing Self-Consciousness in Language Models
von: Chen, Sirui, et al.
Veröffentlicht: (2024)