CausalBench: A Comprehensive Benchmark for Causal Learning Capability of LLMs
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhou, Yu, Wu, Xingyu, Huang, Beicheng, Wu, Jibin, Feng, Liang, Tan, Kay Chen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Introducing CausalBench: A Flexible Benchmark Framework for Causal Analysis and Machine Learning
por: Kapkiç, Ahmet, et al.
Publicado: (2024)
por: Kapkiç, Ahmet, et al.
Publicado: (2024)
LLM Cannot Discover Causality, and Should Be Restricted to Non-Decisional Support in Causal Discovery
por: Wu, Xingyu, et al.
Publicado: (2025)
por: Wu, Xingyu, et al.
Publicado: (2025)
HM3: Hierarchical Multi-Objective Model Merging for Pretrained Models
por: Zhou, Yu, et al.
Publicado: (2024)
por: Zhou, Yu, et al.
Publicado: (2024)
Large Language Model-Enhanced Algorithm Selection: Towards Comprehensive Algorithm Representation
por: Wu, Xingyu, et al.
Publicado: (2023)
por: Wu, Xingyu, et al.
Publicado: (2023)
The CausalBench challenge: A machine learning contest for gene network inference from single-cell perturbation data
por: Chevalley, Mathieu, et al.
Publicado: (2023)
por: Chevalley, Mathieu, et al.
Publicado: (2023)
Unlock the Power of Algorithm Features: A Generalization Analysis for Algorithm Selection
por: Wu, Xingyu, et al.
Publicado: (2024)
por: Wu, Xingyu, et al.
Publicado: (2024)
Diversity-Aware Policy Optimization for Large Language Model Reasoning
por: Yao, Jian, et al.
Publicado: (2025)
por: Yao, Jian, et al.
Publicado: (2025)
Learning Causally Disentangled Representations via the Principle of Independent Causal Mechanisms
por: Komanduri, Aneesh, et al.
Publicado: (2023)
por: Komanduri, Aneesh, et al.
Publicado: (2023)
Fine-Grained Model Merging via Modular Expert Recombination
por: Qiu, Haiyun, et al.
Publicado: (2026)
por: Qiu, Haiyun, et al.
Publicado: (2026)
PRL-Bench: A Comprehensive Benchmark Evaluating LLMs' Capabilities in Frontier Physics Research
por: Miao, Tingjia, et al.
Publicado: (2026)
por: Miao, Tingjia, et al.
Publicado: (2026)
Improve ROI with Causal Learning and Conformal Prediction
por: Ai, Meng, et al.
Publicado: (2024)
por: Ai, Meng, et al.
Publicado: (2024)
CAUSAL3D: A Comprehensive Benchmark for Causal Learning from Visual Data
por: Liu, Disheng, et al.
Publicado: (2025)
por: Liu, Disheng, et al.
Publicado: (2025)
CURLS: Causal Rule Learning for Subgroups with Significant Treatment Effect
por: Zhou, Jiehui, et al.
Publicado: (2024)
por: Zhou, Jiehui, et al.
Publicado: (2024)
Design Principle Transfer in Neural Architecture Search via Large Language Models
por: Zhou, Xun, et al.
Publicado: (2024)
por: Zhou, Xun, et al.
Publicado: (2024)
From Identifiable Causal Representations to Controllable Counterfactual Generation: A Survey on Causal Generative Modeling
por: Komanduri, Aneesh, et al.
Publicado: (2023)
por: Komanduri, Aneesh, et al.
Publicado: (2023)
Scaling Supervised Local Learning with Augmented Auxiliary Networks
por: Ma, Chenxiang, et al.
Publicado: (2024)
por: Ma, Chenxiang, et al.
Publicado: (2024)
Towards Adaptive Continual Model Merging via Manifold-Aware Expert Evolution
por: Qiu, Haiyun, et al.
Publicado: (2026)
por: Qiu, Haiyun, et al.
Publicado: (2026)
AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation
por: Wang, Lu, et al.
Publicado: (2025)
por: Wang, Lu, et al.
Publicado: (2025)
BackdoorBench: A Comprehensive Benchmark and Analysis of Backdoor Learning
por: Wu, Baoyuan, et al.
Publicado: (2024)
por: Wu, Baoyuan, et al.
Publicado: (2024)
Exploring the True Potential: Evaluating the Black-box Optimization Capability of Large Language Models
por: Huang, Beichen, et al.
Publicado: (2024)
por: Huang, Beichen, et al.
Publicado: (2024)
Confounded Causal Imitation Learning with Instrumental Variables
por: Zeng, Yan, et al.
Publicado: (2025)
por: Zeng, Yan, et al.
Publicado: (2025)
CausalVLBench: Benchmarking Visual Causal Reasoning in Large Vision-Language Models
por: Komanduri, Aneesh, et al.
Publicado: (2025)
por: Komanduri, Aneesh, et al.
Publicado: (2025)
CausalVerse: Benchmarking Causal Representation Learning with Configurable High-Fidelity Simulations
por: Chen, Guangyi, et al.
Publicado: (2025)
por: Chen, Guangyi, et al.
Publicado: (2025)
How Multimodal Integration Boost the Performance of LLM for Optimization: Case Study on Capacitated Vehicle Routing Problems
por: Huang, Yuxiao, et al.
Publicado: (2024)
por: Huang, Yuxiao, et al.
Publicado: (2024)
DPrivBench: Benchmarking LLMs' Reasoning for Differential Privacy
por: Wang, Erchi, et al.
Publicado: (2026)
por: Wang, Erchi, et al.
Publicado: (2026)
Graph Disentangle Causal Model: Enhancing Causal Inference in Networked Observational Data
por: Hu, Binbin, et al.
Publicado: (2024)
por: Hu, Binbin, et al.
Publicado: (2024)
IGL-Bench: Establishing the Comprehensive Benchmark for Imbalanced Graph Learning
por: Qin, Jiawen, et al.
Publicado: (2024)
por: Qin, Jiawen, et al.
Publicado: (2024)
Realizing LLMs' Causal Potential Requires Science-Grounded, Novel Benchmarks
por: Srivastava, Ashutosh, et al.
Publicado: (2025)
por: Srivastava, Ashutosh, et al.
Publicado: (2025)
DHG-Bench: A Comprehensive Benchmark for Deep Hypergraph Learning
por: Li, Fan, et al.
Publicado: (2025)
por: Li, Fan, et al.
Publicado: (2025)
Learning by Doing: An Online Causal Reinforcement Learning Framework with Causal-Aware Policy
por: Cai, Ruichu, et al.
Publicado: (2024)
por: Cai, Ruichu, et al.
Publicado: (2024)
Coarse-to-Fine Learning of Dynamic Causal Structures
por: Yang, Dezhi, et al.
Publicado: (2026)
por: Yang, Dezhi, et al.
Publicado: (2026)
OSS-Bench: Benchmark Generator for Coding LLMs
por: Jiang, Yuancheng, et al.
Publicado: (2025)
por: Jiang, Yuancheng, et al.
Publicado: (2025)
Causal Process Models: Reframing Dynamic Causal Graph Discovery as a Reinforcement Learning Problem
por: Orujlu, Turan, et al.
Publicado: (2025)
por: Orujlu, Turan, et al.
Publicado: (2025)
Executable Counterfactuals: Improving LLMs' Causal Reasoning Through Code
por: Vashishtha, Aniket, et al.
Publicado: (2025)
por: Vashishtha, Aniket, et al.
Publicado: (2025)
Estimating Heterogeneous Causal Effect on Networks via Orthogonal Learning
por: Wu, Yuanchen, et al.
Publicado: (2025)
por: Wu, Yuanchen, et al.
Publicado: (2025)
LabSafety Bench: Benchmarking LLMs on Safety Issues in Scientific Labs
por: Zhou, Yujun, et al.
Publicado: (2024)
por: Zhou, Yujun, et al.
Publicado: (2024)
CausalProfiler: Generating Synthetic Benchmarks for Rigorous and Transparent Evaluation of Causal Machine Learning
por: Panayiotou, Panayiotis, et al.
Publicado: (2025)
por: Panayiotou, Panayiotis, et al.
Publicado: (2025)
CausalCompass: Evaluating the Robustness of Time-Series Causal Discovery in Misspecified Scenarios
por: Yi, Huiyang, et al.
Publicado: (2026)
por: Yi, Huiyang, et al.
Publicado: (2026)
Local Causal Structure Learning in the Presence of Latent Variables
por: Xie, Feng, et al.
Publicado: (2024)
por: Xie, Feng, et al.
Publicado: (2024)
CausalChaos! Dataset for Comprehensive Causal Action Question Answering Over Longer Causal Chains Grounded in Dynamic Visual Scenes
por: Parmar, Paritosh, et al.
Publicado: (2024)
por: Parmar, Paritosh, et al.
Publicado: (2024)
Ejemplares similares
-
Introducing CausalBench: A Flexible Benchmark Framework for Causal Analysis and Machine Learning
por: Kapkiç, Ahmet, et al.
Publicado: (2024) -
LLM Cannot Discover Causality, and Should Be Restricted to Non-Decisional Support in Causal Discovery
por: Wu, Xingyu, et al.
Publicado: (2025) -
HM3: Hierarchical Multi-Objective Model Merging for Pretrained Models
por: Zhou, Yu, et al.
Publicado: (2024) -
Large Language Model-Enhanced Algorithm Selection: Towards Comprehensive Algorithm Representation
por: Wu, Xingyu, et al.
Publicado: (2023) -
The CausalBench challenge: A machine learning contest for gene network inference from single-cell perturbation data
por: Chevalley, Mathieu, et al.
Publicado: (2023)