CAUSAL3D: A Comprehensive Benchmark for Causal Learning from Visual Data
Fuente:
arXiv
Saved in:
| Main Authors: | Liu, Disheng, Qiao, Yiran, Liu, Wuche, Lu, Yiren, Zhou, Yunlai, Liang, Tuo, Yin, Yu, Ma, Jing |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
BARD-GS: Blur-Aware Reconstruction of Dynamic Scenes via Gaussian Splatting
by: Lu, Yiren, et al.
Published: (2025)
by: Lu, Yiren, et al.
Published: (2025)
Structured 3D Latents Are Surprisingly Powerful: Unleashing Generalizable Style with 2D Diffusion
by: Qiao, Yiran, et al.
Published: (2026)
by: Qiao, Yiran, et al.
Published: (2026)
Counterfactual Visual Explanation via Causally-Guided Adversarial Steering
by: Qiao, Yiran, et al.
Published: (2025)
by: Qiao, Yiran, et al.
Published: (2025)
Segment then Splat: Unified 3D Open-Vocabulary Segmentation via Gaussian Splatting
by: Lu, Yiren, et al.
Published: (2025)
by: Lu, Yiren, et al.
Published: (2025)
When 'YES' Meets 'BUT': Can Large Models Comprehend Contradictory Humor Through Comparative Reasoning?
by: Liang, Tuo, et al.
Published: (2025)
by: Liang, Tuo, et al.
Published: (2025)
GSMem: 3D Gaussian Splatting as Persistent Spatial Memory for Zero-Shot Embodied Exploration and Reasoning
by: Lu, Yiren, et al.
Published: (2026)
by: Lu, Yiren, et al.
Published: (2026)
Cracking the Code of Juxtaposition: Can AI Models Understand the Humorous Contradictions
by: Hu, Zhe, et al.
Published: (2024)
by: Hu, Zhe, et al.
Published: (2024)
DefenseSplat: Enhancing the Robustness of 3D Gaussian Splatting via Frequency-Aware Filtering
by: Qiao, Yiran, et al.
Published: (2026)
by: Qiao, Yiran, et al.
Published: (2026)
AdvSplat: Adversarial Attacks on Feed-Forward Gaussian Splatting Models
by: Qiao, Yiran, et al.
Published: (2026)
by: Qiao, Yiran, et al.
Published: (2026)
View-consistent Object Removal in Radiance Fields
by: Lu, Yiren, et al.
Published: (2024)
by: Lu, Yiren, et al.
Published: (2024)
Unlocking the Latent Canvas: Eliciting and Benchmarking Symbolic Visual Expression in LLMs
by: Zheng, Yiren, et al.
Published: (2026)
by: Zheng, Yiren, et al.
Published: (2026)
Reconstruction Matters: Learning Geometry-Aligned BEV Representation through 3D Gaussian Splatting
by: Lu, Yiren, et al.
Published: (2026)
by: Lu, Yiren, et al.
Published: (2026)
Learning 1D Causal Visual Representation with De-focus Attention Networks
by: Tao, Chenxin, et al.
Published: (2024)
by: Tao, Chenxin, et al.
Published: (2024)
MP5: A Multi-modal Open-ended Embodied System in Minecraft via Active Perception
by: Qin, Yiran, et al.
Published: (2023)
by: Qin, Yiran, et al.
Published: (2023)
Certified Causal Defense with Generalizable Robustness
by: Qiao, Yiran, et al.
Published: (2024)
by: Qiao, Yiran, et al.
Published: (2024)
MineDreamer: Learning to Follow Instructions via Chain-of-Imagination for Simulated-World Control
by: Zhou, Enshen, et al.
Published: (2024)
by: Zhou, Enshen, et al.
Published: (2024)
RelationAdapter: Learning and Transferring Visual Relation with Diffusion Transformers
by: Gong, Yan, et al.
Published: (2025)
by: Gong, Yan, et al.
Published: (2025)
OmniConsistency: Learning Style-Agnostic Consistency from Paired Stylization Data
by: Song, Yiren, et al.
Published: (2025)
by: Song, Yiren, et al.
Published: (2025)
OccLoff: Learning Optimized Feature Fusion for 3D Occupancy Prediction
by: Zhang, Ji, et al.
Published: (2024)
by: Zhang, Ji, et al.
Published: (2024)
3DSRBench: A Comprehensive 3D Spatial Reasoning Benchmark
by: Ma, Wufei, et al.
Published: (2024)
by: Ma, Wufei, et al.
Published: (2024)
DiffSim: Taming Diffusion Models for Evaluating Visual Similarity
by: Song, Yiren, et al.
Published: (2024)
by: Song, Yiren, et al.
Published: (2024)
Fix False Transparency by Noise Guided Splatting
by: Hakie, Aly El, et al.
Published: (2025)
by: Hakie, Aly El, et al.
Published: (2025)
Story3D-Agent: Exploring 3D Storytelling Visualization with Large Language Models
by: Huang, Yuzhou, et al.
Published: (2024)
by: Huang, Yuzhou, et al.
Published: (2024)
CausalGS: Learning Physical Causality of 3D Dynamic Scenes with Gaussian Representations
by: Lu, Nengbo, et al.
Published: (2026)
by: Lu, Nengbo, et al.
Published: (2026)
SurveillanceVQA-589K: A Benchmark for Comprehensive Surveillance Video-Language Understanding with Large Models
by: Liu, Bo, et al.
Published: (2025)
by: Liu, Bo, et al.
Published: (2025)
3DGen-Bench: Comprehensive Benchmark Suite for 3D Generative Models
by: Zhang, Yuhan, et al.
Published: (2025)
by: Zhang, Yuhan, et al.
Published: (2025)
A Comprehensive Survey of Data Augmentation in Visual Reinforcement Learning
by: Ma, Guozheng, et al.
Published: (2022)
by: Ma, Guozheng, et al.
Published: (2022)
Saliency-Bench: A Comprehensive Benchmark for Evaluating Visual Explanations
by: Zhang, Yifei, et al.
Published: (2023)
by: Zhang, Yifei, et al.
Published: (2023)
Seeing 3D Through 2D Lenses: 3D Few-Shot Class-Incremental Learning via Cross-Modal Geometric Rectification
by: Xiang, Tuo, et al.
Published: (2025)
by: Xiang, Tuo, et al.
Published: (2025)
M$^3$-VQA: A Benchmark for Multimodal, Multi-Entity, Multi-Hop Visual Question Answering
by: Ma, Jiatong, et al.
Published: (2026)
by: Ma, Jiatong, et al.
Published: (2026)
Epsilon: Exploring Comprehensive Visual-Semantic Projection for Multi-Label Zero-Shot Learning
by: Liu, Ziming, et al.
Published: (2024)
by: Liu, Ziming, et al.
Published: (2024)
Visual-RAG: Benchmarking Text-to-Image Retrieval Augmented Generation for Visual Knowledge Intensive Queries
by: Wu, Yin, et al.
Published: (2025)
by: Wu, Yin, et al.
Published: (2025)
Shape2Scene: 3D Scene Representation Learning Through Pre-training on Shape Data
by: Feng, Tuo, et al.
Published: (2024)
by: Feng, Tuo, et al.
Published: (2024)
End to End Face Reconstruction via Differentiable PnP
by: Lu, Yiren, et al.
Published: (2024)
by: Lu, Yiren, et al.
Published: (2024)
A Comprehensive Survey on Deep Learning Solutions for 3D Flood Mapping
by: Jia, Wenfeng, et al.
Published: (2025)
by: Jia, Wenfeng, et al.
Published: (2025)
Benchmarking and Analyzing Generative Data for Visual Recognition
by: Li, Bo, et al.
Published: (2023)
by: Li, Bo, et al.
Published: (2023)
CausalCLIP: Causally-Informed Feature Disentanglement and Filtering for Generalizable Detection of Generated Images
by: Liu, Bo, et al.
Published: (2025)
by: Liu, Bo, et al.
Published: (2025)
Deep Learning for Event-based Vision: A Comprehensive Survey and Benchmarks
by: Zheng, Xu, et al.
Published: (2023)
by: Zheng, Xu, et al.
Published: (2023)
LSK3DNet: Towards Effective and Efficient 3D Perception with Large Sparse Kernels
by: Feng, Tuo, et al.
Published: (2024)
by: Feng, Tuo, et al.
Published: (2024)
OccFusion: Depth Estimation Free Multi-sensor Fusion for 3D Occupancy Prediction
by: Zhang, Ji, et al.
Published: (2024)
by: Zhang, Ji, et al.
Published: (2024)
Similar Items
-
BARD-GS: Blur-Aware Reconstruction of Dynamic Scenes via Gaussian Splatting
by: Lu, Yiren, et al.
Published: (2025) -
Structured 3D Latents Are Surprisingly Powerful: Unleashing Generalizable Style with 2D Diffusion
by: Qiao, Yiran, et al.
Published: (2026) -
Counterfactual Visual Explanation via Causally-Guided Adversarial Steering
by: Qiao, Yiran, et al.
Published: (2025) -
Segment then Splat: Unified 3D Open-Vocabulary Segmentation via Gaussian Splatting
by: Lu, Yiren, et al.
Published: (2025) -
When 'YES' Meets 'BUT': Can Large Models Comprehend Contradictory Humor Through Comparative Reasoning?
by: Liang, Tuo, et al.
Published: (2025)