From Gameplay Traces to Game Mechanics: Causal Induction with Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiwatode, Mohit, Dockhorn, Alexander, Rosenhahn, Bodo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Interpretable Decision-Making for End-to-End Autonomous Driving
por: Mirzaie, Mona, et al.
Publicado: (2025)
por: Mirzaie, Mona, et al.
Publicado: (2025)
Pixels to Play: A Foundation Model for 3D Gameplay
por: Yue, Yuguang, et al.
Publicado: (2025)
por: Yue, Yuguang, et al.
Publicado: (2025)
QPM: Discrete Optimization for Globally Interpretable Image Classification
por: Norrenbrock, Thomas, et al.
Publicado: (2025)
por: Norrenbrock, Thomas, et al.
Publicado: (2025)
Multi-Flow: Multi-View-Enriched Normalizing Flows for Industrial Anomaly Detection
por: Kruse, Mathis, et al.
Publicado: (2025)
por: Kruse, Mathis, et al.
Publicado: (2025)
Circuit Tracing in Vision-Language Models: Understanding the Internal Mechanisms of Multimodal Thinking
por: Yang, Jingcheng, et al.
Publicado: (2026)
por: Yang, Jingcheng, et al.
Publicado: (2026)
Causal Decoding for Hallucination-Resistant Multimodal Large Language Models
por: Tan, Shiwei, et al.
Publicado: (2026)
por: Tan, Shiwei, et al.
Publicado: (2026)
Online Optimization of Curriculum Learning Schedules using Evolutionary Optimization
por: Jiwatode, Mohit, et al.
Publicado: (2024)
por: Jiwatode, Mohit, et al.
Publicado: (2024)
Q-SENN: Quantized Self-Explaining Neural Networks
por: Norrenbrock, Thomas, et al.
Publicado: (2023)
por: Norrenbrock, Thomas, et al.
Publicado: (2023)
DINO-QPM: Adapting Visual Foundation Models for Globally Interpretable Image Classification
por: Zimmermann, Robert, et al.
Publicado: (2026)
por: Zimmermann, Robert, et al.
Publicado: (2026)
Rephrase, Augment, Reason: Visual Grounding of Questions for Vision-Language Models
por: Prasad, Archiki, et al.
Publicado: (2023)
por: Prasad, Archiki, et al.
Publicado: (2023)
ECoFLaP: Efficient Coarse-to-Fine Layer-Wise Pruning for Vision-Language Models
por: Sung, Yi-Lin, et al.
Publicado: (2023)
por: Sung, Yi-Lin, et al.
Publicado: (2023)
Perceptual Quality-based Model Training under Annotator Label Uncertainty
por: Zhou, Chen, et al.
Publicado: (2024)
por: Zhou, Chen, et al.
Publicado: (2024)
SplatPose & Detect: Pose-Agnostic 3D Anomaly Detection
por: Kruse, Mathis, et al.
Publicado: (2024)
por: Kruse, Mathis, et al.
Publicado: (2024)
Contrastive Region Guidance: Improving Grounding in Vision-Language Models without Training
por: Wan, David, et al.
Publicado: (2024)
por: Wan, David, et al.
Publicado: (2024)
Who Brings the Frisbee: Probing Hidden Hallucination Factors in Large Vision-Language Model via Causality Analysis
por: Huang, Po-Hsuan, et al.
Publicado: (2024)
por: Huang, Po-Hsuan, et al.
Publicado: (2024)
Exposing and Addressing Cross-Task Inconsistency in Unified Vision-Language Models
por: Maharana, Adyasha, et al.
Publicado: (2023)
por: Maharana, Adyasha, et al.
Publicado: (2023)
Ctrl-Adapter: An Efficient and Versatile Framework for Adapting Diverse Controls to Any Diffusion Model
por: Lin, Han, et al.
Publicado: (2024)
por: Lin, Han, et al.
Publicado: (2024)
Leveraging Foundation Models for Causal Generative Modeling
por: Komanduri, Aneesh, et al.
Publicado: (2026)
por: Komanduri, Aneesh, et al.
Publicado: (2026)
From Theory to Decision Rule: Calibrating the Noisy-Label Crossover for Vision-Language Model Weak Supervision Across Three Medical-Imaging Benchmarks
por: Xu, Bruce Changlong, et al.
Publicado: (2026)
por: Xu, Bruce Changlong, et al.
Publicado: (2026)
Counterfactual Gradients-based Quantification of Prediction Trust in Neural Networks
por: Prabhushankar, Mohit, et al.
Publicado: (2024)
por: Prabhushankar, Mohit, et al.
Publicado: (2024)
Mementos: A Comprehensive Benchmark for Multimodal Large Language Model Reasoning over Image Sequences
por: Wang, Xiyao, et al.
Publicado: (2024)
por: Wang, Xiyao, et al.
Publicado: (2024)
Causality-Driven Audits of Model Robustness
por: Drenkow, Nathan, et al.
Publicado: (2024)
por: Drenkow, Nathan, et al.
Publicado: (2024)
Where Reliability Lives in Vision-Language Models: A Mechanistic Study of Attention, Hidden States, and Causal Circuits
por: Mann, Logan, et al.
Publicado: (2026)
por: Mann, Logan, et al.
Publicado: (2026)
Parallel In-context Learning for Large Vision Language Models
por: Yamaguchi, Shin'ya, et al.
Publicado: (2026)
por: Yamaguchi, Shin'ya, et al.
Publicado: (2026)
PAVE: Patching and Adapting Video Large Language Models
por: Liu, Zhuoming, et al.
Publicado: (2025)
por: Liu, Zhuoming, et al.
Publicado: (2025)
Visual Hallucinations of Multi-modal Large Language Models
por: Huang, Wen, et al.
Publicado: (2024)
por: Huang, Wen, et al.
Publicado: (2024)
Effectiveness Assessment of Recent Large Vision-Language Models
por: Jiang, Yao, et al.
Publicado: (2024)
por: Jiang, Yao, et al.
Publicado: (2024)
Exploring Perceptual Limitation of Multimodal Large Language Models
por: Zhang, Jiarui, et al.
Publicado: (2024)
por: Zhang, Jiarui, et al.
Publicado: (2024)
Programmatic Video Prediction Using Large Language Models
por: Tang, Hao, et al.
Publicado: (2025)
por: Tang, Hao, et al.
Publicado: (2025)
Learning to Inference Adaptively for Multimodal Large Language Models
por: Xu, Zhuoyan, et al.
Publicado: (2025)
por: Xu, Zhuoyan, et al.
Publicado: (2025)
Diffusion Models Are Real-Time Game Engines
por: Valevski, Dani, et al.
Publicado: (2024)
por: Valevski, Dani, et al.
Publicado: (2024)
A Multimodal Architecture for Endpoint Position Prediction in Team-based Multiplayer Games
por: Peche, Jonas, et al.
Publicado: (2025)
por: Peche, Jonas, et al.
Publicado: (2025)
Exploring the Transferability of Visual Prompting for Multimodal Large Language Models
por: Zhang, Yichi, et al.
Publicado: (2024)
por: Zhang, Yichi, et al.
Publicado: (2024)
Diagnosing and Mitigating Modality Interference in Multimodal Large Language Models
por: Cai, Rui, et al.
Publicado: (2025)
por: Cai, Rui, et al.
Publicado: (2025)
Representing Online Handwriting for Recognition in Large Vision-Language Models
por: Fadeeva, Anastasiia, et al.
Publicado: (2024)
por: Fadeeva, Anastasiia, et al.
Publicado: (2024)
Rethinking Post-Unlearning Behavior of Large Vision-Language Models
por: Kim, Minsung, et al.
Publicado: (2025)
por: Kim, Minsung, et al.
Publicado: (2025)
Semi-Supervised Learning for Deep Causal Generative Models
por: Ibrahim, Yasin, et al.
Publicado: (2024)
por: Ibrahim, Yasin, et al.
Publicado: (2024)
Learning Truncated Causal History Model for Video Restoration
por: Ghasemabadi, Amirhosein, et al.
Publicado: (2024)
por: Ghasemabadi, Amirhosein, et al.
Publicado: (2024)
CLEFT: Language-Image Contrastive Learning with Efficient Large Language Model and Prompt Fine-Tuning
por: Du, Yuexi, et al.
Publicado: (2024)
por: Du, Yuexi, et al.
Publicado: (2024)
From Images to Signals: Are Large Vision Models Useful for Time Series Analysis?
por: Zhao, Ziming, et al.
Publicado: (2025)
por: Zhao, Ziming, et al.
Publicado: (2025)
Ejemplares similares
-
Interpretable Decision-Making for End-to-End Autonomous Driving
por: Mirzaie, Mona, et al.
Publicado: (2025) -
Pixels to Play: A Foundation Model for 3D Gameplay
por: Yue, Yuguang, et al.
Publicado: (2025) -
QPM: Discrete Optimization for Globally Interpretable Image Classification
por: Norrenbrock, Thomas, et al.
Publicado: (2025) -
Multi-Flow: Multi-View-Enriched Normalizing Flows for Industrial Anomaly Detection
por: Kruse, Mathis, et al.
Publicado: (2025) -
Circuit Tracing in Vision-Language Models: Understanding the Internal Mechanisms of Multimodal Thinking
por: Yang, Jingcheng, et al.
Publicado: (2026)