WorldModelBench: Judging Video Generation Models As World Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Dacheng, Fang, Yunhao, Chen, Yukang, Yang, Shuo, Cao, Shiyi, Wong, Justin, Luo, Michael, Wang, Xiaolong, Yin, Hongxu, Gonzalez, Joseph E., Stoica, Ion, Han, Song, Lu, Yao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
K-Search: LLM Kernel Generation via Co-Evolving Intrinsic World Model
par: Cao, Shiyi, et autres
Publié: (2026)
par: Cao, Shiyi, et autres
Publié: (2026)
Fairness in Serving Large Language Models
par: Sheng, Ying, et autres
Publié: (2023)
par: Sheng, Ying, et autres
Publié: (2023)
OR-Bench: An Over-Refusal Benchmark for Large Language Models
par: Cui, Justin, et autres
Publié: (2024)
par: Cui, Justin, et autres
Publié: (2024)
WorldBench: Disambiguating Physics for Diagnostic Evaluation of World Models
par: Upadhyay, Rishi, et autres
Publié: (2026)
par: Upadhyay, Rishi, et autres
Publié: (2026)
LongVILA: Scaling Long-Context Visual Language Models for Long Videos
par: Chen, Yukang, et autres
Publié: (2024)
par: Chen, Yukang, et autres
Publié: (2024)
WorldMark: A Unified Benchmark Suite for Interactive Video World Models
par: Xu, Xiaojie, et autres
Publié: (2026)
par: Xu, Xiaojie, et autres
Publié: (2026)
WorldSimBench: Towards Video Generation Models as World Simulators
par: Qin, Yiran, et autres
Publié: (2024)
par: Qin, Yiran, et autres
Publié: (2024)
Stylus: Automatic Adapter Selection for Diffusion Models
par: Luo, Michael, et autres
Publié: (2024)
par: Luo, Michael, et autres
Publié: (2024)
JudgeBench: A Benchmark for Evaluating LLM-based Judges
par: Tan, Sijun, et autres
Publié: (2024)
par: Tan, Sijun, et autres
Publié: (2024)
VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation
par: Wu, Yecheng, et autres
Publié: (2024)
par: Wu, Yecheng, et autres
Publié: (2024)
3D Aware Region Prompted Vision Language Model
par: Cheng, An-Chieh, et autres
Publié: (2025)
par: Cheng, An-Chieh, et autres
Publié: (2025)
S*: Test Time Scaling for Code Generation
par: Li, Dacheng, et autres
Publié: (2025)
par: Li, Dacheng, et autres
Publié: (2025)
NEO: Saving GPU Memory Crisis with CPU Offloading for Online LLM Inference
par: Jiang, Xuanlin, et autres
Publié: (2024)
par: Jiang, Xuanlin, et autres
Publié: (2024)
Wukong's 72 Transformations: High-fidelity Textured 3D Morphing via Flow Models
par: Yin, Minghao, et autres
Publié: (2025)
par: Yin, Minghao, et autres
Publié: (2025)
EgoVLA: Learning Vision-Language-Action Models from Egocentric Human Videos
par: Yang, Ruihan, et autres
Publié: (2025)
par: Yang, Ruihan, et autres
Publié: (2025)
NVILA: Efficient Frontier Visual Language Models
par: Liu, Zhijian, et autres
Publié: (2024)
par: Liu, Zhijian, et autres
Publié: (2024)
A New World Framework: The Three Realms and Six Layers Model
par: Zhou, Dacheng
Publié: (2024)
par: Zhou, Dacheng
Publié: (2024)
Some Present-Day Problems of Romanian Library Science
par: Stoica, Ion
Publié: (1973)
par: Stoica, Ion
Publié: (1973)
The Central University Library, Bucharest. Over Seventy-five Years in the History of a Collection
par: Stoica, Ion
Publié: (1972)
par: Stoica, Ion
Publié: (1972)
CtrlAttack: A Unified Attack on World-Model Control in Diffusion Models
par: Xu, Shuhan, et autres
Publié: (2026)
par: Xu, Shuhan, et autres
Publié: (2026)
RedunCut: Measurement-Driven Sampling and Accuracy Performance Modeling for Low-Cost Live Video Analytics
par: Sela, Gur-Eyal, et autres
Publié: (2025)
par: Sela, Gur-Eyal, et autres
Publié: (2025)
SGLang: Efficient Execution of Structured Language Model Programs
par: Zheng, Lianmin, et autres
Publié: (2023)
par: Zheng, Lianmin, et autres
Publié: (2023)
S-LoRA: Serving Thousands of Concurrent LoRA Adapters
par: Sheng, Ying, et autres
Publié: (2023)
par: Sheng, Ying, et autres
Publié: (2023)
Probabilistic Dreaming for World Models
par: Wong, Gavin
Publié: (2026)
par: Wong, Gavin
Publié: (2026)
Grounding Video Models to Actions through Goal Conditioned Exploration
par: Luo, Yunhao, et autres
Publié: (2024)
par: Luo, Yunhao, et autres
Publié: (2024)
M$^2$RNN: Non-Linear RNNs with Matrix-Valued States for Scalable Language Modeling
par: Mishra, Mayank, et autres
Publié: (2026)
par: Mishra, Mayank, et autres
Publié: (2026)
Interpreting Physics in Video World Models
par: Joseph, Sonia, et autres
Publié: (2026)
par: Joseph, Sonia, et autres
Publié: (2026)
A Survey on 3D Human Avatar Modeling -- From Reconstruction to Generation
par: Wang, Ruihe, et autres
Publié: (2024)
par: Wang, Ruihe, et autres
Publié: (2024)
Classical Many-Worlds Interpretation
par: Stoica, Ovidiu Cristinel
Publié: (2024)
par: Stoica, Ovidiu Cristinel
Publié: (2024)
TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times
par: Zhang, Jintao, et autres
Publié: (2025)
par: Zhang, Jintao, et autres
Publié: (2025)
Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity
par: Xi, Haocheng, et autres
Publié: (2025)
par: Xi, Haocheng, et autres
Publié: (2025)
Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile
par: Ding, Hangliang, et autres
Publié: (2025)
par: Ding, Hangliang, et autres
Publié: (2025)
RoboTrustBench: Benchmarking the Trustworthiness of Video World Models for Robotic Manipulation
par: Li, Huiqiong, et autres
Publié: (2026)
par: Li, Huiqiong, et autres
Publié: (2026)
EDIT-Bench: Evaluating LLM Abilities to Perform Real-World Instructed Code Edits
par: Chi, Wayne, et autres
Publié: (2025)
par: Chi, Wayne, et autres
Publié: (2025)
MPC-Minimized Secure LLM Inference
par: Rathee, Deevashwer, et autres
Publié: (2024)
par: Rathee, Deevashwer, et autres
Publié: (2024)
When World Models Dream Wrong: Physical-Conditioned Adversarial Attacks against World Models
par: Guo, Zhixiang, et autres
Publié: (2026)
par: Guo, Zhixiang, et autres
Publié: (2026)
MobileWorldBench: Towards Semantic World Modeling For Mobile Agents
par: Li, Shufan, et autres
Publié: (2025)
par: Li, Shufan, et autres
Publié: (2025)
PoseBench: Benchmarking the Robustness of Pose Estimation Models under Corruptions
par: Ma, Sihan, et autres
Publié: (2024)
par: Ma, Sihan, et autres
Publié: (2024)
TurtleBench: Evaluating Top Language Models via Real-World Yes/No Puzzles
par: Yu, Qingchen, et autres
Publié: (2024)
par: Yu, Qingchen, et autres
Publié: (2024)
Omni-WorldBench: Towards a Comprehensive Interaction-Centric Evaluation for World Models
par: Wu, Meiqi, et autres
Publié: (2026)
par: Wu, Meiqi, et autres
Publié: (2026)
Documents similaires
-
K-Search: LLM Kernel Generation via Co-Evolving Intrinsic World Model
par: Cao, Shiyi, et autres
Publié: (2026) -
Fairness in Serving Large Language Models
par: Sheng, Ying, et autres
Publié: (2023) -
OR-Bench: An Over-Refusal Benchmark for Large Language Models
par: Cui, Justin, et autres
Publié: (2024) -
WorldBench: Disambiguating Physics for Diagnostic Evaluation of World Models
par: Upadhyay, Rishi, et autres
Publié: (2026) -
LongVILA: Scaling Long-Context Visual Language Models for Long Videos
par: Chen, Yukang, et autres
Publié: (2024)