MBench: A Comprehensive Benchmark on Memory Capability for Video World Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Shengjun, Zhang, Zhang, Huang, Simin, Tang, Zhenyu, Wang, Hanyang, Dai, Chensheng, Chen, Min, Li, Yifan, Li, Yuxin, Chen, Yingjie, Liu, Hao, Li, Chen, Duan, Yueqi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SurfelSplat: Learning Efficient and Generalizable Gaussian Surfel Representations for Sparse-View Surface Reconstruction
di: Dai, Chensheng, et al.
Pubblicazione: (2026)
di: Dai, Chensheng, et al.
Pubblicazione: (2026)
Learning Efficient and Generalizable Human Representation with Human Gaussian Model
di: Liu, Yifan, et al.
Pubblicazione: (2025)
di: Liu, Yifan, et al.
Pubblicazione: (2025)
E-GRPO: High Entropy Steps Drive Effective Reinforcement Learning for Flow Models
di: Zhang, Shengjun, et al.
Pubblicazione: (2026)
di: Zhang, Shengjun, et al.
Pubblicazione: (2026)
Scene Splatter: Momentum 3D Scene Generation from Single Image with Video Diffusion Model
di: Zhang, Shengjun, et al.
Pubblicazione: (2025)
di: Zhang, Shengjun, et al.
Pubblicazione: (2025)
Physics3D: Learning Physical Properties of 3D Gaussians via Video Diffusion
di: Liu, Fangfu, et al.
Pubblicazione: (2024)
di: Liu, Fangfu, et al.
Pubblicazione: (2024)
Revisiting 3D Reconstruction Kernels as Low-Pass Filters
di: Zhang, Shengjun, et al.
Pubblicazione: (2026)
di: Zhang, Shengjun, et al.
Pubblicazione: (2026)
GeoAuxNet: Towards Universal 3D Representation Learning for Multi-sensor Point Clouds
di: Zhang, Shengjun, et al.
Pubblicazione: (2024)
di: Zhang, Shengjun, et al.
Pubblicazione: (2024)
ToMBench: Benchmarking Theory of Mind in Large Language Models
di: Chen, Zhuang, et al.
Pubblicazione: (2024)
di: Chen, Zhuang, et al.
Pubblicazione: (2024)
VideoScene: Distilling Video Diffusion Model to Generate 3D Scenes in One Step
di: Wang, Hanyang, et al.
Pubblicazione: (2025)
di: Wang, Hanyang, et al.
Pubblicazione: (2025)
Video-T1: Test-Time Scaling for Video Generation
di: Liu, Fangfu, et al.
Pubblicazione: (2025)
di: Liu, Fangfu, et al.
Pubblicazione: (2025)
ORPP: Self-Optimizing Role-playing Prompts to Enhance Language Model Capabilities
di: Duan, Yifan, et al.
Pubblicazione: (2025)
di: Duan, Yifan, et al.
Pubblicazione: (2025)
T2MBench: A Benchmark for Out-of-Distribution Text-to-Motion Generation
di: Yang, Bin, et al.
Pubblicazione: (2026)
di: Yang, Bin, et al.
Pubblicazione: (2026)
LangScene-X: Reconstruct Generalizable 3D Language-Embedded Scenes with TriMap Video Diffusion
di: Liu, Fangfu, et al.
Pubblicazione: (2025)
di: Liu, Fangfu, et al.
Pubblicazione: (2025)
DEVAL: A Framework for Evaluating and Improving the Derivation Capability of Large Language Models
di: Li, Yifan, et al.
Pubblicazione: (2025)
di: Li, Yifan, et al.
Pubblicazione: (2025)
VideoAesBench: Benchmarking the Video Aesthetics Perception Capabilities of Large Multimodal Models
di: Li, Yunhao, et al.
Pubblicazione: (2026)
di: Li, Yunhao, et al.
Pubblicazione: (2026)
Gaussian Graph Network: Learning Efficient and Generalizable Gaussian Representations from Multi-view Images
di: Zhang, Shengjun, et al.
Pubblicazione: (2025)
di: Zhang, Shengjun, et al.
Pubblicazione: (2025)
Make-Your-3D: Fast and Consistent Subject-Driven 3D Content Generation
di: Liu, Fangfu, et al.
Pubblicazione: (2024)
di: Liu, Fangfu, et al.
Pubblicazione: (2024)
Dynamic Benchmarking of Reasoning Capabilities in Code Large Language Models Under Data Contamination
di: Chen, Simin, et al.
Pubblicazione: (2025)
di: Chen, Simin, et al.
Pubblicazione: (2025)
DecompileBench: A Comprehensive Benchmark for Evaluating Decompilers in Real-World Scenarios
di: Gao, Zeyu, et al.
Pubblicazione: (2025)
di: Gao, Zeyu, et al.
Pubblicazione: (2025)
ELABORATION: A Comprehensive Benchmark on Human-LLM Competitive Programming
di: Yang, Xinwei, et al.
Pubblicazione: (2025)
di: Yang, Xinwei, et al.
Pubblicazione: (2025)
GenWorld: Towards Detecting AI-generated Real-world Simulation Videos
di: Chen, Weiliang, et al.
Pubblicazione: (2025)
di: Chen, Weiliang, et al.
Pubblicazione: (2025)
OmniHuman: A Large-scale Dataset and Benchmark for Human-Centric Video Generation
di: Zhu, Lei, et al.
Pubblicazione: (2026)
di: Zhu, Lei, et al.
Pubblicazione: (2026)
PLANET: A Collection of Benchmarks for Evaluating LLMs' Planning Capabilities
di: Li, Haoming, et al.
Pubblicazione: (2025)
di: Li, Haoming, et al.
Pubblicazione: (2025)
Shell or Nothing: Real-World Benchmarks and Memory-Activated Agents for Automated Penetration Testing
di: Mai, Wuyuao, et al.
Pubblicazione: (2025)
di: Mai, Wuyuao, et al.
Pubblicazione: (2025)
EditBoard: Towards a Comprehensive Evaluation Benchmark for Text-Based Video Editing Models
di: Chen, Yupeng, et al.
Pubblicazione: (2024)
di: Chen, Yupeng, et al.
Pubblicazione: (2024)
ScenePainter: Semantically Consistent Perpetual 3D Scene Generation with Concept Relation Alignment
di: Xia, Chong, et al.
Pubblicazione: (2025)
di: Xia, Chong, et al.
Pubblicazione: (2025)
AMSbench: A Comprehensive Benchmark for Evaluating MLLM Capabilities in AMS Circuits
di: Shi, Yichen, et al.
Pubblicazione: (2025)
di: Shi, Yichen, et al.
Pubblicazione: (2025)
Foundation Models for Autonomous Driving Perception: A Survey Through Core Capabilities
di: Sathyam, Rajendramayavan, et al.
Pubblicazione: (2025)
di: Sathyam, Rajendramayavan, et al.
Pubblicazione: (2025)
VABench: A Comprehensive Benchmark for Audio-Video Generation
di: Hua, Daili, et al.
Pubblicazione: (2025)
di: Hua, Daili, et al.
Pubblicazione: (2025)
PRL-Bench: A Comprehensive Benchmark Evaluating LLMs' Capabilities in Frontier Physics Research
di: Miao, Tingjia, et al.
Pubblicazione: (2026)
di: Miao, Tingjia, et al.
Pubblicazione: (2026)
ReconX: Reconstruct Any Scene from Sparse Views with Video Diffusion Model
di: Liu, Fangfu, et al.
Pubblicazione: (2024)
di: Liu, Fangfu, et al.
Pubblicazione: (2024)
Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis
di: Fu, Chaoyou, et al.
Pubblicazione: (2024)
di: Fu, Chaoyou, et al.
Pubblicazione: (2024)
Q-Bench-Video: Benchmarking the Video Quality Understanding of LMMs
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
VideoVista: A Versatile Benchmark for Video Understanding and Reasoning
di: Li, Yunxin, et al.
Pubblicazione: (2024)
di: Li, Yunxin, et al.
Pubblicazione: (2024)
CAM: A Constructivist View of Agentic Memory for LLM-Based Reading Comprehension
di: Li, Rui, et al.
Pubblicazione: (2025)
di: Li, Rui, et al.
Pubblicazione: (2025)
RoboMemArena: A Comprehensive and Challenging Robotic Memory Benchmark
di: Lei, Huashuo, et al.
Pubblicazione: (2026)
di: Lei, Huashuo, et al.
Pubblicazione: (2026)
The Power of Personality: A Human Simulation Perspective to Investigate Large Language Model Agents
di: Duan, Yifan, et al.
Pubblicazione: (2025)
di: Duan, Yifan, et al.
Pubblicazione: (2025)
Uncovering What, Why and How: A Comprehensive Benchmark for Causation Understanding of Video Anomaly
di: Du, Hang, et al.
Pubblicazione: (2024)
di: Du, Hang, et al.
Pubblicazione: (2024)
Improved Adversarial Diffusion Compression for Real-World Video Super-Resolution
di: Chen, Bin, et al.
Pubblicazione: (2026)
di: Chen, Bin, et al.
Pubblicazione: (2026)
Memory-Anchored Multimodal Reasoning for Explainable Video Forensics
di: Chen, Chen, et al.
Pubblicazione: (2025)
di: Chen, Chen, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SurfelSplat: Learning Efficient and Generalizable Gaussian Surfel Representations for Sparse-View Surface Reconstruction
di: Dai, Chensheng, et al.
Pubblicazione: (2026) -
Learning Efficient and Generalizable Human Representation with Human Gaussian Model
di: Liu, Yifan, et al.
Pubblicazione: (2025) -
E-GRPO: High Entropy Steps Drive Effective Reinforcement Learning for Flow Models
di: Zhang, Shengjun, et al.
Pubblicazione: (2026) -
Scene Splatter: Momentum 3D Scene Generation from Single Image with Video Diffusion Model
di: Zhang, Shengjun, et al.
Pubblicazione: (2025) -
Physics3D: Learning Physical Properties of 3D Gaussians via Video Diffusion
di: Liu, Fangfu, et al.
Pubblicazione: (2024)