4DWorldBench: A Comprehensive Evaluation Framework for 3D/4D World Generation Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lu, Yiting, Luo, Wei, Tu, Peiyan, Li, Haoran, Zhu, Hanxin, Yu, Zihao, Wang, Xingrui, Chen, Xinyi, Peng, Xinge, Li, Xin, Chen, Zhibo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Embody4D: A Generalist 4D World Model for Embodied AI
par: Tu, Peiyan, et autres
Publié: (2026)
par: Tu, Peiyan, et autres
Publié: (2026)
Sonic4D: Spatial Audio Generation for Immersive 4D Scene Exploration
par: Xie, Siyi, et autres
Publié: (2025)
par: Xie, Siyi, et autres
Publié: (2025)
GTA: Advancing Image-to-3D World Generation via Geometry Then Appearance Video Diffusion
par: Zhu, Hanxin, et autres
Publié: (2026)
par: Zhu, Hanxin, et autres
Publié: (2026)
IQA-Spider: Unifying Multi-Granularity Image Quality Assessment with Reasoning, Grounding and Referring
par: Peng, Xinge, et autres
Publié: (2026)
par: Peng, Xinge, et autres
Publié: (2026)
GSemSplat: Generalizable Semantic 3D Gaussian Splatting from Uncalibrated Image Pairs
par: Wang, Xingrui, et autres
Publié: (2024)
par: Wang, Xingrui, et autres
Publié: (2024)
P-4DGS: Predictive 4D Gaussian Splatting with 90$\times$ Compression
par: Wang, Henan, et autres
Publié: (2025)
par: Wang, Henan, et autres
Publié: (2025)
AR4D: Autoregressive 4D Generation from Monocular Videos
par: Zhu, Hanxin, et autres
Publié: (2025)
par: Zhu, Hanxin, et autres
Publié: (2025)
TIV-Diffusion: Towards Object-Centric Movement for Text-driven Image to Video Generation
par: Wang, Xingrui, et autres
Publié: (2024)
par: Wang, Xingrui, et autres
Publié: (2024)
CoNo: Consistency Noise Injection for Tuning-free Long Video Diffusion
par: Wang, Xingrui, et autres
Publié: (2024)
par: Wang, Xingrui, et autres
Publié: (2024)
GaussianSR: 3D Gaussian Super-Resolution with 2D Diffusion Priors
par: Yu, Xiqian, et autres
Publié: (2024)
par: Yu, Xiqian, et autres
Publié: (2024)
Video Quality Assessment Based on Swin TransformerV2 and Coarse to Fine Strategy
par: Yu, Zihao, et autres
Publié: (2024)
par: Yu, Zihao, et autres
Publié: (2024)
InternVQA: Advancing Compressed Video Quality Assessment with Distilling Large Foundation Model
par: Guan, Fengbin, et autres
Publié: (2025)
par: Guan, Fengbin, et autres
Publié: (2025)
QMamba: On First Exploration of Vision Mamba for Image Quality Assessment
par: Guan, Fengbin, et autres
Publié: (2024)
par: Guan, Fengbin, et autres
Publié: (2024)
SeD: Semantic-Aware Discriminator for Image Super-Resolution
par: Li, Bingchen, et autres
Publié: (2024)
par: Li, Bingchen, et autres
Publié: (2024)
LossAgent: Towards Any Optimization Objectives for Image Processing with LLM Agents
par: Li, Bingchen, et autres
Publié: (2024)
par: Li, Bingchen, et autres
Publié: (2024)
Hybrid Agents for Image Restoration
par: Li, Bingchen, et autres
Publié: (2025)
par: Li, Bingchen, et autres
Publié: (2025)
Is Vanilla MLP in Neural Radiance Field Enough for Few-shot View Synthesis?
par: Zhu, Hanxin, et autres
Publié: (2024)
par: Zhu, Hanxin, et autres
Publié: (2024)
CMC: Few-shot Novel View Synthesis via Cross-view Multiplane Consistency
par: Zhu, Hanxin, et autres
Publié: (2024)
par: Zhu, Hanxin, et autres
Publié: (2024)
Light Field Compression Based on Implicit Neural Representation
par: Wang, Henan, et autres
Publié: (2024)
par: Wang, Henan, et autres
Publié: (2024)
UCIP: A Universal Framework for Compressed Image Super-Resolution using Dynamic Prompt
par: Li, Xin, et autres
Publié: (2024)
par: Li, Xin, et autres
Publié: (2024)
Diffusion Models for Image Restoration and Enhancement: A Comprehensive Survey
par: Li, Xin, et autres
Publié: (2023)
par: Li, Xin, et autres
Publié: (2023)
Unified 4D World Action Modeling from Video Priors with Asynchronous Denoising
par: Guo, Jun, et autres
Publié: (2026)
par: Guo, Jun, et autres
Publié: (2026)
Compositional 3D-aware Video Generation with LLM Director
par: Zhu, Hanxin, et autres
Publié: (2024)
par: Zhu, Hanxin, et autres
Publié: (2024)
Avatar4D: Synthesizing Domain-Specific 4D Humans for Real-World Pose Estimation
par: Bright, Jerrin, et autres
Publié: (2025)
par: Bright, Jerrin, et autres
Publié: (2025)
Priorformer: A UGC-VQA Method with content and distortion priors
par: Pei, Yajing, et autres
Publié: (2024)
par: Pei, Yajing, et autres
Publié: (2024)
LoViF 2026 The First Challenge on Holistic Quality Assessment for 4D World Model (PhyScore)
par: Luo, Wei, et autres
Publié: (2026)
par: Luo, Wei, et autres
Publié: (2026)
Dynamic Boronate Ester Chemistry Facilitating 3D Printing Interlayer Adhesion and Modular 4D Printing of Polylactic Acid
par: Wenjun Peng, et autres
Publié: (2025)
par: Wenjun Peng, et autres
Publié: (2025)
OrthoPhys: Physically Plausible Video Generation with Orthogonal-View Geometry Guidance
par: Wang, Cong, et autres
Publié: (2026)
par: Wang, Cong, et autres
Publié: (2026)
Instant4D: 4D Gaussian Splatting in Minutes
par: Luo, Zhanpeng, et autres
Publié: (2025)
par: Luo, Zhanpeng, et autres
Publié: (2025)
OmniQuality-R: Advancing Reward Models Through All-Encompassing Quality Assessment
par: Lu, Yiting, et autres
Publié: (2025)
par: Lu, Yiting, et autres
Publié: (2025)
Q-Adapt: Adapting LMM for Visual Quality Assessment with Progressive Instruction Tuning
par: Lu, Yiting, et autres
Publié: (2025)
par: Lu, Yiting, et autres
Publié: (2025)
CoCo4D: Comprehensive and Complex 4D Scene Generation
par: Zhou, Junwei, et autres
Publié: (2025)
par: Zhou, Junwei, et autres
Publié: (2025)
DiffCap-Bench: A Comprehensive, Challenging, Robust Benchmark for Image Difference Captioning
par: Wei, Yuancheng, et autres
Publié: (2026)
par: Wei, Yuancheng, et autres
Publié: (2026)
End-to-End Rate-Distortion Optimized 3D Gaussian Representation
par: Wang, Henan, et autres
Publié: (2024)
par: Wang, Henan, et autres
Publié: (2024)
Spatial4D-Bench: A Versatile 4D Spatial Intelligence Benchmark
par: Wang, Pan, et autres
Publié: (2025)
par: Wang, Pan, et autres
Publié: (2025)
Fusion4CA: Boosting 3D Object Detection via Comprehensive Image Exploitation
par: Luo, Kang, et autres
Publié: (2026)
par: Luo, Kang, et autres
Publié: (2026)
MemBench: Towards More Comprehensive Evaluation on the Memory of LLM-based Agents
par: Tan, Haoran, et autres
Publié: (2025)
par: Tan, Haoran, et autres
Publié: (2025)
Style4D-Bench: A Benchmark Suite for 4D Stylization
par: Chen, Beiqi, et autres
Publié: (2025)
par: Chen, Beiqi, et autres
Publié: (2025)
3D4D: An Interactive, Editable, 4D World Model via 3D Video Generation
par: He, Yunhong, et autres
Publié: (2025)
par: He, Yunhong, et autres
Publié: (2025)
Bench4Merge: A Comprehensive Benchmark for Merging in Realistic Dense Traffic with Micro-Interactive Vehicles
par: Wang, Zhengming, et autres
Publié: (2024)
par: Wang, Zhengming, et autres
Publié: (2024)
Documents similaires
-
Embody4D: A Generalist 4D World Model for Embodied AI
par: Tu, Peiyan, et autres
Publié: (2026) -
Sonic4D: Spatial Audio Generation for Immersive 4D Scene Exploration
par: Xie, Siyi, et autres
Publié: (2025) -
GTA: Advancing Image-to-3D World Generation via Geometry Then Appearance Video Diffusion
par: Zhu, Hanxin, et autres
Publié: (2026) -
IQA-Spider: Unifying Multi-Granularity Image Quality Assessment with Reasoning, Grounding and Referring
par: Peng, Xinge, et autres
Publié: (2026) -
GSemSplat: Generalizable Semantic 3D Gaussian Splatting from Uncalibrated Image Pairs
par: Wang, Xingrui, et autres
Publié: (2024)