WildWorld: A Large-Scale Dataset for Dynamic World Modeling with Actions and Explicit State toward Generative ARPG
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Zhen, Meng, Zian, Shi, Shuwei, Peng, Wenshuo, Wu, Yuwei, Zheng, Bo, Li, Chuanhao, Zhang, Kaipeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Yume: An Interactive World Generation Model
di: Mao, Xiaofeng, et al.
Pubblicazione: (2025)
di: Mao, Xiaofeng, et al.
Pubblicazione: (2025)
Sekai: A Video Dataset towards World Exploration
di: Li, Zhen, et al.
Pubblicazione: (2025)
di: Li, Zhen, et al.
Pubblicazione: (2025)
SVBench: Evaluation of Video Generation Models on Social Reasoning
di: Peng, Wenshuo, et al.
Pubblicazione: (2025)
di: Peng, Wenshuo, et al.
Pubblicazione: (2025)
Yume-1.5: A Text-Controlled Interactive World Generation Model
di: Mao, Xiaofeng, et al.
Pubblicazione: (2025)
di: Mao, Xiaofeng, et al.
Pubblicazione: (2025)
SearchLVLMs: A Plug-and-Play Framework for Augmenting Large Vision-Language Models by Searching Up-to-Date Internet Knowledge
di: Li, Chuanhao, et al.
Pubblicazione: (2024)
di: Li, Chuanhao, et al.
Pubblicazione: (2024)
World Craft: Agentic Framework to Create Visualizable Worlds via Text
di: Sun, Jianwen, et al.
Pubblicazione: (2026)
di: Sun, Jianwen, et al.
Pubblicazione: (2026)
T3M: Text Guided 3D Human Motion Synthesis from Speech
di: Peng, Wenshuo, et al.
Pubblicazione: (2024)
di: Peng, Wenshuo, et al.
Pubblicazione: (2024)
World In Your Hands: A Large-Scale and Open-Source Ecosystem for Learning Human-Centric Manipulation in the Wild
di: Zheng, Yupeng, et al.
Pubblicazione: (2025)
di: Zheng, Yupeng, et al.
Pubblicazione: (2025)
Learning Latent Action World Models In The Wild
di: Garrido, Quentin, et al.
Pubblicazione: (2026)
di: Garrido, Quentin, et al.
Pubblicazione: (2026)
Speech World Model: Causal State-Action Planning with Explicit Reasoning for Speech
di: Zhou, Xuanru, et al.
Pubblicazione: (2025)
di: Zhou, Xuanru, et al.
Pubblicazione: (2025)
PointWorld: Scaling 3D World Models for In-The-Wild Robotic Manipulation
di: Huang, Wenlong, et al.
Pubblicazione: (2026)
di: Huang, Wenlong, et al.
Pubblicazione: (2026)
Multi-Sourced Compositional Generalization in Visual Question Answering
di: Li, Chuanhao, et al.
Pubblicazione: (2025)
di: Li, Chuanhao, et al.
Pubblicazione: (2025)
A Large-Scale Study on Video Action Dataset Condensation
di: Chen, Yang, et al.
Pubblicazione: (2024)
di: Chen, Yang, et al.
Pubblicazione: (2024)
MAPF-World: Action World Model for Multi-Agent Path Finding
di: Yang, Zhanjiang, et al.
Pubblicazione: (2025)
di: Yang, Zhanjiang, et al.
Pubblicazione: (2025)
GigaWorld-Policy: An Efficient Action-Centered World--Action Model
di: Ye, Angen, et al.
Pubblicazione: (2026)
di: Ye, Angen, et al.
Pubblicazione: (2026)
PackForcing: Short Video Training Suffices for Long Video Sampling and Long Context Inference
di: Mao, Xiaofeng, et al.
Pubblicazione: (2026)
di: Mao, Xiaofeng, et al.
Pubblicazione: (2026)
Specification-Driven Generation and Evaluation of Discrete-Event World Models via the DEVS Formalism
di: Chen, Zheyu, et al.
Pubblicazione: (2026)
di: Chen, Zheyu, et al.
Pubblicazione: (2026)
MotionScape: A Large-Scale Real-World Highly Dynamic UAV Video Dataset for World Models
di: Guo, Zile, et al.
Pubblicazione: (2026)
di: Guo, Zile, et al.
Pubblicazione: (2026)
OmniVTG: A Large-Scale Dataset and Training Paradigm for Open-World Video Temporal Grounding
di: Zheng, Minghang, et al.
Pubblicazione: (2026)
di: Zheng, Minghang, et al.
Pubblicazione: (2026)
Generative World Renderer
di: Huang, Zheng-Hui, et al.
Pubblicazione: (2026)
di: Huang, Zheng-Hui, et al.
Pubblicazione: (2026)
Stash, Slot, and Carry: ARPG, Pokémon, PSO, and the Environmental Conditions of Agentic AI
di: Eissens, Raynor
Pubblicazione: (2026)
di: Eissens, Raynor
Pubblicazione: (2026)
Composition-Incremental Learning for Compositional Generalization
di: Li, Zhen, et al.
Pubblicazione: (2025)
di: Li, Zhen, et al.
Pubblicazione: (2025)
3CAD: A Large-Scale Real-World 3C Product Dataset for Unsupervised Anomaly
di: Yang, Enquan, et al.
Pubblicazione: (2025)
di: Yang, Enquan, et al.
Pubblicazione: (2025)
Data Adaptive Traceback for Vision-Language Foundation Models in Image Classification
di: Peng, Wenshuo, et al.
Pubblicazione: (2024)
di: Peng, Wenshuo, et al.
Pubblicazione: (2024)
Generalized Dynamics Generation towards Scannable Physical World Model
di: Li, Yichen, et al.
Pubblicazione: (2025)
di: Li, Yichen, et al.
Pubblicazione: (2025)
LMSYS-Chat-1M: A Large-Scale Real-World LLM Conversation Dataset
di: Zheng, Lianmin, et al.
Pubblicazione: (2023)
di: Zheng, Lianmin, et al.
Pubblicazione: (2023)
WebWorld: A Large-Scale World Model for Web Agent Training
di: Xiao, Zikai, et al.
Pubblicazione: (2026)
di: Xiao, Zikai, et al.
Pubblicazione: (2026)
Building Explicit World Model for Zero-Shot Open-World Object Manipulation
di: Li, Xiaotong, et al.
Pubblicazione: (2026)
di: Li, Xiaotong, et al.
Pubblicazione: (2026)
EgoLive: A Large-Scale Egocentric Dataset from Real-World Human Tasks
di: Li, Yihang, et al.
Pubblicazione: (2026)
di: Li, Yihang, et al.
Pubblicazione: (2026)
DriveWAM: Video Generative Priors Enable Scalable World-Action Modeling for Autonomous Driving
di: Shi, Chen, et al.
Pubblicazione: (2026)
di: Shi, Chen, et al.
Pubblicazione: (2026)
WildDeepfake: A Challenging Real-World Dataset for Deepfake Detection
di: Zi, Bojia, et al.
Pubblicazione: (2021)
di: Zi, Bojia, et al.
Pubblicazione: (2021)
Is the Future Compatible? Diagnosing Dynamic Consistency in World Action Models
di: Ruan, Bo-Kai, et al.
Pubblicazione: (2026)
di: Ruan, Bo-Kai, et al.
Pubblicazione: (2026)
OmniWorld: A Multi-Domain and Multi-Modal Dataset for 4D World Modeling
di: Zhou, Yang, et al.
Pubblicazione: (2025)
di: Zhou, Yang, et al.
Pubblicazione: (2025)
Can World Models Benefit VLMs for World Dynamics?
di: Zhang, Kevin, et al.
Pubblicazione: (2025)
di: Zhang, Kevin, et al.
Pubblicazione: (2025)
ATRNet-STAR: A Large Dataset and Benchmark Towards Remote Sensing Object Recognition in the Wild
di: Liu, Yongxiang, et al.
Pubblicazione: (2025)
di: Liu, Yongxiang, et al.
Pubblicazione: (2025)
DyWA: Dynamics-adaptive World Action Model for Generalizable Non-prehensile Manipulation
di: Lyu, Jiangran, et al.
Pubblicazione: (2025)
di: Lyu, Jiangran, et al.
Pubblicazione: (2025)
VT-LVLM-AR: A Video-Temporal Large Vision-Language Model Adapter for Fine-Grained Action Recognition in Long-Term Videos
di: Li, Kaining, et al.
Pubblicazione: (2025)
di: Li, Kaining, et al.
Pubblicazione: (2025)
EvoWorld: Evolving Panoramic World Generation with Explicit 3D Memory
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
Wild Tibetan Macaques Use a Route‐Based Mental Map to Navigate in Large‐Scale Space
di: Shi Cheng, et al.
Pubblicazione: (2024)
di: Shi Cheng, et al.
Pubblicazione: (2024)
DDL: A Large-Scale Datasets for Deepfake Detection and Localization in Diversified Real-World Scenarios
di: Miao, Changtao, et al.
Pubblicazione: (2025)
di: Miao, Changtao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Yume: An Interactive World Generation Model
di: Mao, Xiaofeng, et al.
Pubblicazione: (2025) -
Sekai: A Video Dataset towards World Exploration
di: Li, Zhen, et al.
Pubblicazione: (2025) -
SVBench: Evaluation of Video Generation Models on Social Reasoning
di: Peng, Wenshuo, et al.
Pubblicazione: (2025) -
Yume-1.5: A Text-Controlled Interactive World Generation Model
di: Mao, Xiaofeng, et al.
Pubblicazione: (2025) -
SearchLVLMs: A Plug-and-Play Framework for Augmenting Large Vision-Language Models by Searching Up-to-Date Internet Knowledge
di: Li, Chuanhao, et al.
Pubblicazione: (2024)