Model as a Game: On Numerical and Spatial Consistency for Generative Games
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Jingye, Zhao, Yuzhong, Huang, Yupan, Cui, Lei, Dong, Li, Lv, Tengchao, Chen, Qifeng, Wei, Furu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
KOSMOS-2.5: A Multimodal Literate Model
por: Lv, Tengchao, et al.
Publicado: (2023)
por: Lv, Tengchao, et al.
Publicado: (2023)
DocReward: A Document Reward Model for Structuring and Stylizing
por: Liu, Junpeng, et al.
Publicado: (2025)
por: Liu, Junpeng, et al.
Publicado: (2025)
TALE: Training-free Cross-domain Image Composition via Adaptive Latent Manipulation and Energy-guided Optimization
por: Pham, Kien T., et al.
Publicado: (2024)
por: Pham, Kien T., et al.
Publicado: (2024)
Rethinking Layered Graphic Design Generation with a Top-Down Approach
por: Chen, Jingye, et al.
Publicado: (2025)
por: Chen, Jingye, et al.
Publicado: (2025)
Kosmos-G: Generating Images in Context with Multimodal Large Language Models
por: Pan, Xichen, et al.
Publicado: (2023)
por: Pan, Xichen, et al.
Publicado: (2023)
Does Synthetic Layered Design Data Benefit Layered Design Decomposition?
por: Wu, Kam Man, et al.
Publicado: (2026)
por: Wu, Kam Man, et al.
Publicado: (2026)
Towards Generalist Game Players: An Investigation of Foundation Models in the Game Multiverse
por: Zhang, Kuan, et al.
Publicado: (2026)
por: Zhang, Kuan, et al.
Publicado: (2026)
Hunyuan-Game: Industrial-grade Intelligent Game Creation Model
por: Li, Ruihuang, et al.
Publicado: (2025)
por: Li, Ruihuang, et al.
Publicado: (2025)
BEV-VAE: Multi-view Image Generation with Spatial Consistency for Autonomous Driving
por: Chen, Zeming, et al.
Publicado: (2025)
por: Chen, Zeming, et al.
Publicado: (2025)
Large Motion Video Autoencoding with Cross-modal Video VAE
por: Xing, Yazhou, et al.
Publicado: (2024)
por: Xing, Yazhou, et al.
Publicado: (2024)
From Virtual Games to Real-World Play
por: Sun, Wenqiang, et al.
Publicado: (2025)
por: Sun, Wenqiang, et al.
Publicado: (2025)
PEACE: Empowering Geologic Map Holistic Understanding with MLLMs
por: Huang, Yangyu, et al.
Publicado: (2025)
por: Huang, Yangyu, et al.
Publicado: (2025)
Multimodal Large Language Model is a Human-Aligned Annotator for Text-to-Image Generation
por: Wu, Xun, et al.
Publicado: (2024)
por: Wu, Xun, et al.
Publicado: (2024)
Hunyuan-GameCraft-2: Instruction-following Interactive Game World Model
por: Tang, Junshu, et al.
Publicado: (2025)
por: Tang, Junshu, et al.
Publicado: (2025)
Play to Generalize: Learning to Reason Through Game Play
por: Xie, Yunfei, et al.
Publicado: (2025)
por: Xie, Yunfei, et al.
Publicado: (2025)
Optimizing Prompts for Text-to-Image Generation
por: Hao, Yaru, et al.
Publicado: (2022)
por: Hao, Yaru, et al.
Publicado: (2022)
GameFactory: Creating New Games with Generative Interactive Videos
por: Yu, Jiwen, et al.
Publicado: (2025)
por: Yu, Jiwen, et al.
Publicado: (2025)
GameGen-X: Interactive Open-world Game Video Generation
por: Che, Haoxuan, et al.
Publicado: (2024)
por: Che, Haoxuan, et al.
Publicado: (2024)
Free4D: Tuning-free 4D Scene Generation with Spatial-Temporal Consistency
por: Liu, Tianqi, et al.
Publicado: (2025)
por: Liu, Tianqi, et al.
Publicado: (2025)
CharaConsist: Fine-Grained Consistent Character Generation
por: Wang, Mengyu, et al.
Publicado: (2025)
por: Wang, Mengyu, et al.
Publicado: (2025)
Domain Game: Disentangle Anatomical Feature for Single Domain Generalized Segmentation
por: Chen, Hao, et al.
Publicado: (2024)
por: Chen, Hao, et al.
Publicado: (2024)
FontStudio: Shape-Adaptive Diffusion Model for Coherent and Consistent Font Effect Generation
por: Mu, Xinzhi, et al.
Publicado: (2024)
por: Mu, Xinzhi, et al.
Publicado: (2024)
Diagnosing the Compositional Knowledge of Vision Language Models from a Game-Theoretic View
por: Wang, Jin, et al.
Publicado: (2024)
por: Wang, Jin, et al.
Publicado: (2024)
LibraGen: Playing a Balance Game in Subject-Driven Video Generation
por: Zhu, Jiahao, et al.
Publicado: (2026)
por: Zhu, Jiahao, et al.
Publicado: (2026)
Hunyuan-GameCraft: High-dynamic Interactive Game Video Generation with Hybrid History Condition
por: Li, Jiaqi, et al.
Publicado: (2025)
por: Li, Jiaqi, et al.
Publicado: (2025)
4DGen: Grounded 4D Content Generation with Spatial-temporal Consistency
por: Yin, Yuyang, et al.
Publicado: (2023)
por: Yin, Yuyang, et al.
Publicado: (2023)
AvatarArtist: Open-Domain 4D Avatarization
por: Liu, Hongyu, et al.
Publicado: (2025)
por: Liu, Hongyu, et al.
Publicado: (2025)
Spatial Chain-of-Thought: Bridging Understanding and Generation Models for Spatial Reasoning Generation
por: Chen, Wei, et al.
Publicado: (2026)
por: Chen, Wei, et al.
Publicado: (2026)
GTAutoAct: An Automatic Datasets Generation Framework Based on Game Engine Redevelopment for Action Recognition
por: Song, Xingyu, et al.
Publicado: (2024)
por: Song, Xingyu, et al.
Publicado: (2024)
TIGaussian: Disentangle Gaussians for Spatial-Awared Text-Image-3D Alignment
por: Liu, Jiarun, et al.
Publicado: (2026)
por: Liu, Jiarun, et al.
Publicado: (2026)
EEdit: Rethinking the Spatial and Temporal Redundancy for Efficient Image Editing
por: Yan, Zexuan, et al.
Publicado: (2025)
por: Yan, Zexuan, et al.
Publicado: (2025)
GameIR: A Large-Scale Synthesized Ground-Truth Dataset for Image Restoration over Gaming Content
por: Zhou, Lebin, et al.
Publicado: (2024)
por: Zhou, Lebin, et al.
Publicado: (2024)
Synergizing Understanding and Generation with Interleaved Analyzing-Drafting Thinking
por: Wu, Shengqiong, et al.
Publicado: (2026)
por: Wu, Shengqiong, et al.
Publicado: (2026)
Measuring 3D Spatial Geometric Consistency in Dynamic Generated Videos
por: Dou, Weijia, et al.
Publicado: (2026)
por: Dou, Weijia, et al.
Publicado: (2026)
UniPlane: Unified Plane Detection and Reconstruction from Posed Monocular Videos
por: Huang, Yuzhong, et al.
Publicado: (2024)
por: Huang, Yuzhong, et al.
Publicado: (2024)
ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation
por: Ren, Weiming, et al.
Publicado: (2024)
por: Ren, Weiming, et al.
Publicado: (2024)
ReactiveGWM: Steering NPC in Reactive Game World Models
por: Wang, Zeqing, et al.
Publicado: (2026)
por: Wang, Zeqing, et al.
Publicado: (2026)
OrientDream: Streamlining Text-to-3D Generation with Explicit Orientation Control
por: Huang, Yuzhong, et al.
Publicado: (2024)
por: Huang, Yuzhong, et al.
Publicado: (2024)
Dual-Expert Consistency Model for Efficient and High-Quality Video Generation
por: Lv, Zhengyao, et al.
Publicado: (2025)
por: Lv, Zhengyao, et al.
Publicado: (2025)
Diffusion4D: Fast Spatial-temporal Consistent 4D Generation via Video Diffusion Models
por: Liang, Hanwen, et al.
Publicado: (2024)
por: Liang, Hanwen, et al.
Publicado: (2024)
Ejemplares similares
-
KOSMOS-2.5: A Multimodal Literate Model
por: Lv, Tengchao, et al.
Publicado: (2023) -
DocReward: A Document Reward Model for Structuring and Stylizing
por: Liu, Junpeng, et al.
Publicado: (2025) -
TALE: Training-free Cross-domain Image Composition via Adaptive Latent Manipulation and Energy-guided Optimization
por: Pham, Kien T., et al.
Publicado: (2024) -
Rethinking Layered Graphic Design Generation with a Top-Down Approach
por: Chen, Jingye, et al.
Publicado: (2025) -
Kosmos-G: Generating Images in Context with Multimodal Large Language Models
por: Pan, Xichen, et al.
Publicado: (2023)