Video2Game: Real-time, Interactive, Realistic and Browser-Compatible Environment from a Single Video
Fuente:
arXiv
Salvato in:
| Autori principali: | Xia, Hongchi, Lin, Zhi-Hao, Ma, Wei-Chiu, Wang, Shenlong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AutoVFX: Physically Realistic Video Editing from Natural Language Instructions
di: Hsu, Hao-Yu, et al.
Pubblicazione: (2024)
di: Hsu, Hao-Yu, et al.
Pubblicazione: (2024)
HoloScene: Simulation-Ready Interactive 3D Worlds from a Single Video
di: Xia, Hongchi, et al.
Pubblicazione: (2025)
di: Xia, Hongchi, et al.
Pubblicazione: (2025)
GameGen-X: Interactive Open-world Game Video Generation
di: Che, Haoxuan, et al.
Pubblicazione: (2024)
di: Che, Haoxuan, et al.
Pubblicazione: (2024)
Uni4D: Unifying Visual Foundation Models for 4D Modeling from a Single Video
di: Yao, David Yifan, et al.
Pubblicazione: (2025)
di: Yao, David Yifan, et al.
Pubblicazione: (2025)
Autoregressive Adversarial Post-Training for Real-Time Interactive Video Generation
di: Lin, Shanchuan, et al.
Pubblicazione: (2025)
di: Lin, Shanchuan, et al.
Pubblicazione: (2025)
TKN: Transformer-based Keypoint Prediction Network For Real-time Video Prediction
di: Li, Haoran, et al.
Pubblicazione: (2023)
di: Li, Haoran, et al.
Pubblicazione: (2023)
PhysTwin: Physics-Informed Reconstruction and Simulation of Deformable Objects from Videos
di: Jiang, Hanxiao, et al.
Pubblicazione: (2025)
di: Jiang, Hanxiao, et al.
Pubblicazione: (2025)
PhysGen: Rigid-Body Physics-Grounded Image-to-Video Generation
di: Liu, Shaowei, et al.
Pubblicazione: (2024)
di: Liu, Shaowei, et al.
Pubblicazione: (2024)
MIDAS: Multimodal Interactive Digital-humAn Synthesis via Real-time Autoregressive Video Generation
di: Chen, Ming, et al.
Pubblicazione: (2025)
di: Chen, Ming, et al.
Pubblicazione: (2025)
SuperGaussian: Repurposing Video Models for 3D Super Resolution
di: Shen, Yuan, et al.
Pubblicazione: (2024)
di: Shen, Yuan, et al.
Pubblicazione: (2024)
FreeOrbit4D: Training-Free Arbitrary Camera Redirection for Monocular Videos via Foreground-Complete 4D Reconstruction
di: Cao, Wei, et al.
Pubblicazione: (2026)
di: Cao, Wei, et al.
Pubblicazione: (2026)
VideoGameQA-Bench: Evaluating Vision-Language Models for Video Game Quality Assurance
di: Taesiri, Mohammad Reza, et al.
Pubblicazione: (2025)
di: Taesiri, Mohammad Reza, et al.
Pubblicazione: (2025)
O-DisCo-Edit: Object Distortion Control for Unified Realistic Video Editing
di: Chen, Yuqing, et al.
Pubblicazione: (2025)
di: Chen, Yuqing, et al.
Pubblicazione: (2025)
AccidentSim: Generating Vehicle Collision Videos with Physically Realistic Collision Trajectories from Real-World Accident Reports
di: Zhang, Xiangwen, et al.
Pubblicazione: (2025)
di: Zhang, Xiangwen, et al.
Pubblicazione: (2025)
X2SAM: Any Segmentation in Images and Videos
di: Wang, Hao, et al.
Pubblicazione: (2026)
di: Wang, Hao, et al.
Pubblicazione: (2026)
Yan: Foundational Interactive Video Generation
di: Ye, Deheng, et al.
Pubblicazione: (2025)
di: Ye, Deheng, et al.
Pubblicazione: (2025)
Space-time Reinforcement Network for Video Object Segmentation
di: Chen, Yadang, et al.
Pubblicazione: (2024)
di: Chen, Yadang, et al.
Pubblicazione: (2024)
Non-verbal Real-time Human-AI Interaction in Constrained Robotic Environments
di: Costea, Dragos, et al.
Pubblicazione: (2026)
di: Costea, Dragos, et al.
Pubblicazione: (2026)
DisCa: Accelerating Video Diffusion Transformers with Distillation-Compatible Learnable Feature Caching
di: Zou, Chang, et al.
Pubblicazione: (2026)
di: Zou, Chang, et al.
Pubblicazione: (2026)
A Hybrid Co-Finetuning Approach for Visual Bug Detection in Video Games
di: Yi, Faliu, et al.
Pubblicazione: (2025)
di: Yi, Faliu, et al.
Pubblicazione: (2025)
Universal Visuo-Tactile Video Understanding for Embodied Interaction
di: Xie, Yifan, et al.
Pubblicazione: (2025)
di: Xie, Yifan, et al.
Pubblicazione: (2025)
SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer
di: Zhao, Yuyang, et al.
Pubblicazione: (2026)
di: Zhao, Yuyang, et al.
Pubblicazione: (2026)
MagicVideo-V2: Multi-Stage High-Aesthetic Video Generation
di: Wang, Weimin, et al.
Pubblicazione: (2024)
di: Wang, Weimin, et al.
Pubblicazione: (2024)
CV-VAE: A Compatible Video VAE for Latent Generative Video Models
di: Zhao, Sijie, et al.
Pubblicazione: (2024)
di: Zhao, Sijie, et al.
Pubblicazione: (2024)
BehAVE: Behaviour Alignment of Video Game Encodings
di: Rašajski, Nemanja, et al.
Pubblicazione: (2024)
di: Rašajski, Nemanja, et al.
Pubblicazione: (2024)
Video-As-Prompt: Unified Semantic Control for Video Generation
di: Bian, Yuxuan, et al.
Pubblicazione: (2025)
di: Bian, Yuxuan, et al.
Pubblicazione: (2025)
Fewer Tokens and Fewer Videos: Extending Video Understanding Abilities in Large Vision-Language Models
di: Chen, Shimin, et al.
Pubblicazione: (2024)
di: Chen, Shimin, et al.
Pubblicazione: (2024)
Video-of-Thought: Step-by-Step Video Reasoning from Perception to Cognition
di: Fei, Hao, et al.
Pubblicazione: (2024)
di: Fei, Hao, et al.
Pubblicazione: (2024)
VC-Agent: An Interactive Agent for Customized Video Dataset Collection
di: Zhang, Yidan, et al.
Pubblicazione: (2025)
di: Zhang, Yidan, et al.
Pubblicazione: (2025)
VOID: Video Object and Interaction Deletion
di: Motamed, Saman, et al.
Pubblicazione: (2026)
di: Motamed, Saman, et al.
Pubblicazione: (2026)
DGGAN: Degradation Guided Generative Adversarial Network for Real-time Endoscopic Video Enhancement
di: Xu, Handing, et al.
Pubblicazione: (2025)
di: Xu, Handing, et al.
Pubblicazione: (2025)
SWIFT: Prompt-Adaptive Memory for Efficient Interactive Long Video Generation
di: Tan, Shanwen, et al.
Pubblicazione: (2026)
di: Tan, Shanwen, et al.
Pubblicazione: (2026)
QuickVideo: Real-Time Long Video Understanding with System Algorithm Co-Design
di: Schneider, Benjamin, et al.
Pubblicazione: (2025)
di: Schneider, Benjamin, et al.
Pubblicazione: (2025)
YCDa: YCbCr Decoupled Attention for Real-time Realistic Camouflaged Object Detection
di: Zheng, PeiHuang, et al.
Pubblicazione: (2026)
di: Zheng, PeiHuang, et al.
Pubblicazione: (2026)
RealWonder: Real-Time Physical Action-Conditioned Video Generation
di: Liu, Wei, et al.
Pubblicazione: (2026)
di: Liu, Wei, et al.
Pubblicazione: (2026)
TimeMarker: A Versatile Video-LLM for Long and Short Video Understanding with Superior Temporal Localization Ability
di: Chen, Shimin, et al.
Pubblicazione: (2024)
di: Chen, Shimin, et al.
Pubblicazione: (2024)
Real2SAM2Real: Generative 3D Caches as Complementary Context for Video Diffusion
di: Wu, Jiayi, et al.
Pubblicazione: (2026)
di: Wu, Jiayi, et al.
Pubblicazione: (2026)
VidPrism: Heterogeneous Mixture of Experts for Image-to-Video Transfer
di: Lin, Rui, et al.
Pubblicazione: (2026)
di: Lin, Rui, et al.
Pubblicazione: (2026)
Zero-Shot Temporal Interaction Localization for Egocentric Videos
di: Zhang, Erhang, et al.
Pubblicazione: (2025)
di: Zhang, Erhang, et al.
Pubblicazione: (2025)
InsertAnywhere: Bridging 4D Scene Geometry and Diffusion Models for Realistic Video Object Insertion
di: Jin, Hoiyeong, et al.
Pubblicazione: (2025)
di: Jin, Hoiyeong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
AutoVFX: Physically Realistic Video Editing from Natural Language Instructions
di: Hsu, Hao-Yu, et al.
Pubblicazione: (2024) -
HoloScene: Simulation-Ready Interactive 3D Worlds from a Single Video
di: Xia, Hongchi, et al.
Pubblicazione: (2025) -
GameGen-X: Interactive Open-world Game Video Generation
di: Che, Haoxuan, et al.
Pubblicazione: (2024) -
Uni4D: Unifying Visual Foundation Models for 4D Modeling from a Single Video
di: Yao, David Yifan, et al.
Pubblicazione: (2025) -
Autoregressive Adversarial Post-Training for Real-Time Interactive Video Generation
di: Lin, Shanchuan, et al.
Pubblicazione: (2025)