GeoVideo: Introducing Geometric Regularization into Video Generation Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Bai, Yunpeng, Fang, Shaoheng, Yu, Chaohui, Wang, Fan, Huang, Qixing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MVRoom: Controllable 3D Indoor Scene Generation with Multi-View Diffusion Models
por: Fang, Shaoheng, et al.
Publicado: (2025)
por: Fang, Shaoheng, et al.
Publicado: (2025)
WorldReel: 4D Video Generation with Consistent Geometry and Motion Modeling
por: Fang, Shaoheng, et al.
Publicado: (2025)
por: Fang, Shaoheng, et al.
Publicado: (2025)
FiffDepth: Feed-forward Transformation of Diffusion-Based Generators for Detailed Depth Estimation
por: Bai, Yunpeng, et al.
Publicado: (2024)
por: Bai, Yunpeng, et al.
Publicado: (2024)
Positional Encoding Field
por: Bai, Yunpeng, et al.
Publicado: (2025)
por: Bai, Yunpeng, et al.
Publicado: (2025)
SC4D: Sparse-Controlled Video-to-4D Generation and Motion Transfer
por: Wu, Zijie, et al.
Publicado: (2024)
por: Wu, Zijie, et al.
Publicado: (2024)
3DV-TON: Textured 3D-Guided Consistent Video Try-on via Diffusion Models
por: Wei, Min, et al.
Publicado: (2025)
por: Wei, Min, et al.
Publicado: (2025)
CamPVG: Camera-Controlled Panoramic Video Generation with Epipolar-Aware Diffusion
por: Ji, Chenhao, et al.
Publicado: (2025)
por: Ji, Chenhao, et al.
Publicado: (2025)
DynamicScaler: Seamless and Scalable Video Generation for Panoramic Scenes
por: Liu, Jinxiu, et al.
Publicado: (2024)
por: Liu, Jinxiu, et al.
Publicado: (2024)
Animate3D: Animating Any 3D Model with Multi-view Video Diffusion
por: Jiang, Yanqin, et al.
Publicado: (2024)
por: Jiang, Yanqin, et al.
Publicado: (2024)
AnimateAnyMesh: A Feed-Forward 4D Foundation Model for Text-Driven Universal Mesh Animation
por: Wu, Zijie, et al.
Publicado: (2025)
por: Wu, Zijie, et al.
Publicado: (2025)
AnimateAnyMesh++: A Flexible 4D Foundation Model for High-Fidelity Text-Driven Mesh Animation
por: Wu, Zijie, et al.
Publicado: (2026)
por: Wu, Zijie, et al.
Publicado: (2026)
Information-Regularized Constrained Inversion for Stable Avatar Editing from Sparse Supervision
por: Liang, Zhenxiao, et al.
Publicado: (2026)
por: Liang, Zhenxiao, et al.
Publicado: (2026)
LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion
por: Zhang, Yisu, et al.
Publicado: (2025)
por: Zhang, Yisu, et al.
Publicado: (2025)
GeoFlow: Enforcing Implicit Geometric Consistency in Video Generation
por: Ackermann, Jan, et al.
Publicado: (2026)
por: Ackermann, Jan, et al.
Publicado: (2026)
Uni3C: Unifying Precisely 3D-Enhanced Camera and Human Motion Controls for Video Generation
por: Cao, Chenjie, et al.
Publicado: (2025)
por: Cao, Chenjie, et al.
Publicado: (2025)
FantasyID: Face Knowledge Enhanced ID-Preserving Video Generation
por: Zhang, Yunpeng, et al.
Publicado: (2025)
por: Zhang, Yunpeng, et al.
Publicado: (2025)
ViD-GPT: Introducing GPT-style Autoregressive Generation in Video Diffusion Models
por: Gao, Kaifeng, et al.
Publicado: (2024)
por: Gao, Kaifeng, et al.
Publicado: (2024)
Vid2World: Crafting Video Diffusion Models to Interactive World Models
por: Huang, Siqiao, et al.
Publicado: (2025)
por: Huang, Siqiao, et al.
Publicado: (2025)
RepVideo: Rethinking Cross-Layer Representation for Video Generation
por: Si, Chenyang, et al.
Publicado: (2025)
por: Si, Chenyang, et al.
Publicado: (2025)
Temporal Regularization Makes Your Video Generator Stronger
por: Chen, Harold Haodong, et al.
Publicado: (2025)
por: Chen, Harold Haodong, et al.
Publicado: (2025)
Cyc3D: Fine-grained Controllable 3D Generation via Cycle Consistency Regularization
por: Xu, Hongbin, et al.
Publicado: (2025)
por: Xu, Hongbin, et al.
Publicado: (2025)
VideoMV: Consistent Multi-View Generation Based on Large Video Generative Model
por: Zuo, Qi, et al.
Publicado: (2024)
por: Zuo, Qi, et al.
Publicado: (2024)
Sora Generates Videos with Stunning Geometrical Consistency
por: Li, Xuanyi, et al.
Publicado: (2024)
por: Li, Xuanyi, et al.
Publicado: (2024)
4DRecons: 4D Neural Implicit Deformable Objects Reconstruction from a single RGB-D Camera with Geometrical and Topological Regularizations
por: Cong, Xiaoyan, et al.
Publicado: (2024)
por: Cong, Xiaoyan, et al.
Publicado: (2024)
HunyuanVideo: A Systematic Framework For Large Video Generative Models
por: Kong, Weijie, et al.
Publicado: (2024)
por: Kong, Weijie, et al.
Publicado: (2024)
Q-GeoMem: Question-Guided Geometric Memory for Video Spatial Reasoning
por: Gao, Xianqiang, et al.
Publicado: (2026)
por: Gao, Xianqiang, et al.
Publicado: (2026)
Hi-GaTA: Hierarchical Gated Temporal Aggregation Adapter for Surgical Video Report Generation
por: Sun, Kedi, et al.
Publicado: (2026)
por: Sun, Kedi, et al.
Publicado: (2026)
Measuring 3D Spatial Geometric Consistency in Dynamic Generated Videos
por: Dou, Weijia, et al.
Publicado: (2026)
por: Dou, Weijia, et al.
Publicado: (2026)
GenAnalysis: Joint Shape Analysis by Learning Man-Made Shape Generators with Deformation Regularizations
por: Yang, Yuezhi, et al.
Publicado: (2025)
por: Yang, Yuezhi, et al.
Publicado: (2025)
Driving-Video Dehazing with Non-Aligned Regularization for Safety Assistance
por: Fan, Junkai, et al.
Publicado: (2024)
por: Fan, Junkai, et al.
Publicado: (2024)
MVGenMaster: Scaling Multi-View Generation from Any Image via 3D Priors Enhanced Diffusion Model
por: Cao, Chenjie, et al.
Publicado: (2024)
por: Cao, Chenjie, et al.
Publicado: (2024)
Video2BEV: Transforming Drone Videos to BEVs for Video-based Geo-localization
por: Ju, Hao, et al.
Publicado: (2024)
por: Ju, Hao, et al.
Publicado: (2024)
CineScene: Implicit 3D as Effective Scene Representation for Cinematic Video Generation
por: Huang, Kaiyi, et al.
Publicado: (2026)
por: Huang, Kaiyi, et al.
Publicado: (2026)
UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models
por: Jiang, Hong, et al.
Publicado: (2026)
por: Jiang, Hong, et al.
Publicado: (2026)
Versatile Transition Generation with Image-to-Video Diffusion
por: Yang, Zuhao, et al.
Publicado: (2025)
por: Yang, Zuhao, et al.
Publicado: (2025)
Unleashing Video Language Models for Fine-grained HRCT Report Generation
por: Fang, Yingying, et al.
Publicado: (2026)
por: Fang, Yingying, et al.
Publicado: (2026)
MagicGeo: Training-Free Text-Guided Geometric Diagram Generation
por: Wang, Junxiao, et al.
Publicado: (2025)
por: Wang, Junxiao, et al.
Publicado: (2025)
VBench++: Comprehensive and Versatile Benchmark Suite for Video Generative Models
por: Huang, Ziqi, et al.
Publicado: (2024)
por: Huang, Ziqi, et al.
Publicado: (2024)
InternVideo-Next: Towards General Video Foundation Models without Video-Text Supervision
por: Wang, Chenting, et al.
Publicado: (2025)
por: Wang, Chenting, et al.
Publicado: (2025)
Beyond Pixels: Introducing Geometric-Semantic World Priors for Video-based Embodied Models via Spatio-temporal Alignment
por: Tang, Jinzhou, et al.
Publicado: (2025)
por: Tang, Jinzhou, et al.
Publicado: (2025)
Ejemplares similares
-
MVRoom: Controllable 3D Indoor Scene Generation with Multi-View Diffusion Models
por: Fang, Shaoheng, et al.
Publicado: (2025) -
WorldReel: 4D Video Generation with Consistent Geometry and Motion Modeling
por: Fang, Shaoheng, et al.
Publicado: (2025) -
FiffDepth: Feed-forward Transformation of Diffusion-Based Generators for Detailed Depth Estimation
por: Bai, Yunpeng, et al.
Publicado: (2024) -
Positional Encoding Field
por: Bai, Yunpeng, et al.
Publicado: (2025) -
SC4D: Sparse-Controlled Video-to-4D Generation and Motion Transfer
por: Wu, Zijie, et al.
Publicado: (2024)