UniGeo: Taming Video Diffusion for Unified Consistent Geometry Estimation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Sun, Yang-Tian, Yu, Xin, Huang, Zehuan, Huang, Yi-Hua, Guo, Yuan-Chen, Yang, Ziyi, Cao, Yan-Pei, Qi, Xiaojuan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models
von: Jiang, Hong, et al.
Veröffentlicht: (2026)
von: Jiang, Hong, et al.
Veröffentlicht: (2026)
UniGeo: A Unified 3D Indoor Object Detection Framework Integrating Geometry-Aware Learning and Dynamic Channel Gating
von: Yi, Xing, et al.
Veröffentlicht: (2026)
von: Yi, Xing, et al.
Veröffentlicht: (2026)
UniTok: A Unified Tokenizer for Visual Generation and Understanding
von: Ma, Chuofan, et al.
Veröffentlicht: (2025)
von: Ma, Chuofan, et al.
Veröffentlicht: (2025)
UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation
von: Wang, Xiang, et al.
Veröffentlicht: (2024)
von: Wang, Xiang, et al.
Veröffentlicht: (2024)
Stereo World Model: Camera-Guided Stereo Video Generation
von: Sun, Yang-Tian, et al.
Veröffentlicht: (2026)
von: Sun, Yang-Tian, et al.
Veröffentlicht: (2026)
SC-GS: Sparse-Controlled Gaussian Splatting for Editable Dynamic Scenes
von: Huang, Yi-Hua, et al.
Veröffentlicht: (2023)
von: Huang, Yi-Hua, et al.
Veröffentlicht: (2023)
Splatter a Video: Video Gaussian Representation for Versatile Processing
von: Sun, Yang-Tian, et al.
Veröffentlicht: (2024)
von: Sun, Yang-Tian, et al.
Veröffentlicht: (2024)
UniDream: Unifying Diffusion Priors for Relightable Text-to-3D Generation
von: Liu, Zexiang, et al.
Veröffentlicht: (2023)
von: Liu, Zexiang, et al.
Veröffentlicht: (2023)
AniGen: Unified $S^3$ Fields for Animatable 3D Asset Generation
von: Huang, Yi-Hua, et al.
Veröffentlicht: (2026)
von: Huang, Yi-Hua, et al.
Veröffentlicht: (2026)
UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation
von: Guo, Qin, et al.
Veröffentlicht: (2025)
von: Guo, Qin, et al.
Veröffentlicht: (2025)
Deformable Radial Kernel Splatting
von: Huang, Yi-Hua, et al.
Veröffentlicht: (2024)
von: Huang, Yi-Hua, et al.
Veröffentlicht: (2024)
MV-Adapter: Multi-view Consistent Image Generation Made Easy
von: Huang, Zehuan, et al.
Veröffentlicht: (2024)
von: Huang, Zehuan, et al.
Veröffentlicht: (2024)
UniT: Unified Geometry Learning with Group Autoregressive Transformer
von: Wang, Haotian, et al.
Veröffentlicht: (2026)
von: Wang, Haotian, et al.
Veröffentlicht: (2026)
GeoMan: Temporally Consistent Human Geometry Estimation using Image-to-Video Diffusion
von: Kim, Gwanghyun, et al.
Veröffentlicht: (2025)
von: Kim, Gwanghyun, et al.
Veröffentlicht: (2025)
InstaVSR: Taming Diffusion for Efficient and Temporally Consistent Video Super-Resolution
von: Hu, Jintong, et al.
Veröffentlicht: (2026)
von: Hu, Jintong, et al.
Veröffentlicht: (2026)
GeometryCrafter: Consistent Geometry Estimation for Open-world Videos with Diffusion Priors
von: Xu, Tian-Xing, et al.
Veröffentlicht: (2025)
von: Xu, Tian-Xing, et al.
Veröffentlicht: (2025)
SeqTex: Generate Mesh Textures in Video Sequence
von: Yuan, Ze, et al.
Veröffentlicht: (2025)
von: Yuan, Ze, et al.
Veröffentlicht: (2025)
UniVBench: Towards Unified Evaluation for Video Foundation Models
von: Wei, Jianhui, et al.
Veröffentlicht: (2026)
von: Wei, Jianhui, et al.
Veröffentlicht: (2026)
Groma: Localized Visual Tokenization for Grounding Multimodal Large Language Models
von: Ma, Chuofan, et al.
Veröffentlicht: (2024)
von: Ma, Chuofan, et al.
Veröffentlicht: (2024)
UniCtrl: Improving the Spatiotemporal Consistency of Text-to-Video Diffusion Models via Training-Free Unified Attention Control
von: Xia, Tian, et al.
Veröffentlicht: (2024)
von: Xia, Tian, et al.
Veröffentlicht: (2024)
MIDI: Multi-Instance Diffusion for Single Image to 3D Scene Generation
von: Huang, Zehuan, et al.
Veröffentlicht: (2024)
von: Huang, Zehuan, et al.
Veröffentlicht: (2024)
AnimaX: Animating the Inanimate in 3D with Joint Video-Pose Diffusion Models
von: Huang, Zehuan, et al.
Veröffentlicht: (2025)
von: Huang, Zehuan, et al.
Veröffentlicht: (2025)
UniMLVG: Unified Framework for Multi-view Long Video Generation with Comprehensive Control Capabilities for Autonomous Driving
von: Chen, Rui, et al.
Veröffentlicht: (2024)
von: Chen, Rui, et al.
Veröffentlicht: (2024)
GCRayDiffusion: Pose-Free Surface Reconstruction via Geometric Consistent Ray Diffusion
von: Chen, Li-Heng, et al.
Veröffentlicht: (2025)
von: Chen, Li-Heng, et al.
Veröffentlicht: (2025)
IllumiCraft: Unified Geometry and Illumination Diffusion for Controllable Video Generation
von: Lin, Yuanze, et al.
Veröffentlicht: (2025)
von: Lin, Yuanze, et al.
Veröffentlicht: (2025)
3DGSR: Implicit Surface Reconstruction with 3D Gaussian Splatting
von: Lyu, Xiaoyang, et al.
Veröffentlicht: (2024)
von: Lyu, Xiaoyang, et al.
Veröffentlicht: (2024)
TEXGen: a Generative Diffusion Model for Mesh Textures
von: Yu, Xin, et al.
Veröffentlicht: (2024)
von: Yu, Xin, et al.
Veröffentlicht: (2024)
SuperMat: Physically Consistent PBR Material Estimation at Interactive Rates
von: Hong, Yijia, et al.
Veröffentlicht: (2024)
von: Hong, Yijia, et al.
Veröffentlicht: (2024)
From Prompt to Progression: Taming Video Diffusion Models for Seamless Attribute Transition
von: Lo, Ling, et al.
Veröffentlicht: (2025)
von: Lo, Ling, et al.
Veröffentlicht: (2025)
UniGS: Unified Geometry-Aware Gaussian Splatting for Multimodal Rendering
von: Xie, Yusen, et al.
Veröffentlicht: (2025)
von: Xie, Yusen, et al.
Veröffentlicht: (2025)
Veda: Scalable Video Diffusion via Distilled Sparse Attention
von: Han, Shihao, et al.
Veröffentlicht: (2026)
von: Han, Shihao, et al.
Veröffentlicht: (2026)
Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling
von: Wu, Haoyu, et al.
Veröffentlicht: (2025)
von: Wu, Haoyu, et al.
Veröffentlicht: (2025)
UniLat3D: Geometry-Appearance Unified Latents for Single-Stage 3D Generation
von: Wu, Guanjun, et al.
Veröffentlicht: (2025)
von: Wu, Guanjun, et al.
Veröffentlicht: (2025)
UniScene: Unified Occupancy-centric Driving Scene Generation
von: Li, Bohan, et al.
Veröffentlicht: (2024)
von: Li, Bohan, et al.
Veröffentlicht: (2024)
FlowVid: Taming Imperfect Optical Flows for Consistent Video-to-Video Synthesis
von: Liang, Feng, et al.
Veröffentlicht: (2023)
von: Liang, Feng, et al.
Veröffentlicht: (2023)
UniFinEval: Towards Unified Evaluation of Financial Multimodal Models across Text, Images and Videos
von: Yang, Zhi, et al.
Veröffentlicht: (2026)
von: Yang, Zhi, et al.
Veröffentlicht: (2026)
Taming Lookup Tables for Efficient Image Retouching
von: Yang, Sidi, et al.
Veröffentlicht: (2024)
von: Yang, Sidi, et al.
Veröffentlicht: (2024)
ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis
von: Yu, Wangbo, et al.
Veröffentlicht: (2024)
von: Yu, Wangbo, et al.
Veröffentlicht: (2024)
UniBYD: A Unified Framework for Learning Robotic Manipulation Across Embodiments Beyond Imitation of Human Demonstrations
von: Yuan, Tingyu, et al.
Veröffentlicht: (2025)
von: Yuan, Tingyu, et al.
Veröffentlicht: (2025)
UniSim: A Unified Simulator for Time-Coarsened Dynamics of Biomolecules
von: Yu, Ziyang, et al.
Veröffentlicht: (2025)
von: Yu, Ziyang, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models
von: Jiang, Hong, et al.
Veröffentlicht: (2026) -
UniGeo: A Unified 3D Indoor Object Detection Framework Integrating Geometry-Aware Learning and Dynamic Channel Gating
von: Yi, Xing, et al.
Veröffentlicht: (2026) -
UniTok: A Unified Tokenizer for Visual Generation and Understanding
von: Ma, Chuofan, et al.
Veröffentlicht: (2025) -
UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation
von: Wang, Xiang, et al.
Veröffentlicht: (2024) -
Stereo World Model: Camera-Guided Stereo Video Generation
von: Sun, Yang-Tian, et al.
Veröffentlicht: (2026)