Generative Camera Dolly: Extreme Monocular Dynamic Novel View Synthesis
Fuente:
arXiv
Salvato in:
| Autori principali: | Van Hoorick, Basile, Wu, Rundi, Ozguroglu, Ege, Sargent, Kyle, Liu, Ruoshi, Tokmakov, Pavel, Dave, Achal, Zheng, Changxi, Vondrick, Carl |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
pix2gestalt: Amodal Segmentation by Synthesizing Wholes
di: Ozguroglu, Ege, et al.
Pubblicazione: (2024)
di: Ozguroglu, Ege, et al.
Pubblicazione: (2024)
Dreamitate: Real-World Visuomotor Policy Learning via Video Generation
di: Liang, Junbang, et al.
Pubblicazione: (2024)
di: Liang, Junbang, et al.
Pubblicazione: (2024)
Sin3DM: Learning a Diffusion Model from a Single 3D Textured Shape
di: Wu, Rundi, et al.
Pubblicazione: (2023)
di: Wu, Rundi, et al.
Pubblicazione: (2023)
EraseDraw: Learning to Draw Step-by-Step via Erasing Objects from Images
di: Canberk, Alper, et al.
Pubblicazione: (2024)
di: Canberk, Alper, et al.
Pubblicazione: (2024)
Controlling the World by Sleight of Hand
di: Sudhakar, Sruthi, et al.
Pubblicazione: (2024)
di: Sudhakar, Sruthi, et al.
Pubblicazione: (2024)
AnyView: Synthesizing Any Novel View in Dynamic Scenes
di: Van Hoorick, Basile, et al.
Pubblicazione: (2026)
di: Van Hoorick, Basile, et al.
Pubblicazione: (2026)
Video Generators are Robot Policies
di: Liang, Junbang, et al.
Pubblicazione: (2025)
di: Liang, Junbang, et al.
Pubblicazione: (2025)
GRIN: Zero-Shot Metric Depth with Pixel-Level Diffusion
di: Guizilini, Vitor, et al.
Pubblicazione: (2024)
di: Guizilini, Vitor, et al.
Pubblicazione: (2024)
AnchorDream: Repurposing Video Diffusion for Embodiment-Aware Robot Data Synthesis
di: Ye, Junjie, et al.
Pubblicazione: (2025)
di: Ye, Junjie, et al.
Pubblicazione: (2025)
New York Smells: A Large Multimodal Dataset for Olfaction
di: Ozguroglu, Ege, et al.
Pubblicazione: (2025)
di: Ozguroglu, Ege, et al.
Pubblicazione: (2025)
RoboDream: Compositional World Models for Scalable Robot Data Synthesis
di: Ye, Junjie, et al.
Pubblicazione: (2026)
di: Ye, Junjie, et al.
Pubblicazione: (2026)
Spatiotemporally Consistent Indoor Lighting Estimation with Diffusion Priors
di: Tong, Mutian, et al.
Pubblicazione: (2025)
di: Tong, Mutian, et al.
Pubblicazione: (2025)
Differentiable Robot Rendering
di: Liu, Ruoshi, et al.
Pubblicazione: (2024)
di: Liu, Ruoshi, et al.
Pubblicazione: (2024)
Understanding Video Transformers via Universal Concept Discovery
di: Kowal, Matthew, et al.
Pubblicazione: (2024)
di: Kowal, Matthew, et al.
Pubblicazione: (2024)
Zero-Shot Open-Vocabulary Tracking with Large Pre-Trained Models
di: Chu, Wen-Hsuan, et al.
Pubblicazione: (2023)
di: Chu, Wen-Hsuan, et al.
Pubblicazione: (2023)
Self-Improving Autonomous Underwater Manipulation
di: Liu, Ruoshi, et al.
Pubblicazione: (2024)
di: Liu, Ruoshi, et al.
Pubblicazione: (2024)
Fiducial Exoskeletons: Image-Centric Robot State Estimation
di: Smith, Cameron, et al.
Pubblicazione: (2026)
di: Smith, Cameron, et al.
Pubblicazione: (2026)
SIRE: SE(3) Intrinsic Rigidity Embeddings
di: Smith, Cameron, et al.
Pubblicazione: (2025)
di: Smith, Cameron, et al.
Pubblicazione: (2025)
CAT4D: Create Anything in 4D with Multi-View Video Diffusion Models
di: Wu, Rundi, et al.
Pubblicazione: (2024)
di: Wu, Rundi, et al.
Pubblicazione: (2024)
View-Invariant Policy Learning via Zero-Shot Novel View Synthesis
di: Tian, Stephen, et al.
Pubblicazione: (2024)
di: Tian, Stephen, et al.
Pubblicazione: (2024)
4D Gaussian Splatting as a Learned Dynamical System
di: Asiimwe, Arnold Caleb, et al.
Pubblicazione: (2025)
di: Asiimwe, Arnold Caleb, et al.
Pubblicazione: (2025)
Extreme Views: 3DGS Filter for Novel View Synthesis from Out-of-Distribution Camera Poses
di: Bowness, Damian, et al.
Pubblicazione: (2025)
di: Bowness, Damian, et al.
Pubblicazione: (2025)
Understanding Complexity in VideoQA via Visual Program Generation
di: Eyzaguirre, Cristobal, et al.
Pubblicazione: (2025)
di: Eyzaguirre, Cristobal, et al.
Pubblicazione: (2025)
Dynamic Gaussian Marbles for Novel View Synthesis of Casual Monocular Videos
di: Stearns, Colton, et al.
Pubblicazione: (2024)
di: Stearns, Colton, et al.
Pubblicazione: (2024)
Generative 4D Scene Gaussian Splatting with Object View-Synthesis Priors
di: Chu, Wen-Hsuan, et al.
Pubblicazione: (2025)
di: Chu, Wen-Hsuan, et al.
Pubblicazione: (2025)
PaperBot: Learning to Design Real-World Tools Using Paper
di: Liu, Ruoshi, et al.
Pubblicazione: (2024)
di: Liu, Ruoshi, et al.
Pubblicazione: (2024)
Decoupling Dynamic Monocular Videos for Dynamic View Synthesis
di: You, Meng, et al.
Pubblicazione: (2023)
di: You, Meng, et al.
Pubblicazione: (2023)
Neural Radiance Fields for Novel View Synthesis in Monocular Gastroscopy
di: Jiang, Zijie, et al.
Pubblicazione: (2024)
di: Jiang, Zijie, et al.
Pubblicazione: (2024)
VLMaterial: Procedural Material Generation with Large Vision-Language Models
di: Li, Beichen, et al.
Pubblicazione: (2025)
di: Li, Beichen, et al.
Pubblicazione: (2025)
Hello, Dolly
Pubblicazione: (1997)
Pubblicazione: (1997)
Generalizable Novel-View Synthesis using a Stereo Camera
di: Lee, Haechan, et al.
Pubblicazione: (2024)
di: Lee, Haechan, et al.
Pubblicazione: (2024)
Diffusion Priors for Dynamic View Synthesis from Monocular Videos
di: Wang, Chaoyang, et al.
Pubblicazione: (2024)
di: Wang, Chaoyang, et al.
Pubblicazione: (2024)
GES: Generalized Exponential Splatting for Efficient Radiance Field Rendering
di: Hamdi, Abdullah, et al.
Pubblicazione: (2024)
di: Hamdi, Abdullah, et al.
Pubblicazione: (2024)
Whiteboard-of-Thought: Thinking Step-by-Step Across Modalities
di: Menon, Sachit, et al.
Pubblicazione: (2024)
di: Menon, Sachit, et al.
Pubblicazione: (2024)
SelfIE: Self-Interpretation of Large Language Model Embeddings
di: Chen, Haozhe, et al.
Pubblicazione: (2024)
di: Chen, Haozhe, et al.
Pubblicazione: (2024)
Few-Shot Design Optimization by Exploiting Auxiliary Information
di: Mani, Arjun, et al.
Pubblicazione: (2026)
di: Mani, Arjun, et al.
Pubblicazione: (2026)
Evolving Interpretable Visual Classifiers with Large Language Models
di: Chiquier, Mia, et al.
Pubblicazione: (2024)
di: Chiquier, Mia, et al.
Pubblicazione: (2024)
Broadening View Synthesis of Dynamic Scenes from Constrained Monocular Videos
di: Jiang, Le, et al.
Pubblicazione: (2025)
di: Jiang, Le, et al.
Pubblicazione: (2025)
GRVS: a Generalizable and Recurrent Approach to Monocular Dynamic View Synthesis
di: Tanay, Thomas, et al.
Pubblicazione: (2026)
di: Tanay, Thomas, et al.
Pubblicazione: (2026)
Dynamic View Synthesis from Small Camera Motion Videos
di: Sun, Huiqiang, et al.
Pubblicazione: (2025)
di: Sun, Huiqiang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
pix2gestalt: Amodal Segmentation by Synthesizing Wholes
di: Ozguroglu, Ege, et al.
Pubblicazione: (2024) -
Dreamitate: Real-World Visuomotor Policy Learning via Video Generation
di: Liang, Junbang, et al.
Pubblicazione: (2024) -
Sin3DM: Learning a Diffusion Model from a Single 3D Textured Shape
di: Wu, Rundi, et al.
Pubblicazione: (2023) -
EraseDraw: Learning to Draw Step-by-Step via Erasing Objects from Images
di: Canberk, Alper, et al.
Pubblicazione: (2024) -
Controlling the World by Sleight of Hand
di: Sudhakar, Sruthi, et al.
Pubblicazione: (2024)