Elastic3D: Controllable Stereo Video Conversion with Guided Latent Decoding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Metzger, Nando, Truong, Prune, Bhat, Goutam, Schindler, Konrad, Tombari, Federico |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
M2SVid: End-to-End Inpainting and Refinement for Monocular-to-Stereo Video Conversion
par: Shvetsova, Nina, et autres
Publié: (2025)
par: Shvetsova, Nina, et autres
Publié: (2025)
Text-to-3D by Stitching a Multi-view Reconstruction Network to a Video Generator
par: Go, Hyojun, et autres
Publié: (2025)
par: Go, Hyojun, et autres
Publié: (2025)
Stitched Value Model for Diffusion Alignment
par: Go, Hyojun, et autres
Publié: (2026)
par: Go, Hyojun, et autres
Publié: (2026)
High-resolution Population Maps Derived from Sentinel-1 and Sentinel-2
par: Metzger, Nando, et autres
Publié: (2023)
par: Metzger, Nando, et autres
Publié: (2023)
One2Any: One-Reference 6D Pose Estimation for Any Object
par: Liu, Mengya, et autres
Publié: (2025)
par: Liu, Mengya, et autres
Publié: (2025)
Marigold-DC: Zero-Shot Monocular Depth Completion with Guided Diffusion
par: Viola, Massimiliano, et autres
Publié: (2024)
par: Viola, Massimiliano, et autres
Publié: (2024)
Repurposing Diffusion-Based Image Generators for Monocular Depth Estimation
par: Ke, Bingxin, et autres
Publié: (2023)
par: Ke, Bingxin, et autres
Publié: (2023)
Need for Speed: Zero-Shot Depth Completion with Single-Step Diffusion
par: Gregorek, Jakub, et autres
Publié: (2026)
par: Gregorek, Jakub, et autres
Publié: (2026)
BetterDepth: Plug-and-Play Diffusion Refiner for Zero-Shot Monocular Depth Estimation
par: Zhang, Xiang, et autres
Publié: (2024)
par: Zhang, Xiang, et autres
Publié: (2024)
Thera: Aliasing-Free Arbitrary-Scale Super-Resolution with Neural Heat Fields
par: Becker, Alexander, et autres
Publié: (2023)
par: Becker, Alexander, et autres
Publié: (2023)
Consistency^2: Consistent and Fast 3D Painting with Latent Consistency Models
par: Wang, Tianfu, et autres
Publié: (2024)
par: Wang, Tianfu, et autres
Publié: (2024)
AnyUp: Universal Feature Upsampling
par: Wimmer, Thomas, et autres
Publié: (2025)
par: Wimmer, Thomas, et autres
Publié: (2025)
3D-LATTE: Latent Space 3D Editing from Textual Instructions
par: Parelli, Maria, et autres
Publié: (2025)
par: Parelli, Maria, et autres
Publié: (2025)
Unified Panoramic Geometry Estimation via Multi-View Foundation Models
par: Bozic, Vukasin, et autres
Publié: (2026)
par: Bozic, Vukasin, et autres
Publié: (2026)
The Potential of Copernicus Satellites for Disaster Response: Retrieving Building Damage from Sentinel-1 and Sentinel-2
par: Dietrich, Olivier, et autres
Publié: (2025)
par: Dietrich, Olivier, et autres
Publié: (2025)
LayoutVLM: Differentiable Optimization of 3D Layout via Vision-Language Models
par: Sun, Fan-Yun, et autres
Publié: (2024)
par: Sun, Fan-Yun, et autres
Publié: (2024)
StereoSpace: Depth-Free Synthesis of Stereo Geometry via End-to-End Diffusion in a Canonical Space
par: Behrens, Tjark, et autres
Publié: (2025)
par: Behrens, Tjark, et autres
Publié: (2025)
Continuous Space-Time Video Super-Resolution with 3D Fourier Fields
par: Becker, Alexander, et autres
Publié: (2025)
par: Becker, Alexander, et autres
Publié: (2025)
Marigold: Affordable Adaptation of Diffusion-Based Image Generators for Image Analysis
par: Ke, Bingxin, et autres
Publié: (2025)
par: Ke, Bingxin, et autres
Publié: (2025)
Stereo World Model: Camera-Guided Stereo Video Generation
par: Sun, Yang-Tian, et autres
Publié: (2026)
par: Sun, Yang-Tian, et autres
Publié: (2026)
CubeDiff: Repurposing Diffusion-Based Image Models for Panorama Generation
par: Kalischek, Nikolai, et autres
Publié: (2025)
par: Kalischek, Nikolai, et autres
Publié: (2025)
Language-Guided Open-World Anomaly Segmentation
par: Reichard, Klara, et autres
Publié: (2025)
par: Reichard, Klara, et autres
Publié: (2025)
Video Perception Models for 3D Scene Synthesis
par: Huang, Rui, et autres
Publié: (2025)
par: Huang, Rui, et autres
Publié: (2025)
Epipolar Geometry Improves Video Generation Models
par: Kupyn, Orest, et autres
Publié: (2025)
par: Kupyn, Orest, et autres
Publié: (2025)
Gaussians-to-Life: Text-Driven Animation of 3D Gaussian Splatting Scenes
par: Wimmer, Thomas, et autres
Publié: (2024)
par: Wimmer, Thomas, et autres
Publié: (2024)
Stereo4D: Learning How Things Move in 3D from Internet Stereo Videos
par: Jin, Linyi, et autres
Publié: (2024)
par: Jin, Linyi, et autres
Publié: (2024)
HyperSDFusion: Bridging Hierarchical Structures in Language and Geometry for Enhanced 3D Text2Shape Generation
par: Leng, Zhiying, et autres
Publié: (2024)
par: Leng, Zhiying, et autres
Publié: (2024)
Object-X: Learning to Reconstruct Multi-Modal 3D Object Representations
par: Di Lorenzo, Gaia, et autres
Publié: (2025)
par: Di Lorenzo, Gaia, et autres
Publié: (2025)
VideoLifter: Lifting Videos to 3D with Fast Hierarchical Stereo Alignment
par: Cong, Wenyan, et autres
Publié: (2025)
par: Cong, Wenyan, et autres
Publié: (2025)
WorldStereo: Bridging Camera-Guided Video Generation and Scene Reconstruction via 3D Geometric Memories
par: Zhang, Yisu, et autres
Publié: (2026)
par: Zhang, Yisu, et autres
Publié: (2026)
Text-Conditioned Resampler For Long Form Video Understanding
par: Korbar, Bruno, et autres
Publié: (2023)
par: Korbar, Bruno, et autres
Publié: (2023)
Search3D: Hierarchical Open-Vocabulary 3D Segmentation
par: Takmaz, Ayca, et autres
Publié: (2024)
par: Takmaz, Ayca, et autres
Publié: (2024)
SpatialMe: Stereo Video Conversion Using Depth-Warping and Blend-Inpainting
par: Zhang, Jiale, et autres
Publié: (2024)
par: Zhang, Jiale, et autres
Publié: (2024)
Living Scenes: Multi-object Relocalization and Reconstruction in Changing 3D Environments
par: Zhu, Liyuan, et autres
Publié: (2023)
par: Zhu, Liyuan, et autres
Publié: (2023)
LaRI: Layered Ray Intersections for Single-view 3D Geometric Reasoning
par: Li, Rui, et autres
Publié: (2025)
par: Li, Rui, et autres
Publié: (2025)
AGILE3D: Attention Guided Interactive Multi-object 3D Segmentation
par: Yue, Yuanwen, et autres
Publié: (2023)
par: Yue, Yuanwen, et autres
Publié: (2023)
3D Human Pose Perception from Egocentric Stereo Videos
par: Akada, Hiroyasu, et autres
Publié: (2023)
par: Akada, Hiroyasu, et autres
Publié: (2023)
Mono2Stereo: A Benchmark and Empirical Study for Stereo Conversion
par: Yu, Songsong, et autres
Publié: (2025)
par: Yu, Songsong, et autres
Publié: (2025)
CausNVS: Autoregressive Multi-view Diffusion for Flexible 3D Novel View Synthesis
par: Kong, Xin, et autres
Publié: (2025)
par: Kong, Xin, et autres
Publié: (2025)
MonoGSDF: Exploring Monocular Geometric Cues for Gaussian Splatting-Guided Implicit Surface Reconstruction
par: Li, Kunyi, et autres
Publié: (2024)
par: Li, Kunyi, et autres
Publié: (2024)
Documents similaires
-
M2SVid: End-to-End Inpainting and Refinement for Monocular-to-Stereo Video Conversion
par: Shvetsova, Nina, et autres
Publié: (2025) -
Text-to-3D by Stitching a Multi-view Reconstruction Network to a Video Generator
par: Go, Hyojun, et autres
Publié: (2025) -
Stitched Value Model for Diffusion Alignment
par: Go, Hyojun, et autres
Publié: (2026) -
High-resolution Population Maps Derived from Sentinel-1 and Sentinel-2
par: Metzger, Nando, et autres
Publié: (2023) -
One2Any: One-Reference 6D Pose Estimation for Any Object
par: Liu, Mengya, et autres
Publié: (2025)