SpatialDreamer: Self-supervised Stereo Video Synthesis from Monocular Input
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lv, Zhen, Long, Yangqi, Huang, Congzhentao, Li, Cao, Lv, Chengfei, Ren, Hao, Zheng, Dian |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SpatialDreamer: Incentivizing Spatial Reasoning via Active Mental Imagery
par: Cao, Meng, et autres
Publié: (2025)
par: Cao, Meng, et autres
Publié: (2025)
StereoWorld: Geometry-Aware Monocular-to-Stereo Video Generation
par: Xing, Ke, et autres
Publié: (2025)
par: Xing, Ke, et autres
Publié: (2025)
Eye2Eye: A Simple Approach for Monocular-to-Stereo Video Synthesis
par: Geyer, Michal, et autres
Publié: (2025)
par: Geyer, Michal, et autres
Publié: (2025)
Panorama Generation From NFoV Image Done Right
par: Zheng, Dian, et autres
Publié: (2025)
par: Zheng, Dian, et autres
Publié: (2025)
Self-supervised Monocular Depth Estimation with Large Kernel Attention
par: Xiang, Xuezhi, et autres
Publié: (2024)
par: Xiang, Xuezhi, et autres
Publié: (2024)
Pseudo-Stereo Inputs: A Solution to the Occlusion Challenge in Self-Supervised Stereo Matching
par: Yang, Ruizhi, et autres
Publié: (2024)
par: Yang, Ruizhi, et autres
Publié: (2024)
4DGT: Learning a 4D Gaussian Transformer Using Real-World Monocular Videos
par: Xu, Zhen, et autres
Publié: (2025)
par: Xu, Zhen, et autres
Publié: (2025)
Adaptive Discrete Disparity Volume for Self-supervised Monocular Depth Estimation
par: Ren, Jianwei
Publié: (2024)
par: Ren, Jianwei
Publié: (2024)
DreamStereo: Towards Real-Time Stereo Inpainting for HD Videos
par: Huang, Yuan, et autres
Publié: (2026)
par: Huang, Yuan, et autres
Publié: (2026)
Stereo World Model: Camera-Guided Stereo Video Generation
par: Sun, Yang-Tian, et autres
Publié: (2026)
par: Sun, Yang-Tian, et autres
Publié: (2026)
Mono2Stereo: Monocular Knowledge Transfer for Enhanced Stereo Matching
par: Wang, Yuran, et autres
Publié: (2024)
par: Wang, Yuran, et autres
Publié: (2024)
SMFormer: Empowering Self-supervised Stereo Matching via Foundation Models and Data Augmentation
par: Wang, Yun, et autres
Publié: (2026)
par: Wang, Yun, et autres
Publié: (2026)
Self Adaptive Threshold Pseudo-labeling and Unreliable Sample Contrastive Loss for Semi-supervised Image Classification
par: Zhang, Xuerong, et autres
Publié: (2024)
par: Zhang, Xuerong, et autres
Publié: (2024)
Self-Calibrating 4D Novel View Synthesis from Monocular Videos Using Gaussian Splatting
par: Li, Fang, et autres
Publié: (2024)
par: Li, Fang, et autres
Publié: (2024)
M2SVid: End-to-End Inpainting and Refinement for Monocular-to-Stereo Video Conversion
par: Shvetsova, Nina, et autres
Publié: (2025)
par: Shvetsova, Nina, et autres
Publié: (2025)
BINO: Encoder Centric Self Supervised Stereo With Native Pair Input
par: Zhou, Haokun
Publié: (2026)
par: Zhou, Haokun
Publié: (2026)
Self-supervised Pretraining and Finetuning for Monocular Depth and Visual Odometry
par: Chidlovskii, Boris, et autres
Publié: (2024)
par: Chidlovskii, Boris, et autres
Publié: (2024)
DO3D: Self-supervised Learning of Decomposed Object-aware 3D Motion and Depth from Monocular Videos
par: Wu, Xiuzhe, et autres
Publié: (2024)
par: Wu, Xiuzhe, et autres
Publié: (2024)
OutDreamer: Video Outpainting with a Diffusion Transformer
par: Zhong, Linhao, et autres
Publié: (2025)
par: Zhong, Linhao, et autres
Publié: (2025)
Neural Multi-View Self-Calibrated Photometric Stereo without Photometric Stereo Cues
par: Cao, Xu, et autres
Publié: (2025)
par: Cao, Xu, et autres
Publié: (2025)
Diffusion Priors for Dynamic View Synthesis from Monocular Videos
par: Wang, Chaoyang, et autres
Publié: (2024)
par: Wang, Chaoyang, et autres
Publié: (2024)
DASP: Self-supervised Nighttime Monocular Depth Estimation with Domain Adaptation of Spatiotemporal Priors
par: Huang, Yiheng, et autres
Publié: (2025)
par: Huang, Yiheng, et autres
Publié: (2025)
Diving into the Fusion of Monocular Priors for Generalized Stereo Matching
par: Yao, Chengtang, et autres
Publié: (2025)
par: Yao, Chengtang, et autres
Publié: (2025)
DriveDreamer-2: LLM-Enhanced World Models for Diverse Driving Video Generation
par: Zhao, Guosheng, et autres
Publié: (2024)
par: Zhao, Guosheng, et autres
Publié: (2024)
NimbleD: Enhancing Self-supervised Monocular Depth Estimation with Pseudo-labels and Large-scale Video Pre-training
par: Luginov, Albert, et autres
Publié: (2024)
par: Luginov, Albert, et autres
Publié: (2024)
WorldDreamer: Towards General World Models for Video Generation via Predicting Masked Tokens
par: Wang, Xiaofeng, et autres
Publié: (2024)
par: Wang, Xiaofeng, et autres
Publié: (2024)
HumanDreamer: Generating Controllable Human-Motion Videos via Decoupled Generation
par: Wang, Boyuan, et autres
Publié: (2025)
par: Wang, Boyuan, et autres
Publié: (2025)
StereoCarla: A High-Fidelity Driving Dataset for Generalizable Stereo
par: Guo, Xianda, et autres
Publié: (2025)
par: Guo, Xianda, et autres
Publié: (2025)
FA-Depth: Toward Fast and Accurate Self-supervised Monocular Depth Estimation
par: Wang, Fei, et autres
Publié: (2024)
par: Wang, Fei, et autres
Publié: (2024)
Adaptive Depth-converted-Scale Convolution for Self-supervised Monocular Depth Estimation
par: Gao, Yanbo, et autres
Publié: (2026)
par: Gao, Yanbo, et autres
Publié: (2026)
ViDAR: Video Diffusion-Aware 4D Reconstruction From Monocular Inputs
par: Nazarczuk, Michal, et autres
Publié: (2025)
par: Nazarczuk, Michal, et autres
Publié: (2025)
GaussVideoDreamer: 3D Scene Generation with Video Diffusion and Inconsistency-Aware Gaussian Splatting
par: Hao, Junlin, et autres
Publié: (2025)
par: Hao, Junlin, et autres
Publié: (2025)
ClotheDreamer: Text-Guided Garment Generation with 3D Gaussians
par: Liu, Yufei, et autres
Publié: (2024)
par: Liu, Yufei, et autres
Publié: (2024)
StereoAdapter-2: Globally Structure-Consistent Underwater Stereo Depth Estimation
par: Ren, Zeyu, et autres
Publié: (2026)
par: Ren, Zeyu, et autres
Publié: (2026)
Decoupling Dynamic Monocular Videos for Dynamic View Synthesis
par: You, Meng, et autres
Publié: (2023)
par: You, Meng, et autres
Publié: (2023)
Prism: Semi-Supervised Multi-View Stereo with Monocular Structure Priors
par: Rich, Alex, et autres
Publié: (2024)
par: Rich, Alex, et autres
Publié: (2024)
MonoMVSNet: Monocular Priors Guided Multi-View Stereo Network
par: Jiang, Jianfei, et autres
Publié: (2025)
par: Jiang, Jianfei, et autres
Publié: (2025)
Self-supervised Event-based Monocular Depth Estimation using Cross-modal Consistency
par: Zhu, Junyu, et autres
Publié: (2024)
par: Zhu, Junyu, et autres
Publié: (2024)
Self-supervised Adversarial Training of Monocular Depth Estimation against Physical-World Attacks
par: Cheng, Zhiyuan, et autres
Publié: (2024)
par: Cheng, Zhiyuan, et autres
Publié: (2024)
BaseBoostDepth: Exploiting Larger Baselines For Self-supervised Monocular Depth Estimation
par: Saunders, Kieran, et autres
Publié: (2024)
par: Saunders, Kieran, et autres
Publié: (2024)
Documents similaires
-
SpatialDreamer: Incentivizing Spatial Reasoning via Active Mental Imagery
par: Cao, Meng, et autres
Publié: (2025) -
StereoWorld: Geometry-Aware Monocular-to-Stereo Video Generation
par: Xing, Ke, et autres
Publié: (2025) -
Eye2Eye: A Simple Approach for Monocular-to-Stereo Video Synthesis
par: Geyer, Michal, et autres
Publié: (2025) -
Panorama Generation From NFoV Image Done Right
par: Zheng, Dian, et autres
Publié: (2025) -
Self-supervised Monocular Depth Estimation with Large Kernel Attention
par: Xiang, Xuezhi, et autres
Publié: (2024)