Puzzles: Unbounded Video-Depth Augmentation for Scalable End-to-End 3D Reconstruction
Fuente:
arXiv
Saved in:
| Main Authors: | Ma, Jiahao, Wang, Lei, liu, Miaomiao, Ahmedt-Aristizabal, David, Nguyen, Chuong |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DCHM: Depth-Consistent Human Modeling for Multiview Detection
by: Ma, Jiahao, et al.
Published: (2025)
by: Ma, Jiahao, et al.
Published: (2025)
HashPoint: Accelerated Point Searching and Sampling for Neural Rendering
by: Ma, Jiahao, et al.
Published: (2024)
by: Ma, Jiahao, et al.
Published: (2024)
SOAF: Scene Occlusion-aware Neural Acoustic Field
by: Gao, Huiyu, et al.
Published: (2024)
by: Gao, Huiyu, et al.
Published: (2024)
SALVE: A 3D Reconstruction Benchmark of Wounds from Consumer-grade Videos
by: Chierchia, Remi, et al.
Published: (2024)
by: Chierchia, Remi, et al.
Published: (2024)
Monitoring of Pigmented Skin Lesions Using 3D Whole Body Imaging
by: Ahmedt-Aristizabal, David, et al.
Published: (2022)
by: Ahmedt-Aristizabal, David, et al.
Published: (2022)
Mining Supervision for Dynamic Regions in Self-Supervised Monocular Depth Estimation
by: Nguyen, Hoang Chuong, et al.
Published: (2024)
by: Nguyen, Hoang Chuong, et al.
Published: (2024)
Wound3DAssist: A Practical Framework for 3D Wound Assessment
by: Chierchia, Remi, et al.
Published: (2025)
by: Chierchia, Remi, et al.
Published: (2025)
SS3D: End2End Self-Supervised 3D from Web Videos
by: Hariat, Marwane, et al.
Published: (2026)
by: Hariat, Marwane, et al.
Published: (2026)
Joint Optimization of Neural Radiance Fields and Continuous Camera Motion from a Monocular Video
by: Nguyen, Hoang Chuong, et al.
Published: (2025)
by: Nguyen, Hoang Chuong, et al.
Published: (2025)
RAP: 3D Rasterization Augmented End-to-End Planning
by: Feng, Lan, et al.
Published: (2025)
by: Feng, Lan, et al.
Published: (2025)
End-to-End HOI Reconstruction Transformer with Graph-based Encoding
by: Wang, Zhenrong, et al.
Published: (2025)
by: Wang, Zhenrong, et al.
Published: (2025)
PAVE: An End-to-End Dataset for Production Autonomous Vehicle Evaluation
by: Li, Xiangyu, et al.
Published: (2025)
by: Li, Xiangyu, et al.
Published: (2025)
In Depth We Trust: Reliable Monocular Depth Supervision for Gaussian Splatting
by: Xiao, Wenhui, et al.
Published: (2026)
by: Xiao, Wenhui, et al.
Published: (2026)
An End-to-End Depth-Based Pipeline for Selfie Image Rectification
by: Alhawwary, Ahmed, et al.
Published: (2024)
by: Alhawwary, Ahmed, et al.
Published: (2024)
SDformer: Efficient End-to-End Transformer for Depth Completion
by: Qian, Jian, et al.
Published: (2024)
by: Qian, Jian, et al.
Published: (2024)
VLM-3D:End-to-End Vision-Language Models for Open-World 3D Perception
by: Chang, Fuhao, et al.
Published: (2025)
by: Chang, Fuhao, et al.
Published: (2025)
Knowledge Priors for Identity-Disentangled Open-Set Privacy-Preserving Video FER
by: Xu, Feng, et al.
Published: (2026)
by: Xu, Feng, et al.
Published: (2026)
Non-Invasive 3D Wound Measurement with RGB-D Imaging
by: Harkämper, Lena, et al.
Published: (2026)
by: Harkämper, Lena, et al.
Published: (2026)
EVA: Efficient Reinforcement Learning for End-to-End Video Agent
by: Zhang, Yaolun, et al.
Published: (2026)
by: Zhang, Yaolun, et al.
Published: (2026)
Drive&Gen: Co-Evaluating End-to-End Driving and Video Generation Models
by: Wang, Jiahao, et al.
Published: (2025)
by: Wang, Jiahao, et al.
Published: (2025)
MoCha:End-to-End Video Character Replacement without Structural Guidance
by: Xu, Zhengbo, et al.
Published: (2026)
by: Xu, Zhengbo, et al.
Published: (2026)
Unify3D: An Augmented Holistic End-to-end Monocular 3D Human Reconstruction via Anatomy Shaping and Twins Negotiating
by: Yao, Nanjie, et al.
Published: (2025)
by: Yao, Nanjie, et al.
Published: (2025)
First Shape, Then Meaning: Efficient Geometry and Semantics Learning for Indoor Reconstruction
by: Chierchia, Remi, et al.
Published: (2026)
by: Chierchia, Remi, et al.
Published: (2026)
End-to-End Dense Video Grounding via Parallel Regression
by: Shi, Fengyuan, et al.
Published: (2021)
by: Shi, Fengyuan, et al.
Published: (2021)
End-to-End Spatial-Temporal Transformer for Real-time 4D HOI Reconstruction
by: Zhang, Haoyu, et al.
Published: (2026)
by: Zhang, Haoyu, et al.
Published: (2026)
LMVC: An End-to-End Learned Multiview Video Coding Framework
by: Sheng, Xihua, et al.
Published: (2025)
by: Sheng, Xihua, et al.
Published: (2025)
BiFM: Bidirectional Flow Matching for Few-Step Image Editing and Generation
by: Dai, Yasong, et al.
Published: (2026)
by: Dai, Yasong, et al.
Published: (2026)
Video-Based Inpatient Fall Risk Assessment: A Case Study
by: Wang, Ziqing, et al.
Published: (2021)
by: Wang, Ziqing, et al.
Published: (2021)
RoSplat: Robust Feed-Forward Pixel-wise Gaussian Splatting for Varying Input Views and High-Resolution Rendering
by: Nguyen, Hoang Chuong, et al.
Published: (2026)
by: Nguyen, Hoang Chuong, et al.
Published: (2026)
IBGS: Image-Based Gaussian Splatting
by: Nguyen, Hoang Chuong, et al.
Published: (2025)
by: Nguyen, Hoang Chuong, et al.
Published: (2025)
CoopTrack: Exploring End-to-End Learning for Efficient Cooperative Sequential Perception
by: Zhong, Jiaru, et al.
Published: (2025)
by: Zhong, Jiaru, et al.
Published: (2025)
End to End Face Reconstruction via Differentiable PnP
by: Lu, Yiren, et al.
Published: (2024)
by: Lu, Yiren, et al.
Published: (2024)
End-to-End Facial Expression Detection in Long Videos
by: Fang, Yini, et al.
Published: (2025)
by: Fang, Yini, et al.
Published: (2025)
Computer Vision for Clinical Gait Analysis: A Gait Abnormality Video Dataset
by: Ranjan, Rahm, et al.
Published: (2024)
by: Ranjan, Rahm, et al.
Published: (2024)
E3D-Bench: A Benchmark for End-to-End 3D Geometric Foundation Models
by: Cong, Wenyan, et al.
Published: (2025)
by: Cong, Wenyan, et al.
Published: (2025)
Hunyuan3D Studio: End-to-End AI Pipeline for Game-Ready 3D Asset Generation
by: Lei, Biwen, et al.
Published: (2025)
by: Lei, Biwen, et al.
Published: (2025)
Syn3DWound: A Synthetic Dataset for 3D Wound Bed Analysis
by: Lebrat, Léo, et al.
Published: (2023)
by: Lebrat, Léo, et al.
Published: (2023)
Weaver: End-to-End Agentic System Training for Video Interleaved Reasoning
by: Shi, Yudi, et al.
Published: (2026)
by: Shi, Yudi, et al.
Published: (2026)
Unleashing Generalization of End-to-End Autonomous Driving with Controllable Long Video Generation
by: Ma, Enhui, et al.
Published: (2024)
by: Ma, Enhui, et al.
Published: (2024)
Facial Expression Recognition with Controlled Privacy Preservation and Feature Compensation
by: Xu, Feng, et al.
Published: (2024)
by: Xu, Feng, et al.
Published: (2024)
Similar Items
-
DCHM: Depth-Consistent Human Modeling for Multiview Detection
by: Ma, Jiahao, et al.
Published: (2025) -
HashPoint: Accelerated Point Searching and Sampling for Neural Rendering
by: Ma, Jiahao, et al.
Published: (2024) -
SOAF: Scene Occlusion-aware Neural Acoustic Field
by: Gao, Huiyu, et al.
Published: (2024) -
SALVE: A 3D Reconstruction Benchmark of Wounds from Consumer-grade Videos
by: Chierchia, Remi, et al.
Published: (2024) -
Monitoring of Pigmented Skin Lesions Using 3D Whole Body Imaging
by: Ahmedt-Aristizabal, David, et al.
Published: (2022)