SS3D: End2End Self-Supervised 3D from Web Videos
Fuente:
arXiv
Guardado en:
| Autores principales: | Hariat, Marwane, Franchi, Gianni, Filliat, David, Manzanera, Antoine |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Rebalancing gradient to improve self-supervised co-training of depth, odometry and optical flow predictions
por: Hariat, Marwane, et al.
Publicado: (2026)
por: Hariat, Marwane, et al.
Publicado: (2026)
Improved monocular depth prediction using distance transform over pre-semantic contours with self-supervised neural networks
por: Hariat, Marwane, et al.
Publicado: (2026)
por: Hariat, Marwane, et al.
Publicado: (2026)
Learning to Generate Training Datasets for Robust Semantic Segmentation
por: Hariat, Marwane, et al.
Publicado: (2023)
por: Hariat, Marwane, et al.
Publicado: (2023)
Hierarchical Light Transformer Ensembles for Multimodal Trajectory Forecasting
por: Lafage, Adrien, et al.
Publicado: (2024)
por: Lafage, Adrien, et al.
Publicado: (2024)
BEEP3D: Box-Supervised End-to-End Pseudo-Mask Generation for 3D Instance Segmentation
por: Yoo, Youngju, et al.
Publicado: (2025)
por: Yoo, Youngju, et al.
Publicado: (2025)
Puzzles: Unbounded Video-Depth Augmentation for Scalable End-to-End 3D Reconstruction
por: Ma, Jiahao, et al.
Publicado: (2025)
por: Ma, Jiahao, et al.
Publicado: (2025)
NECO: NEural Collapse Based Out-of-distribution detection
por: Ammar, Mouïn Ben, et al.
Publicado: (2023)
por: Ammar, Mouïn Ben, et al.
Publicado: (2023)
Rethinking End-to-End 2D to 3D Scene Segmentation in Gaussian Splatting
por: Zhu, Runsong, et al.
Publicado: (2025)
por: Zhu, Runsong, et al.
Publicado: (2025)
E3D-Bench: A Benchmark for End-to-End 3D Geometric Foundation Models
por: Cong, Wenyan, et al.
Publicado: (2025)
por: Cong, Wenyan, et al.
Publicado: (2025)
VLM-3D:End-to-End Vision-Language Models for Open-World 3D Perception
por: Chang, Fuhao, et al.
Publicado: (2025)
por: Chang, Fuhao, et al.
Publicado: (2025)
Rethinking the Spatio-Temporal Alignment of End-to-End 3D Perception
por: Li, Xiaoyu, et al.
Publicado: (2025)
por: Li, Xiaoyu, et al.
Publicado: (2025)
Hunyuan3D Studio: End-to-End AI Pipeline for Game-Ready 3D Asset Generation
por: Lei, Biwen, et al.
Publicado: (2025)
por: Lei, Biwen, et al.
Publicado: (2025)
RAP: 3D Rasterization Augmented End-to-End Planning
por: Feng, Lan, et al.
Publicado: (2025)
por: Feng, Lan, et al.
Publicado: (2025)
End-to-End 3D Spatiotemporal Perception with Multimodal Fusion and V2X Collaboration
por: Yang, Zhenwei, et al.
Publicado: (2025)
por: Yang, Zhenwei, et al.
Publicado: (2025)
End-to-End Rate-Distortion Optimized 3D Gaussian Representation
por: Wang, Henan, et al.
Publicado: (2024)
por: Wang, Henan, et al.
Publicado: (2024)
End-to-End Training for Autoregressive Video Diffusion via Self-Resampling
por: Guo, Yuwei, et al.
Publicado: (2025)
por: Guo, Yuwei, et al.
Publicado: (2025)
3UR-LLM: An End-to-End Multimodal Large Language Model for 3D Scene Understanding
por: Xiong, Haomiao, et al.
Publicado: (2025)
por: Xiong, Haomiao, et al.
Publicado: (2025)
End-to-End Autonomous Driving without Costly Modularization and 3D Manual Annotation
por: Guo, Mingzhe, et al.
Publicado: (2024)
por: Guo, Mingzhe, et al.
Publicado: (2024)
End-to-End Fine-Tuning of 3D Texture Generation using Differentiable Rewards
por: Zamani, AmirHossein, et al.
Publicado: (2025)
por: Zamani, AmirHossein, et al.
Publicado: (2025)
End-to-End Learning of Multi-Organ Implicit Surfaces from 3D Medical Imaging Data
por: Zarin, Farahdiba, et al.
Publicado: (2025)
por: Zarin, Farahdiba, et al.
Publicado: (2025)
End-to-End LiDAR optimization for 3D point cloud registration
por: Katyan, Siddhant, et al.
Publicado: (2026)
por: Katyan, Siddhant, et al.
Publicado: (2026)
S2-Track: A Simple yet Strong Approach for End-to-End 3D Multi-Object Tracking
por: Tang, Tao, et al.
Publicado: (2024)
por: Tang, Tao, et al.
Publicado: (2024)
Towards Viewpoint-Robust End-to-End Autonomous Driving with 3D Foundation Model Priors
por: Hashimoto, Hiroki, et al.
Publicado: (2026)
por: Hashimoto, Hiroki, et al.
Publicado: (2026)
Generative Planning with 3D-vision Language Pre-training for End-to-End Autonomous Driving
por: Li, Tengpeng, et al.
Publicado: (2025)
por: Li, Tengpeng, et al.
Publicado: (2025)
There is No VAE: End-to-End Pixel-Space Generative Modeling via Self-Supervised Pre-training
por: Lei, Jiachen, et al.
Publicado: (2025)
por: Lei, Jiachen, et al.
Publicado: (2025)
Double Descent Meets Out-of-Distribution Detection: Theoretical Insights and Empirical Analysis on the role of model complexity
por: Ammar, Mouïn Ben, et al.
Publicado: (2024)
por: Ammar, Mouïn Ben, et al.
Publicado: (2024)
ViSS-R1: Self-Supervised Reinforcement Video Reasoning
por: Fang, Bo, et al.
Publicado: (2025)
por: Fang, Bo, et al.
Publicado: (2025)
RT-DETRv3: Real-time End-to-End Object Detection with Hierarchical Dense Positive Supervision
por: Wang, Shuo, et al.
Publicado: (2024)
por: Wang, Shuo, et al.
Publicado: (2024)
VR-Drive: Viewpoint-Robust End-to-End Driving with Feed-Forward 3D Gaussian Splatting
por: Cho, Hoonhee, et al.
Publicado: (2025)
por: Cho, Hoonhee, et al.
Publicado: (2025)
Is Self-Supervision Enough? Benchmarking Foundation Models Against End-to-End Training for Mitotic Figure Classification
por: Ganz, Jonathan, et al.
Publicado: (2024)
por: Ganz, Jonathan, et al.
Publicado: (2024)
Leveraging Visual Signals for Robust Token-Level Uncertainty in Vision-Language Generation
por: Hoche, Joseph, et al.
Publicado: (2026)
por: Hoche, Joseph, et al.
Publicado: (2026)
RG-SAN: Rule-Guided Spatial Awareness Network for End-to-End 3D Referring Expression Segmentation
por: Wu, Changli, et al.
Publicado: (2024)
por: Wu, Changli, et al.
Publicado: (2024)
ADA-Track++: End-to-End Multi-Camera 3D Multi-Object Tracking with Alternating Detection and Association
por: Ding, Shuxiao, et al.
Publicado: (2024)
por: Ding, Shuxiao, et al.
Publicado: (2024)
Revisiting End-to-End Learning with Slide-level Supervision in Computational Pathology
por: Tang, Wenhao, et al.
Publicado: (2025)
por: Tang, Wenhao, et al.
Publicado: (2025)
DreamScene: 3D Gaussian-based End-to-end Text-to-3D Scene Generation
por: Li, Haoran, et al.
Publicado: (2025)
por: Li, Haoran, et al.
Publicado: (2025)
End-to-End Facial Expression Detection in Long Videos
por: Fang, Yini, et al.
Publicado: (2025)
por: Fang, Yini, et al.
Publicado: (2025)
Zero-Shot Cross-City Generalization in End-to-End Autonomous Driving: Self-Supervised versus Supervised Representations
por: Naeinian, Fatemeh, et al.
Publicado: (2026)
por: Naeinian, Fatemeh, et al.
Publicado: (2026)
Towards an End-to-End System for 3D Tracking of Physical Objects in Virtual Immersive Environments
por: Knapiński, Stanisław, et al.
Publicado: (2026)
por: Knapiński, Stanisław, et al.
Publicado: (2026)
ForestFormer3D: A Unified Framework for End-to-End Segmentation of Forest LiDAR 3D Point Clouds
por: Xiang, Binbin, et al.
Publicado: (2025)
por: Xiang, Binbin, et al.
Publicado: (2025)
LMVC: An End-to-End Learned Multiview Video Coding Framework
por: Sheng, Xihua, et al.
Publicado: (2025)
por: Sheng, Xihua, et al.
Publicado: (2025)
Ejemplares similares
-
Rebalancing gradient to improve self-supervised co-training of depth, odometry and optical flow predictions
por: Hariat, Marwane, et al.
Publicado: (2026) -
Improved monocular depth prediction using distance transform over pre-semantic contours with self-supervised neural networks
por: Hariat, Marwane, et al.
Publicado: (2026) -
Learning to Generate Training Datasets for Robust Semantic Segmentation
por: Hariat, Marwane, et al.
Publicado: (2023) -
Hierarchical Light Transformer Ensembles for Multimodal Trajectory Forecasting
por: Lafage, Adrien, et al.
Publicado: (2024) -
BEEP3D: Box-Supervised End-to-End Pseudo-Mask Generation for 3D Instance Segmentation
por: Yoo, Youngju, et al.
Publicado: (2025)