SMORE: Simultaneous Map and Object REconstruction
Fuente:
arXiv
Salvato in:
| Autori principali: | Chodosh, Nathaniel, Madan, Anish, Lucey, Simon, Ramanan, Deva |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Revisiting Few-Shot Object Detection with Vision-Language Models
di: Madan, Anish, et al.
Pubblicazione: (2023)
di: Madan, Anish, et al.
Pubblicazione: (2023)
Roboflow100-VL: A Multi-Domain Object Detection Benchmark for Vision-Language Models
di: Robicheaux, Peter, et al.
Pubblicazione: (2025)
di: Robicheaux, Peter, et al.
Pubblicazione: (2025)
Predicting Long-horizon Futures by Conditioning on Geometry and Time
di: Khurana, Tarasha, et al.
Pubblicazione: (2024)
di: Khurana, Tarasha, et al.
Pubblicazione: (2024)
RaySt3R: Predicting Novel Depth Maps for Zero-Shot Object Completion
di: Duisterhof, Bardienus P., et al.
Pubblicazione: (2025)
di: Duisterhof, Bardienus P., et al.
Pubblicazione: (2025)
ZeroFlow: Scalable Scene Flow via Distillation
di: Vedder, Kyle, et al.
Pubblicazione: (2023)
di: Vedder, Kyle, et al.
Pubblicazione: (2023)
Using Diffusion Priors for Video Amodal Segmentation
di: Chen, Kaihua, et al.
Pubblicazione: (2024)
di: Chen, Kaihua, et al.
Pubblicazione: (2024)
Reconstruct, Inpaint, Test-Time Finetune: Dynamic Novel-view Synthesis from Monocular Videos
di: Chen, Kaihua, et al.
Pubblicazione: (2025)
di: Chen, Kaihua, et al.
Pubblicazione: (2025)
SHARE: Single-view Human Adversarial REconstruction
di: Revankar, Shreelekha, et al.
Pubblicazione: (2023)
di: Revankar, Shreelekha, et al.
Pubblicazione: (2023)
Shelf-Supervised Cross-Modal Pre-Training for 3D Object Detection
di: Khurana, Mehar, et al.
Pubblicazione: (2024)
di: Khurana, Mehar, et al.
Pubblicazione: (2024)
RefAV: Towards Planning-Centric Scenario Mining
di: Davidson, Cainan, et al.
Pubblicazione: (2025)
di: Davidson, Cainan, et al.
Pubblicazione: (2025)
DetPO: In-Context Learning with Multi-Modal LLMs for Few-Shot Object Detection
di: Gare, Gautam Rajendrakumar, et al.
Pubblicazione: (2026)
di: Gare, Gautam Rajendrakumar, et al.
Pubblicazione: (2026)
Gradient Descent as a Shrinkage Operator for Spectral Bias
di: Lucey, Simon
Pubblicazione: (2025)
di: Lucey, Simon
Pubblicazione: (2025)
3DFIRES: Few Image 3D REconstruction for Scenes with Hidden Surface
di: Jin, Linyi, et al.
Pubblicazione: (2024)
di: Jin, Linyi, et al.
Pubblicazione: (2024)
Can Vision-Language Models Understand Construction Workers? An Exploratory Study
di: Bui, Hieu, et al.
Pubblicazione: (2026)
di: Bui, Hieu, et al.
Pubblicazione: (2026)
Fast Kernel Scene Flow
di: Li, Xueqian, et al.
Pubblicazione: (2024)
di: Li, Xueqian, et al.
Pubblicazione: (2024)
Enhancing Transformers Through Conditioned Embedded Tokens
di: Saratchandran, Hemanth, et al.
Pubblicazione: (2025)
di: Saratchandran, Hemanth, et al.
Pubblicazione: (2025)
I Can't Believe It's Not Scene Flow!
di: Khatri, Ishan, et al.
Pubblicazione: (2024)
di: Khatri, Ishan, et al.
Pubblicazione: (2024)
DressRecon: Freeform 4D Human Reconstruction from Monocular Video
di: Tan, Jeff, et al.
Pubblicazione: (2024)
di: Tan, Jeff, et al.
Pubblicazione: (2024)
MonoFusion: Sparse-View 4D Reconstruction via Monocular Fusion
di: Wang, Zihan, et al.
Pubblicazione: (2025)
di: Wang, Zihan, et al.
Pubblicazione: (2025)
PAI-Bench: A Comprehensive Benchmark For Physical AI
di: Zhou, Fengzhe, et al.
Pubblicazione: (2025)
di: Zhou, Fengzhe, et al.
Pubblicazione: (2025)
AerialMegaDepth: Learning Aerial-Ground Reconstruction and View Synthesis
di: Vuong, Khiem, et al.
Pubblicazione: (2025)
di: Vuong, Khiem, et al.
Pubblicazione: (2025)
RF-DETR: Neural Architecture Search for Real-Time Detection Transformers
di: Robinson, Isaac, et al.
Pubblicazione: (2025)
di: Robinson, Isaac, et al.
Pubblicazione: (2025)
Novel View Synthesis as Video Completion
di: Wu, Qi, et al.
Pubblicazione: (2026)
di: Wu, Qi, et al.
Pubblicazione: (2026)
TAO-Amodal: A Benchmark for Tracking Any Object Amodally
di: Hsieh, Cheng-Yen, et al.
Pubblicazione: (2023)
di: Hsieh, Cheng-Yen, et al.
Pubblicazione: (2023)
B-SMALL: A Bayesian Neural Network approach to Sparse Model-Agnostic Meta-Learning
di: Madan, Anish, et al.
Pubblicazione: (2021)
di: Madan, Anish, et al.
Pubblicazione: (2021)
DynOMo: Online Point Tracking by Dynamic Online Monocular Gaussian Reconstruction
di: Seidenschwarz, Jenny, et al.
Pubblicazione: (2024)
di: Seidenschwarz, Jenny, et al.
Pubblicazione: (2024)
Soft Augmentation for Image Classification
di: Liu, Yang, et al.
Pubblicazione: (2022)
di: Liu, Yang, et al.
Pubblicazione: (2022)
MORE: Multi-Organ Medical Image REconstruction Dataset
di: Wu, Shaokai, et al.
Pubblicazione: (2025)
di: Wu, Shaokai, et al.
Pubblicazione: (2025)
Structured Initialization for Attention in Vision Transformers
di: Zheng, Jianqiao, et al.
Pubblicazione: (2024)
di: Zheng, Jianqiao, et al.
Pubblicazione: (2024)
Convolutional Initialization for Data-Efficient Vision Transformers
di: Zheng, Jianqiao, et al.
Pubblicazione: (2024)
di: Zheng, Jianqiao, et al.
Pubblicazione: (2024)
SineProject: Machine Unlearning for Stable Vision Language Alignment
di: Garg, Arpit, et al.
Pubblicazione: (2025)
di: Garg, Arpit, et al.
Pubblicazione: (2025)
Generating Physically Stable and Buildable Brick Structures from Text
di: Pun, Ava, et al.
Pubblicazione: (2025)
di: Pun, Ava, et al.
Pubblicazione: (2025)
DiffusionSfM: Predicting Structure and Motion via Ray Origin and Endpoint Diffusion
di: Zhao, Qitao, et al.
Pubblicazione: (2025)
di: Zhao, Qitao, et al.
Pubblicazione: (2025)
Depth-supervised NeRF: Fewer Views and Faster Training for Free
di: Deng, Kangle, et al.
Pubblicazione: (2021)
di: Deng, Kangle, et al.
Pubblicazione: (2021)
Object Agnostic 3D Lifting in Space and Time
di: Fusco, Christopher, et al.
Pubblicazione: (2024)
di: Fusco, Christopher, et al.
Pubblicazione: (2024)
Long-Tailed 3D Detection via Multi-Modal Fusion
di: Ma, Yechi, et al.
Pubblicazione: (2023)
di: Ma, Yechi, et al.
Pubblicazione: (2023)
SplaTAM: Splat, Track & Map 3D Gaussians for Dense RGB-D SLAM
di: Keetha, Nikhil, et al.
Pubblicazione: (2023)
di: Keetha, Nikhil, et al.
Pubblicazione: (2023)
Revisiting the Role of Language Priors in Vision-Language Models
di: Lin, Zhiqiu, et al.
Pubblicazione: (2023)
di: Lin, Zhiqiu, et al.
Pubblicazione: (2023)
UniFlow: Zero-Shot LiDAR Scene Flow for Autonomous Vehicles
di: Li, Siyi, et al.
Pubblicazione: (2025)
di: Li, Siyi, et al.
Pubblicazione: (2025)
Weight Conditioning for Smooth Optimization of Neural Networks
di: Saratchandran, Hemanth, et al.
Pubblicazione: (2024)
di: Saratchandran, Hemanth, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Revisiting Few-Shot Object Detection with Vision-Language Models
di: Madan, Anish, et al.
Pubblicazione: (2023) -
Roboflow100-VL: A Multi-Domain Object Detection Benchmark for Vision-Language Models
di: Robicheaux, Peter, et al.
Pubblicazione: (2025) -
Predicting Long-horizon Futures by Conditioning on Geometry and Time
di: Khurana, Tarasha, et al.
Pubblicazione: (2024) -
RaySt3R: Predicting Novel Depth Maps for Zero-Shot Object Completion
di: Duisterhof, Bardienus P., et al.
Pubblicazione: (2025) -
ZeroFlow: Scalable Scene Flow via Distillation
di: Vedder, Kyle, et al.
Pubblicazione: (2023)