Cameras as Rays: Pose Estimation via Ray Diffusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Jason Y., Lin, Amy, Kumar, Moneish, Yang, Tzu-Hsuan, Ramanan, Deva, Tulsiani, Shubham |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DiffusionSfM: Predicting Structure and Motion via Ray Origin and Endpoint Diffusion
di: Zhao, Qitao, et al.
Pubblicazione: (2025)
di: Zhao, Qitao, et al.
Pubblicazione: (2025)
RayRoPE: Projective Ray Positional Encoding for Multi-view Attention
di: Wu, Yu, et al.
Pubblicazione: (2026)
di: Wu, Yu, et al.
Pubblicazione: (2026)
Sparse-view Pose Estimation and Reconstruction via Analysis by Generative Synthesis
di: Zhao, Qitao, et al.
Pubblicazione: (2024)
di: Zhao, Qitao, et al.
Pubblicazione: (2024)
Accenture-NVS1: A Novel View Synthesis Dataset
di: Sugg, Thomas, et al.
Pubblicazione: (2025)
di: Sugg, Thomas, et al.
Pubblicazione: (2025)
DressRecon: Freeform 4D Human Reconstruction from Monocular Video
di: Tan, Jeff, et al.
Pubblicazione: (2024)
di: Tan, Jeff, et al.
Pubblicazione: (2024)
AerialMegaDepth: Learning Aerial-Ground Reconstruction and View Synthesis
di: Vuong, Khiem, et al.
Pubblicazione: (2025)
di: Vuong, Khiem, et al.
Pubblicazione: (2025)
Advancing 6-DoF Instrument Pose Estimation in Variable X-Ray Imaging Geometries
di: Viviers, Christiaan G. A., et al.
Pubblicazione: (2024)
di: Viviers, Christiaan G. A., et al.
Pubblicazione: (2024)
Shelf-Supervised Cross-Modal Pre-Training for 3D Object Detection
di: Khurana, Mehar, et al.
Pubblicazione: (2024)
di: Khurana, Mehar, et al.
Pubblicazione: (2024)
Dex4D: Task-Agnostic Point Track Policy for Sim-to-Real Dexterous Manipulation
di: Kuang, Yuxuan, et al.
Pubblicazione: (2026)
di: Kuang, Yuxuan, et al.
Pubblicazione: (2026)
The Neglected Tails in Vision-Language Models
di: Parashar, Shubham, et al.
Pubblicazione: (2024)
di: Parashar, Shubham, et al.
Pubblicazione: (2024)
Depth-supervised NeRF: Fewer Views and Faster Training for Free
di: Deng, Kangle, et al.
Pubblicazione: (2021)
di: Deng, Kangle, et al.
Pubblicazione: (2021)
RayPose: Ray Bundling Diffusion for Template Views in Unseen 6D Object Pose Estimation
di: Huang, Junwen, et al.
Pubblicazione: (2025)
di: Huang, Junwen, et al.
Pubblicazione: (2025)
ZeroFlow: Scalable Scene Flow via Distillation
di: Vedder, Kyle, et al.
Pubblicazione: (2023)
di: Vedder, Kyle, et al.
Pubblicazione: (2023)
EPOCH: Jointly Estimating the 3D Pose of Cameras and Humans
di: Garau, Nicola, et al.
Pubblicazione: (2024)
di: Garau, Nicola, et al.
Pubblicazione: (2024)
Rays as Pixels: Learning A Joint Distribution of Videos and Camera Trajectories
di: Jang, Wonbong, et al.
Pubblicazione: (2026)
di: Jang, Wonbong, et al.
Pubblicazione: (2026)
Efficient Onboard Spacecraft Pose Estimation with Event Cameras and Neuromorphic Hardware
di: Rathinam, Arunkumar, et al.
Pubblicazione: (2026)
di: Rathinam, Arunkumar, et al.
Pubblicazione: (2026)
CRISP: Contact-Guided Real2Sim from Monocular Video with Planar Scene Primitives
di: Wang, Zihan, et al.
Pubblicazione: (2025)
di: Wang, Zihan, et al.
Pubblicazione: (2025)
TAO-Amodal: A Benchmark for Tracking Any Object Amodally
di: Hsieh, Cheng-Yen, et al.
Pubblicazione: (2023)
di: Hsieh, Cheng-Yen, et al.
Pubblicazione: (2023)
HybridNeRF: Efficient Neural Rendering via Adaptive Volumetric Surfaces
di: Turki, Haithem, et al.
Pubblicazione: (2023)
di: Turki, Haithem, et al.
Pubblicazione: (2023)
Using Diffusion Priors for Video Amodal Segmentation
di: Chen, Kaihua, et al.
Pubblicazione: (2024)
di: Chen, Kaihua, et al.
Pubblicazione: (2024)
Supercharging Floorplan Localization with Semantic Rays
di: Grader, Yuval, et al.
Pubblicazione: (2025)
di: Grader, Yuval, et al.
Pubblicazione: (2025)
CRePE: Curved Ray Expectation Positional Encoding for Unified-Camera-Controlled Video Generation
di: Jin, Seonghyun, et al.
Pubblicazione: (2026)
di: Jin, Seonghyun, et al.
Pubblicazione: (2026)
RaySt3R: Predicting Novel Depth Maps for Zero-Shot Object Completion
di: Duisterhof, Bardienus P., et al.
Pubblicazione: (2025)
di: Duisterhof, Bardienus P., et al.
Pubblicazione: (2025)
MovePose: A High-performance Human Pose Estimation Algorithm on Mobile and Edge Devices
di: Yu, Dongyang, et al.
Pubblicazione: (2023)
di: Yu, Dongyang, et al.
Pubblicazione: (2023)
Occlusion Resilient 3D Human Pose Estimation
di: Roy, Soumava Kumar, et al.
Pubblicazione: (2024)
di: Roy, Soumava Kumar, et al.
Pubblicazione: (2024)
Multimodality Helps Unimodality: Cross-Modal Few-Shot Learning with Multimodal Models
di: Lin, Zhiqiu, et al.
Pubblicazione: (2023)
di: Lin, Zhiqiu, et al.
Pubblicazione: (2023)
FlashTex: Fast Relightable Mesh Texturing with LightControlNet
di: Deng, Kangle, et al.
Pubblicazione: (2024)
di: Deng, Kangle, et al.
Pubblicazione: (2024)
Language Models as Black-Box Optimizers for Vision-Language Models
di: Liu, Shihong, et al.
Pubblicazione: (2023)
di: Liu, Shihong, et al.
Pubblicazione: (2023)
Predicting Long-horizon Futures by Conditioning on Geometry and Time
di: Khurana, Tarasha, et al.
Pubblicazione: (2024)
di: Khurana, Tarasha, et al.
Pubblicazione: (2024)
E-RayZer: Self-supervised 3D Reconstruction as Spatial Visual Pre-training
di: Zhao, Qitao, et al.
Pubblicazione: (2025)
di: Zhao, Qitao, et al.
Pubblicazione: (2025)
Roboflow100-VL: A Multi-Domain Object Detection Benchmark for Vision-Language Models
di: Robicheaux, Peter, et al.
Pubblicazione: (2025)
di: Robicheaux, Peter, et al.
Pubblicazione: (2025)
Any4D: Unified Feed-Forward Metric 4D Reconstruction
di: Karhade, Jay, et al.
Pubblicazione: (2025)
di: Karhade, Jay, et al.
Pubblicazione: (2025)
Activation Reward Models for Few-Shot Model Alignment
di: Chai, Tianning, et al.
Pubblicazione: (2025)
di: Chai, Tianning, et al.
Pubblicazione: (2025)
Monocular 3D Hand Pose Estimation with Implicit Camera Alignment
di: Pantazopoulos, Christos, et al.
Pubblicazione: (2025)
di: Pantazopoulos, Christos, et al.
Pubblicazione: (2025)
UniChest: Conquer-and-Divide Pre-training for Multi-Source Chest X-Ray Classification
di: Dai, Tianjie, et al.
Pubblicazione: (2023)
di: Dai, Tianjie, et al.
Pubblicazione: (2023)
Best of Both Worlds: Hybrid SNN-ANN Architecture for Event-based Optical Flow Estimation
di: Negi, Shubham, et al.
Pubblicazione: (2023)
di: Negi, Shubham, et al.
Pubblicazione: (2023)
NLML-HPE: Head Pose Estimation with Limited Data via Manifold Learning
di: Ghafourian, Mahdi, et al.
Pubblicazione: (2025)
di: Ghafourian, Mahdi, et al.
Pubblicazione: (2025)
Towards Understanding Camera Motions in Any Video
di: Lin, Zhiqiu, et al.
Pubblicazione: (2025)
di: Lin, Zhiqiu, et al.
Pubblicazione: (2025)
Adapting SAM for Volumetric X-Ray Data-sets of Arbitrary Sizes
di: Gruber, Roland, et al.
Pubblicazione: (2024)
di: Gruber, Roland, et al.
Pubblicazione: (2024)
Expanding the Role of Diffusion Models for Robust Classifier Training
di: Huang, Pin-Han, et al.
Pubblicazione: (2026)
di: Huang, Pin-Han, et al.
Pubblicazione: (2026)
Documenti analoghi
-
DiffusionSfM: Predicting Structure and Motion via Ray Origin and Endpoint Diffusion
di: Zhao, Qitao, et al.
Pubblicazione: (2025) -
RayRoPE: Projective Ray Positional Encoding for Multi-view Attention
di: Wu, Yu, et al.
Pubblicazione: (2026) -
Sparse-view Pose Estimation and Reconstruction via Analysis by Generative Synthesis
di: Zhao, Qitao, et al.
Pubblicazione: (2024) -
Accenture-NVS1: A Novel View Synthesis Dataset
di: Sugg, Thomas, et al.
Pubblicazione: (2025) -
DressRecon: Freeform 4D Human Reconstruction from Monocular Video
di: Tan, Jeff, et al.
Pubblicazione: (2024)