RayFormer: Improving Query-Based Multi-Camera 3D Object Detection via Ray-Centric Strategies
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chu, Xiaomeng, Deng, Jiajun, You, Guoliang, Duan, Yifan, Li, Yao, Zhang, Yanyong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RaCFormer: Towards High-Quality 3D Object Detection via Query-based Radar-Camera Fusion
par: Chu, Xiaomeng, et autres
Publié: (2024)
par: Chu, Xiaomeng, et autres
Publié: (2024)
OA-DET3D: Embedding Object Awareness as a General Plug-in for Multi-Camera 3D Object Detection
par: Chu, Xiaomeng, et autres
Publié: (2023)
par: Chu, Xiaomeng, et autres
Publié: (2023)
RayFormer: Modeling Inter- and Intra-Ray Similarity for NeRF-Based Video Snapshot Compressive Imaging
par: Dong, Yubo, et autres
Publié: (2026)
par: Dong, Yubo, et autres
Publié: (2026)
LFP: Efficient and Accurate End-to-End Lane-Level Planning via Camera-LiDAR Fusion
par: You, Guoliang, et autres
Publié: (2024)
par: You, Guoliang, et autres
Publié: (2024)
CELLmap: Enhancing LiDAR SLAM through Elastic and Lightweight Spherical Map Representation
par: Duan, Yifan, et autres
Publié: (2024)
par: Duan, Yifan, et autres
Publié: (2024)
Perception Helps Planning: Facilitating Multi-Stage Lane-Level Integration via Double-Edge Structures
par: You, Guoliang, et autres
Publié: (2024)
par: You, Guoliang, et autres
Publié: (2024)
GraspCoT: Integrating Physical Property Reasoning for 6-DoF Grasping under Flexible Language Instructions
par: Chu, Xiaomeng, et autres
Publié: (2025)
par: Chu, Xiaomeng, et autres
Publié: (2025)
PoIFusion: Multi-Modal 3D Object Detection via Fusion at Points of Interest
par: Deng, Jiajun, et autres
Publié: (2024)
par: Deng, Jiajun, et autres
Publié: (2024)
Sparse 3D Reconstruction via Object-Centric Ray Sampling
par: Cerkezi, Llukman, et autres
Publié: (2023)
par: Cerkezi, Llukman, et autres
Publié: (2023)
S3R-GS: Streamlining the Pipeline for Large-Scale Street Scene Reconstruction
par: Zheng, Guangting, et autres
Publié: (2025)
par: Zheng, Guangting, et autres
Publié: (2025)
RayD3D: Distilling Depth Knowledge Along the Ray for Robust Multi-View 3D Object Detection
par: Ding, Rui, et autres
Publié: (2026)
par: Ding, Rui, et autres
Publié: (2026)
Cameras as Rays: Pose Estimation via Ray Diffusion
par: Zhang, Jason Y., et autres
Publié: (2024)
par: Zhang, Jason Y., et autres
Publié: (2024)
MMCL: Correcting Content Query Distributions for Improved Anti-Overlapping X-Ray Object Detection
par: Li, Mingyuan, et autres
Publié: (2024)
par: Li, Mingyuan, et autres
Publié: (2024)
RayMamba: Ray-Aligned Serialization for Long-Range 3D Object Detection
par: Lu, Cheng, et autres
Publié: (2026)
par: Lu, Cheng, et autres
Publié: (2026)
Rotation Initialization and Stepwise Refinement for Universal LiDAR Calibration
par: Duan, Yifan, et autres
Publié: (2024)
par: Duan, Yifan, et autres
Publié: (2024)
Ray Denoising: Depth-aware Hard Negative Sampling for Multi-view 3D Object Detection
par: Liu, Feng, et autres
Publié: (2024)
par: Liu, Feng, et autres
Publié: (2024)
CalibFormer: A Transformer-based Automatic LiDAR-Camera Calibration Network
par: Xiao, Yuxuan, et autres
Publié: (2023)
par: Xiao, Yuxuan, et autres
Publié: (2023)
Learning Surgical Robotic Manipulation with 3D Spatial Priors
par: Sheng, Yu, et autres
Publié: (2026)
par: Sheng, Yu, et autres
Publié: (2026)
MonoDGP: Monocular 3D Object Detection with Decoupled-Query and Geometry-Error Priors
par: Pu, Fanqi, et autres
Publié: (2024)
par: Pu, Fanqi, et autres
Publié: (2024)
SimPB: A Single Model for 2D and 3D Object Detection from Multiple Cameras
par: Tang, Yingqi, et autres
Publié: (2024)
par: Tang, Yingqi, et autres
Publié: (2024)
Weak-to-Strong 3D Object Detection with X-Ray Distillation
par: Gambashidze, Alexander, et autres
Publié: (2024)
par: Gambashidze, Alexander, et autres
Publié: (2024)
CRPlace: Camera-Radar Fusion with BEV Representation for Place Recognition
par: Fu, Shaowei, et autres
Publié: (2024)
par: Fu, Shaowei, et autres
Publié: (2024)
HeightFormer: Learning Height Prediction in Voxel Features for Roadside Vision Centric 3D Object Detection via Transformer
par: Zhang, Zhang, et autres
Publié: (2025)
par: Zhang, Zhang, et autres
Publié: (2025)
OCC-VO: Dense Mapping via 3D Occupancy-Based Visual Odometry for Autonomous Driving
par: Li, Heng, et autres
Publié: (2023)
par: Li, Heng, et autres
Publié: (2023)
Visual Sync: Multi-Camera Synchronization via Cross-View Object Motion
par: Liu, Shaowei, et autres
Publié: (2025)
par: Liu, Shaowei, et autres
Publié: (2025)
Index-Aligned Query Distillation for Transformer-based Incremental Object Detection
par: Ma, Mingxiao, et autres
Publié: (2025)
par: Ma, Mingxiao, et autres
Publié: (2025)
ART3mis: Ray-Based Textual Annotation on 3D Cultural Objects
par: Arampatzakis, Vasileios, et autres
Publié: (2026)
par: Arampatzakis, Vasileios, et autres
Publié: (2026)
VLMPlanner: Integrating Visual Language Models with Motion Planning
par: Tang, Zhipeng, et autres
Publié: (2025)
par: Tang, Zhipeng, et autres
Publié: (2025)
DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos
par: Yasarla, Rajeev, et autres
Publié: (2025)
par: Yasarla, Rajeev, et autres
Publié: (2025)
MM-Gaussian: 3D Gaussian-based Multi-modal Fusion for Localization and Reconstruction in Unbounded Scenes
par: Wu, Chenyang, et autres
Publié: (2024)
par: Wu, Chenyang, et autres
Publié: (2024)
VistaDepth: Improving far-range Depth Estimation with Spectral Modulation and Adaptive Reweighting
par: Zhan, Mingxia, et autres
Publié: (2025)
par: Zhan, Mingxia, et autres
Publié: (2025)
PGOV3D: Open-Vocabulary 3D Semantic Segmentation with Partial-to-Global Curriculum
par: Zhang, Shiqi, et autres
Publié: (2025)
par: Zhang, Shiqi, et autres
Publié: (2025)
CarFormer: Self-Driving with Learned Object-Centric Representations
par: Hamdan, Shadi, et autres
Publié: (2024)
par: Hamdan, Shadi, et autres
Publié: (2024)
CN-RMA: Combined Network with Ray Marching Aggregation for 3D Indoors Object Detection from Multi-view Images
par: Shen, Guanlin, et autres
Publié: (2024)
par: Shen, Guanlin, et autres
Publié: (2024)
OCH3R: Object-Centric Holistic 3D Reconstruction
par: Du, Yi, et autres
Publié: (2026)
par: Du, Yi, et autres
Publié: (2026)
Every Camera Effect, Every Time, All at Once: 4D Gaussian Ray Tracing for Physics-based Camera Effect Data Generation
par: Liu, Yi-Ruei, et autres
Publié: (2025)
par: Liu, Yi-Ruei, et autres
Publié: (2025)
HeightFormer: Explicit Height Modeling without Extra Data for Camera-only 3D Object Detection in Bird's Eye View
par: Wu, Yiming, et autres
Publié: (2023)
par: Wu, Yiming, et autres
Publié: (2023)
RayPose: Ray Bundling Diffusion for Template Views in Unseen 6D Object Pose Estimation
par: Huang, Junwen, et autres
Publié: (2025)
par: Huang, Junwen, et autres
Publié: (2025)
CoIn3D: Revisiting Configuration-Invariant Multi-Camera 3D Object Detection
par: Kuang, Zhaonian, et autres
Publié: (2026)
par: Kuang, Zhaonian, et autres
Publié: (2026)
3DGUT: Enabling Distorted Cameras and Secondary Rays in Gaussian Splatting
par: Wu, Qi, et autres
Publié: (2024)
par: Wu, Qi, et autres
Publié: (2024)
Documents similaires
-
RaCFormer: Towards High-Quality 3D Object Detection via Query-based Radar-Camera Fusion
par: Chu, Xiaomeng, et autres
Publié: (2024) -
OA-DET3D: Embedding Object Awareness as a General Plug-in for Multi-Camera 3D Object Detection
par: Chu, Xiaomeng, et autres
Publié: (2023) -
RayFormer: Modeling Inter- and Intra-Ray Similarity for NeRF-Based Video Snapshot Compressive Imaging
par: Dong, Yubo, et autres
Publié: (2026) -
LFP: Efficient and Accurate End-to-End Lane-Level Planning via Camera-LiDAR Fusion
par: You, Guoliang, et autres
Publié: (2024) -
CELLmap: Enhancing LiDAR SLAM through Elastic and Lightweight Spherical Map Representation
par: Duan, Yifan, et autres
Publié: (2024)