Enregistré dans:
| Auteurs principaux: | Rekanar, Kaavya, Hayes, Martin, Sistu, Ganesh, Eising, Ciaran |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2406.09203 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Revisiting Birds Eye View Perception Models with Frozen Foundation Models: DINOv2 and Metric3Dv2
par: Hayes, Seamie, et autres
Publié: (2025)
par: Hayes, Seamie, et autres
Publié: (2025)
Easy3D-Labels: Supervising Semantic Occupancy Estimation with 3D Pseudo-Labels for Automotive Perception
par: Hayes, Seamie, et autres
Publié: (2025)
par: Hayes, Seamie, et autres
Publié: (2025)
Probing Visual Concepts in Lightweight Vision-Language Models for Automated Driving
par: Theodoridis, Nikos, et autres
Publié: (2026)
par: Theodoridis, Nikos, et autres
Publié: (2026)
Descriptor: Distance-Annotated Traffic Perception Question Answering (DTPQA)
par: Theodoridis, Nikos, et autres
Publié: (2025)
par: Theodoridis, Nikos, et autres
Publié: (2025)
Optimizing Ego Vehicle Trajectory Prediction: The Graph Enhancement Approach
par: Sharma, Sushil, et autres
Publié: (2023)
par: Sharma, Sushil, et autres
Publié: (2023)
MapsTP: HD Map Images Based Multimodal Trajectory Prediction for Automated Vehicles
par: Sharma, Sushil, et autres
Publié: (2024)
par: Sharma, Sushil, et autres
Publié: (2024)
SuperQuadricOcc: Real-Time Self-Supervised Semantic Occupancy Estimation with Superquadric Volume Rendering
par: Hayes, Seamie, et autres
Publié: (2025)
par: Hayes, Seamie, et autres
Publié: (2025)
Deformable Convolution Based Road Scene Semantic Segmentation of Fisheye Images in Autonomous Driving
par: Manzoor, Anam, et autres
Publié: (2024)
par: Manzoor, Anam, et autres
Publié: (2024)
Occluded nuScenes: A Multi-Sensor Dataset for Evaluating Perception Robustness in Automated Driving
par: Kumar, Sanjay, et autres
Publié: (2025)
par: Kumar, Sanjay, et autres
Publié: (2025)
Evaluating the Impact of Weather-Induced Sensor Occlusion on BEVFusion for 3D Object Detection
par: Kumar, Sanjay, et autres
Publié: (2025)
par: Kumar, Sanjay, et autres
Publié: (2025)
Minimizing Occlusion Effect on Multi-View Camera Perception in BEV with Multi-Sensor Fusion
par: Kumar, Sanjay, et autres
Publié: (2025)
par: Kumar, Sanjay, et autres
Publié: (2025)
Reflective Teacher: Semi-Supervised Multimodal 3D Object Detection in Bird's-Eye-View via Uncertainty Measure
par: Hazra, Saheli, et autres
Publié: (2024)
par: Hazra, Saheli, et autres
Publié: (2024)
Evaluating Small Vision-Language Models on Distance-Dependent Traffic Perception
par: Theodoridis, Nikos, et autres
Publié: (2025)
par: Theodoridis, Nikos, et autres
Publié: (2025)
Velocity Driven Vision: Asynchronous Sensor Fusion Birds Eye View Models for Autonomous Vehicles
par: Hayes, Seamie, et autres
Publié: (2024)
par: Hayes, Seamie, et autres
Publié: (2024)
Fisheye Camera and Ultrasonic Sensor Fusion For Near-Field Obstacle Perception in Bird's-Eye-View
par: Das, Arindam, et autres
Publié: (2024)
par: Das, Arindam, et autres
Publié: (2024)
BEVMOSNet: Multimodal Fusion for BEV Moving Object Segmentation
par: Cong, Hiep Truong, et autres
Publié: (2025)
par: Cong, Hiep Truong, et autres
Publié: (2025)
NeurAll: Towards a Unified Visual Perception Model for Automated Driving
par: Sistu, Ganesh, et autres
Publié: (2019)
par: Sistu, Ganesh, et autres
Publié: (2019)
FisheyeDetNet: 360° Surround view Fisheye Camera based Object Detection System for Autonomous Driving
par: Sistu, Ganesh, et autres
Publié: (2024)
par: Sistu, Ganesh, et autres
Publié: (2024)
FisheyeGaussianLift: BEV Feature Lifting for Surround-View Fisheye Camera Perception
par: Sonarghare, Shubham, et autres
Publié: (2025)
par: Sonarghare, Shubham, et autres
Publié: (2025)
DriveLM: Driving with Graph Visual Question Answering
par: Sima, Chonghao, et autres
Publié: (2023)
par: Sima, Chonghao, et autres
Publié: (2023)
Multimodal Integration of Human-Like Attention in Visual Question Answering
par: Sood, Ekta, et autres
Publié: (2021)
par: Sood, Ekta, et autres
Publié: (2021)
Scalable and Efficient Hierarchical Visual Topological Mapping
par: Ramachandran, Saravanabalagi, et autres
Publié: (2024)
par: Ramachandran, Saravanabalagi, et autres
Publié: (2024)
WoodScape Motion Segmentation for Autonomous Driving -- CVPR 2023 OmniCV Workshop Challenge
par: Ramachandran, Saravanabalagi, et autres
Publié: (2023)
par: Ramachandran, Saravanabalagi, et autres
Publié: (2023)
PAN: Pillars-Attention-Based Network for 3D Object Detection
par: Bispo, Ruan, et autres
Publié: (2025)
par: Bispo, Ruan, et autres
Publié: (2025)
Reconstruction as a Bridge for Event-Based Visual Question Answering
par: Lou, Hanyue, et autres
Publié: (2025)
par: Lou, Hanyue, et autres
Publié: (2025)
Selectively Answering Visual Questions
par: Eisenschlos, Julian Martin, et autres
Publié: (2024)
par: Eisenschlos, Julian Martin, et autres
Publié: (2024)
DriveXQA: Cross-modal Visual Question Answering for Adverse Driving Scene Understanding
par: Tao, Mingzhe, et autres
Publié: (2026)
par: Tao, Mingzhe, et autres
Publié: (2026)
TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving
par: Hassani, Hossein, et autres
Publié: (2025)
par: Hassani, Hossein, et autres
Publié: (2025)
Subgraph Clustering and Atom Learning for Improved Image Classification
par: Singh, Aryan, et autres
Publié: (2024)
par: Singh, Aryan, et autres
Publié: (2024)
FIN: Fast Inference Network for Map Segmentation
par: Bispo, Ruan, et autres
Publié: (2025)
par: Bispo, Ruan, et autres
Publié: (2025)
VLM-Assisted Continual learning for Visual Question Answering in Self-Driving
par: Lin, Yuxin, et autres
Publié: (2025)
par: Lin, Yuxin, et autres
Publié: (2025)
Hierarchical Modeling for Medical Visual Question Answering with Cross-Attention Fusion
par: Zhang, Junkai, et autres
Publié: (2025)
par: Zhang, Junkai, et autres
Publié: (2025)
LingoQA: Visual Question Answering for Autonomous Driving
par: Marcu, Ana-Maria, et autres
Publié: (2023)
par: Marcu, Ana-Maria, et autres
Publié: (2023)
Segmentation-guided Attention for Visual Question Answering from Remote Sensing Images
par: Tosato, Lucrezia, et autres
Publié: (2024)
par: Tosato, Lucrezia, et autres
Publié: (2024)
QIRL: Boosting Visual Question Answering via Optimized Question-Image Relation Learning
par: Xu, Quanxing, et autres
Publié: (2025)
par: Xu, Quanxing, et autres
Publié: (2025)
STRIDE-QA: Visual Question Answering Dataset for Spatiotemporal Reasoning in Urban Driving Scenes
par: Ishihara, Keishi, et autres
Publié: (2025)
par: Ishihara, Keishi, et autres
Publié: (2025)
Efficient Visual Question Answering Pipeline for Autonomous Driving via Scene Region Compression
par: Cai, Yuliang, et autres
Publié: (2026)
par: Cai, Yuliang, et autres
Publié: (2026)
Multi-Page Document Visual Question Answering using Self-Attention Scoring Mechanism
par: Kang, Lei, et autres
Publié: (2024)
par: Kang, Lei, et autres
Publié: (2024)
ConFoThinking: Consolidated Focused Attention Driven Thinking for Visual Question Answering
par: Wu, Zhaodong, et autres
Publié: (2026)
par: Wu, Zhaodong, et autres
Publié: (2026)
Questioning the Stability of Visual Question Answering
par: Rosenfeld, Amir, et autres
Publié: (2025)
par: Rosenfeld, Amir, et autres
Publié: (2025)
Documents similaires
-
Revisiting Birds Eye View Perception Models with Frozen Foundation Models: DINOv2 and Metric3Dv2
par: Hayes, Seamie, et autres
Publié: (2025) -
Easy3D-Labels: Supervising Semantic Occupancy Estimation with 3D Pseudo-Labels for Automotive Perception
par: Hayes, Seamie, et autres
Publié: (2025) -
Probing Visual Concepts in Lightweight Vision-Language Models for Automated Driving
par: Theodoridis, Nikos, et autres
Publié: (2026) -
Descriptor: Distance-Annotated Traffic Perception Question Answering (DTPQA)
par: Theodoridis, Nikos, et autres
Publié: (2025) -
Optimizing Ego Vehicle Trajectory Prediction: The Graph Enhancement Approach
par: Sharma, Sushil, et autres
Publié: (2023)