FADet: A Multi-sensor 3D Object Detection Network based on Local Featured Attention
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guo, Ziang, Yagudin, Zakhar, Asfaw, Selamawit, Lykov, Artem, Tsetserukou, Dzmitry |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VDT-Auto: End-to-end Autonomous Driving with VLM-Guided Diffusion Transformers
par: Guo, Ziang, et autres
Publié: (2025)
par: Guo, Ziang, et autres
Publié: (2025)
METDrive: Multi-modal End-to-end Autonomous Driving with Temporal Guidance
par: Guo, Ziang, et autres
Publié: (2024)
par: Guo, Ziang, et autres
Publié: (2024)
VLM-Auto: VLM-based Autonomous Driving Assistant with Human-like Behavior and Understanding for Complex Road Scenes
par: Guo, Ziang, et autres
Publié: (2024)
par: Guo, Ziang, et autres
Publié: (2024)
EagleVision: A Multi-Task Benchmark for Cross-Domain Perception in High-Speed Autonomous Racing
par: Yagudin, Zakhar, et autres
Publié: (2026)
par: Yagudin, Zakhar, et autres
Publié: (2026)
DogSurf: Quadruped Robot Capable of GRU-based Surface Recognition for Blind Person Navigation
par: Bazhenov, Artem, et autres
Publié: (2024)
par: Bazhenov, Artem, et autres
Publié: (2024)
HawkDrive: A Transformer-driven Visual Perception System for Autonomous Driving in Night Scene
par: Guo, Ziang, et autres
Publié: (2024)
par: Guo, Ziang, et autres
Publié: (2024)
GestLLM: Advanced Hand Gesture Interpretation via Large Language Models for Human-Robot Interaction
par: Kobzarev, Oleg, et autres
Publié: (2025)
par: Kobzarev, Oleg, et autres
Publié: (2025)
GestOS: Advanced Hand Gesture Interpretation via Large Language Models to control Any Type of Robot
par: Lykov, Artem, et autres
Publié: (2025)
par: Lykov, Artem, et autres
Publié: (2025)
FlightAR: AR Flight Assistance Interface with Multiple Video Streams and Object Detection Aimed at Immersive Drone Control
par: Sautenkov, Oleg, et autres
Publié: (2024)
par: Sautenkov, Oleg, et autres
Publié: (2024)
Robots Can Feel: LLM-based Framework for Robot Ethical Reasoning
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
VR-GPT: Visual Language Model for Intelligent Virtual Reality Applications
par: Konenkov, Mikhail, et autres
Publié: (2024)
par: Konenkov, Mikhail, et autres
Publié: (2024)
DiffusionCinema: Text-to-Aerial Cinematography
par: Serpiva, Valerii, et autres
Publié: (2026)
par: Serpiva, Valerii, et autres
Publié: (2026)
UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation
par: Sautenkov, Oleg, et autres
Publié: (2025)
par: Sautenkov, Oleg, et autres
Publié: (2025)
LucidGrasp: Robotic Framework for Autonomous Manipulation of Laboratory Equipment with Different Degrees of Transparency via 6D Pose Estimation
par: Makarova, Maria, et autres
Publié: (2024)
par: Makarova, Maria, et autres
Publié: (2024)
MissionGPT: Mission Planner for Mobile Robot based on Robotics Transformer Model
par: Berman, Vladimir, et autres
Publié: (2024)
par: Berman, Vladimir, et autres
Publié: (2024)
Collaborative Trajectory Prediction via Late Fusion
par: Madjid, Nadya Abdel, et autres
Publié: (2026)
par: Madjid, Nadya Abdel, et autres
Publié: (2026)
DyFADet: Dynamic Feature Aggregation for Temporal Action Detection
par: Yang, Le, et autres
Publié: (2024)
par: Yang, Le, et autres
Publié: (2024)
Multi-scale Feature Fusion with Point Pyramid for 3D Object Detection
par: Lu, Weihao, et autres
Publié: (2024)
par: Lu, Weihao, et autres
Publié: (2024)
FlightDiffusion: Revolutionising Autonomous Drone Training with Diffusion Models Generating FPV Video
par: Serpiva, Valerii, et autres
Publié: (2025)
par: Serpiva, Valerii, et autres
Publié: (2025)
Multi-Object Tracking based on Imaging Radar 3D Object Detection
par: Palmer, Patrick, et autres
Publié: (2024)
par: Palmer, Patrick, et autres
Publié: (2024)
Shake-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Manipulations and Liquid Mixing
par: Khan, Muhamamd Haris, et autres
Publié: (2025)
par: Khan, Muhamamd Haris, et autres
Publié: (2025)
SMR-Net:Robot Snap Detection Based on Multi-Scale Features and Self-Attention Network
par: Hou, Kuanxu
Publié: (2026)
par: Hou, Kuanxu
Publié: (2026)
Evolution 6.0: Robot Evolution through Generative Design
par: Khan, Muhammad Haris, et autres
Publié: (2025)
par: Khan, Muhammad Haris, et autres
Publié: (2025)
TraIL-Det: Transformation-Invariant Local Feature Networks for 3D LiDAR Object Detection with Unsupervised Pre-Training
par: Li, Li, et autres
Publié: (2024)
par: Li, Li, et autres
Publié: (2024)
LLM-MARS: Large Language Model for Behavior Tree Generation and NLP-enhanced Dialogue in Multi-Agent Robot Systems
par: Lykov, Artem, et autres
Publié: (2023)
par: Lykov, Artem, et autres
Publié: (2023)
Improving Generalization Ability for 3D Object Detection by Learning Sparsity-invariant Features
par: Lu, Hsin-Cheng, et autres
Publié: (2025)
par: Lu, Hsin-Cheng, et autres
Publié: (2025)
FlockGPT: Guiding UAV Flocking with Linguistic Orchestration
par: Lykov, Artem, et autres
Publié: (2024)
par: Lykov, Artem, et autres
Publié: (2024)
Bi-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Dexterous Manipulations
par: Gbagbe, Koffivi Fidèle, et autres
Publié: (2024)
par: Gbagbe, Koffivi Fidèle, et autres
Publié: (2024)
DreamToNav: Generalizable Navigation for Robots via Generative Video Planning
par: Serpiva, Valerii, et autres
Publié: (2026)
par: Serpiva, Valerii, et autres
Publié: (2026)
UAV-VLRR: Vision-Language Informed NMPC for Rapid Response in UAV Search and Rescue
par: Yaqoot, Yasheerah, et autres
Publié: (2025)
par: Yaqoot, Yasheerah, et autres
Publié: (2025)
CoIn3D: Revisiting Configuration-Invariant Multi-Camera 3D Object Detection
par: Kuang, Zhaonian, et autres
Publié: (2026)
par: Kuang, Zhaonian, et autres
Publié: (2026)
3D Feature Distillation with Object-Centric Priors
par: Tziafas, Georgios, et autres
Publié: (2024)
par: Tziafas, Georgios, et autres
Publié: (2024)
MATT-GS: Masked Attention-based 3DGS for Robot Perception and Object Detection
par: Lee, Jee Won, et autres
Publié: (2025)
par: Lee, Jee Won, et autres
Publié: (2025)
UncertaintyTrack: Exploiting Detection and Localization Uncertainty in Multi-Object Tracking
par: Lee, Chang Won, et autres
Publié: (2024)
par: Lee, Chang Won, et autres
Publié: (2024)
DVPE: Divided View Position Embedding for Multi-View 3D Object Detection
par: Wang, Jiasen, et autres
Publié: (2024)
par: Wang, Jiasen, et autres
Publié: (2024)
BEVDilation: LiDAR-Centric Multi-Modal Fusion for 3D Object Detection
par: Zhang, Guowen, et autres
Publié: (2025)
par: Zhang, Guowen, et autres
Publié: (2025)
Perspective-Invariant 3D Object Detection
par: Liang, Ao, et autres
Publié: (2025)
par: Liang, Ao, et autres
Publié: (2025)
UAV-VLPA*: A Vision-Language-Path-Action System for Optimal Route Generation on a Large Scales
par: Sautenkov, Oleg, et autres
Publié: (2025)
par: Sautenkov, Oleg, et autres
Publié: (2025)
RaceVLA: VLA-based Racing Drone Navigation with Human-like Behaviour
par: Serpiva, Valerii, et autres
Publié: (2025)
par: Serpiva, Valerii, et autres
Publié: (2025)
PhysX-Omni: Unified Simulation-Ready Physical 3D Generation for Rigid, Deformable, and Articulated Objects
par: Cao, Ziang, et autres
Publié: (2026)
par: Cao, Ziang, et autres
Publié: (2026)
Documents similaires
-
VDT-Auto: End-to-end Autonomous Driving with VLM-Guided Diffusion Transformers
par: Guo, Ziang, et autres
Publié: (2025) -
METDrive: Multi-modal End-to-end Autonomous Driving with Temporal Guidance
par: Guo, Ziang, et autres
Publié: (2024) -
VLM-Auto: VLM-based Autonomous Driving Assistant with Human-like Behavior and Understanding for Complex Road Scenes
par: Guo, Ziang, et autres
Publié: (2024) -
EagleVision: A Multi-Task Benchmark for Cross-Domain Perception in High-Speed Autonomous Racing
par: Yagudin, Zakhar, et autres
Publié: (2026) -
DogSurf: Quadruped Robot Capable of GRU-based Surface Recognition for Blind Person Navigation
par: Bazhenov, Artem, et autres
Publié: (2024)