AYDIV: Adaptable Yielding 3D Object Detection via Integrated Contextual Vision Transformer
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dam, Tanmoy, Dharavath, Sanjay Bhargav, Alam, Sameer, Lilith, Nimrod, Chakraborty, Supriyo, Feroskhan, Mir |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SaViD: Spectravista Aesthetic Vision Integration for Robust and Discerning 3D Object Detection in Challenging Environments
par: Dam, Tanmoy, et autres
Publié: (2025)
par: Dam, Tanmoy, et autres
Publié: (2025)
Quantum Inverse Contextual Vision Transformers (Q-ICVT): A New Frontier in 3D Object Detection for AVs
par: Dharavath, Sanjay Bhargav, et autres
Publié: (2024)
par: Dharavath, Sanjay Bhargav, et autres
Publié: (2024)
OrthoSeisnet: Seismic Inversion through Orthogonal Multi-scale Frequency Domain U-Net for Geophysical Exploration
par: Chakraborty, Supriyo, et autres
Publié: (2024)
par: Chakraborty, Supriyo, et autres
Publié: (2024)
Learning Multi-Pursuit Evasion for Safe Targeted Navigation of Drones
par: Xiao, Jiaping, et autres
Publié: (2023)
par: Xiao, Jiaping, et autres
Publié: (2023)
Vision-based Learning for Drones: A Survey
par: Xiao, Jiaping, et autres
Publié: (2023)
par: Xiao, Jiaping, et autres
Publié: (2023)
Grounded Vision-Language Navigation for UAVs with Open-Vocabulary Goal Understanding
par: Zhang, Yuhang, et autres
Publié: (2025)
par: Zhang, Yuhang, et autres
Publié: (2025)
Learning Resilient Formation Control of Drones with Graph Attention Network
par: Xiao, Jiaping, et autres
Publié: (2024)
par: Xiao, Jiaping, et autres
Publié: (2024)
Oracle-Guided Masked Contrastive Reinforcement Learning for Visuomotor Policies
par: Zhang, Yuhang, et autres
Publié: (2025)
par: Zhang, Yuhang, et autres
Publié: (2025)
Learning Adaptive Cross-Embodiment Visuomotor Policy with Contrastive Prompt Orchestration
par: Zhang, Yuhang, et autres
Publié: (2026)
par: Zhang, Yuhang, et autres
Publié: (2026)
FM-Planner: Foundation Model Guided Path Planning for Autonomous Drone Navigation
par: Xiao, Jiaping, et autres
Publié: (2025)
par: Xiao, Jiaping, et autres
Publié: (2025)
Clustering-based Learning for UAV Tracking and Pose Estimation
par: Xiao, Jiaping, et autres
Publié: (2024)
par: Xiao, Jiaping, et autres
Publié: (2024)
GaussFly: Contrastive Reinforcement Learning for Visuomotor Policies in 3D Gaussian Fields
par: Zhang, Yuhang, et autres
Publié: (2026)
par: Zhang, Yuhang, et autres
Publié: (2026)
Cross-Level Sensor Fusion with Object Lists via Transformer for 3D Object Detection
par: Liu, Xiangzhong, et autres
Publié: (2025)
par: Liu, Xiangzhong, et autres
Publié: (2025)
Left-right Discrepancy for Adversarial Attack on Stereo Networks
par: Wang, Pengfei, et autres
Publié: (2024)
par: Wang, Pengfei, et autres
Publié: (2024)
AED: Adaptable Error Detection for Few-shot Imitation Policy
par: Yeh, Jia-Fong, et autres
Publié: (2024)
par: Yeh, Jia-Fong, et autres
Publié: (2024)
Enhancing Safety and Robustness of Vision-Based Controllers via Reachability Analysis
par: Chakraborty, Kaustav, et autres
Publié: (2024)
par: Chakraborty, Kaustav, et autres
Publié: (2024)
Embodiment-Agnostic Navigation Policy Trained with Visual Demonstrations
par: Curtis, Nimrod, et autres
Publié: (2024)
par: Curtis, Nimrod, et autres
Publié: (2024)
RICL: Adding In-Context Adaptability to Pre-Trained Vision-Language-Action Models
par: Sridhar, Kaustubh, et autres
Publié: (2025)
par: Sridhar, Kaustubh, et autres
Publié: (2025)
Toward generic control for soft robotic systems
par: Sun, Yu, et autres
Publié: (2025)
par: Sun, Yu, et autres
Publié: (2025)
Vi-TacMan: Articulated Object Manipulation via Vision and Touch
par: Cui, Leiyao, et autres
Publié: (2025)
par: Cui, Leiyao, et autres
Publié: (2025)
Multimodal Human-Intent Modeling for Contextual Robot-to-Human Handovers of Arbitrary Objects
par: Chen, Lucas, et autres
Publié: (2025)
par: Chen, Lucas, et autres
Publié: (2025)
Inverse++: Vision-Centric 3D Semantic Occupancy Prediction Assisted with 3D Object Detection
par: Ming, Zhenxing, et autres
Publié: (2025)
par: Ming, Zhenxing, et autres
Publié: (2025)
FOMO-3D: Using Vision Foundation Models for Long-Tailed 3D Object Detection
par: Yang, Anqi Joyce, et autres
Publié: (2026)
par: Yang, Anqi Joyce, et autres
Publié: (2026)
MDHA: Multi-Scale Deformable Transformer with Hybrid Anchors for Multi-View 3D Object Detection
par: Adeline, Michelle, et autres
Publié: (2024)
par: Adeline, Michelle, et autres
Publié: (2024)
Towards Adaptable Humanoid Control via Adaptive Motion Tracking
par: Huang, Tao, et autres
Publié: (2025)
par: Huang, Tao, et autres
Publié: (2025)
CONTHER: Human-Like Contextual Robot Learning via Hindsight Experience Replay and Transformers without Expert Demonstrations
par: Makarova, Maria, et autres
Publié: (2025)
par: Makarova, Maria, et autres
Publié: (2025)
Weakly Supervised Point Clouds Transformer for 3D Object Detection
par: Tang, Zuojin, et autres
Publié: (2023)
par: Tang, Zuojin, et autres
Publié: (2023)
Toward Robust LiDAR based 3D Object Detection via Density-Aware Adaptive Thresholding
par: Lee, Eunho, et autres
Publié: (2024)
par: Lee, Eunho, et autres
Publié: (2024)
Augmenting Tactile Simulators with Real-like and Zero-Shot Capabilities
par: Azulay, Osher, et autres
Publié: (2023)
par: Azulay, Osher, et autres
Publié: (2023)
Scalable Vision-Based 3D Object Detection and Monocular Depth Estimation for Autonomous Driving
par: Liu, Yuxuan
Publié: (2024)
par: Liu, Yuxuan
Publié: (2024)
Demonstration-Enhanced Adaptable Multi-Objective Robot Navigation
par: de Heuvel, Jorge, et autres
Publié: (2024)
par: de Heuvel, Jorge, et autres
Publié: (2024)
An Adaptable, Safe, and Portable Robot-Assisted Feeding System
par: Gordon, Ethan Kroll, et autres
Publié: (2024)
par: Gordon, Ethan Kroll, et autres
Publié: (2024)
Enhancing Robotic Adaptability: Integrating Unsupervised Trajectory Segmentation and Conditional ProMPs for Dynamic Learning Environments
par: Gao, Tianci
Publié: (2024)
par: Gao, Tianci
Publié: (2024)
Visuotactile-Based Learning for Insertion with Compliant Hands
par: Azulay, Osher, et autres
Publié: (2024)
par: Azulay, Osher, et autres
Publié: (2024)
Learning Contextually-Adaptive Rewards via Calibrated Features
par: Forsey-Smerek, Alexandra, et autres
Publié: (2025)
par: Forsey-Smerek, Alexandra, et autres
Publié: (2025)
VinT-6D: A Large-Scale Object-in-hand Dataset from Vision, Touch and Proprioception
par: Wan, Zhaoliang, et autres
Publié: (2024)
par: Wan, Zhaoliang, et autres
Publié: (2024)
VisuoTactile 6D Pose Estimation of an In-Hand Object using Vision and Tactile Sensor Data
par: Dikhale, Snehal s., et autres
Publié: (2026)
par: Dikhale, Snehal s., et autres
Publié: (2026)
Adaptable, shape-conforming robotic endoscope
par: Du, Jiayang, et autres
Publié: (2024)
par: Du, Jiayang, et autres
Publié: (2024)
3DGSNav: Enhancing Vision-Language Model Reasoning for Object Navigation via Active 3D Gaussian Splatting
par: Zheng, Wancai, et autres
Publié: (2026)
par: Zheng, Wancai, et autres
Publié: (2026)
Learning Position From Vehicle Vibration Using an Inertial Measurement Unit
par: Or, Barak, et autres
Publié: (2023)
par: Or, Barak, et autres
Publié: (2023)
Documents similaires
-
SaViD: Spectravista Aesthetic Vision Integration for Robust and Discerning 3D Object Detection in Challenging Environments
par: Dam, Tanmoy, et autres
Publié: (2025) -
Quantum Inverse Contextual Vision Transformers (Q-ICVT): A New Frontier in 3D Object Detection for AVs
par: Dharavath, Sanjay Bhargav, et autres
Publié: (2024) -
OrthoSeisnet: Seismic Inversion through Orthogonal Multi-scale Frequency Domain U-Net for Geophysical Exploration
par: Chakraborty, Supriyo, et autres
Publié: (2024) -
Learning Multi-Pursuit Evasion for Safe Targeted Navigation of Drones
par: Xiao, Jiaping, et autres
Publié: (2023) -
Vision-based Learning for Drones: A Survey
par: Xiao, Jiaping, et autres
Publié: (2023)