SwapTransformer: highway overtaking tactical planner model via imitation learning on OSHA dataset
Fuente:
arXiv
Salvato in:
| Autori principali: | Shamsoshoara, Alireza, Salih, Safin B, Aghazadeh, Pedram |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Goal-conditioned dual-action imitation learning for dexterous dual-arm robot manipulation
di: Kim, Heecheol, et al.
Pubblicazione: (2022)
di: Kim, Heecheol, et al.
Pubblicazione: (2022)
EmbodiSwap for Zero-Shot Robot Imitation Learning
di: Dessalene, Eadom, et al.
Pubblicazione: (2025)
di: Dessalene, Eadom, et al.
Pubblicazione: (2025)
TransForSeg: A Multitask Stereo ViT for Joint Stereo Segmentation and 3D Force Estimation in Catheterization
di: Fekri, Pedram, et al.
Pubblicazione: (2025)
di: Fekri, Pedram, et al.
Pubblicazione: (2025)
Accelerating Transformer-Based Monocular SLAM via Geometric Utility Scoring
di: Xiong, Xinmiao, et al.
Pubblicazione: (2026)
di: Xiong, Xinmiao, et al.
Pubblicazione: (2026)
Point-LN: A Lightweight Framework for Efficient Point Cloud Classification Using Non-Parametric Positional Encoding
di: Mohammadi, Marzieh, et al.
Pubblicazione: (2025)
di: Mohammadi, Marzieh, et al.
Pubblicazione: (2025)
Enhancing 3D Point Cloud Classification with ModelNet-R and Point-SkipNet
di: Saeid, Mohammad, et al.
Pubblicazione: (2025)
di: Saeid, Mohammad, et al.
Pubblicazione: (2025)
DINO-CVA: A Multimodal Goal-Conditioned Vision-to-Action Model for Autonomous Catheter Navigation
di: Fekri, Pedram, et al.
Pubblicazione: (2025)
di: Fekri, Pedram, et al.
Pubblicazione: (2025)
AYDIV: Adaptable Yielding 3D Object Detection via Integrated Contextual Vision Transformer
di: Dam, Tanmoy, et al.
Pubblicazione: (2024)
di: Dam, Tanmoy, et al.
Pubblicazione: (2024)
Aug3D: Augmenting large scale outdoor datasets for Generalizable Novel View Synthesis
di: Rauniyar, Aditya, et al.
Pubblicazione: (2025)
di: Rauniyar, Aditya, et al.
Pubblicazione: (2025)
Look, Focus, Act: Efficient and Robust Robot Learning via Human Gaze and Foveated Vision Transformers
di: Chuang, Ian, et al.
Pubblicazione: (2025)
di: Chuang, Ian, et al.
Pubblicazione: (2025)
MTA-RL: Robust Urban Driving via Multi-modal Transformer-based 3D Affordances and Reinforcement Learning
di: Chen, Guangli, et al.
Pubblicazione: (2026)
di: Chen, Guangli, et al.
Pubblicazione: (2026)
DVGT: Driving Visual Geometry Transformer
di: Zuo, Sicheng, et al.
Pubblicazione: (2025)
di: Zuo, Sicheng, et al.
Pubblicazione: (2025)
On-Device Diffusion Transformer Policy for Efficient Robot Manipulation
di: Wu, Yiming, et al.
Pubblicazione: (2025)
di: Wu, Yiming, et al.
Pubblicazione: (2025)
VIT-Ped: Visionary Intention Transformer for Pedestrian Behavior Analysis
di: Elkammar, Aly R., et al.
Pubblicazione: (2026)
di: Elkammar, Aly R., et al.
Pubblicazione: (2026)
HiRT: Enhancing Robotic Control with Hierarchical Robot Transformers
di: Zhang, Jianke, et al.
Pubblicazione: (2024)
di: Zhang, Jianke, et al.
Pubblicazione: (2024)
Weakly Supervised Point Clouds Transformer for 3D Object Detection
di: Tang, Zuojin, et al.
Pubblicazione: (2023)
di: Tang, Zuojin, et al.
Pubblicazione: (2023)
LIAM: Multimodal Transformer for Language Instructions, Images, Actions and Semantic Maps
di: Wang, Yihao, et al.
Pubblicazione: (2025)
di: Wang, Yihao, et al.
Pubblicazione: (2025)
Hierarchical place recognition with omnidirectional images and curriculum learning-based loss functions
di: Alfaro, Marcos, et al.
Pubblicazione: (2024)
di: Alfaro, Marcos, et al.
Pubblicazione: (2024)
Privacy-Preserving Multi-Stage Fall Detection Framework with Semi-supervised Federated Learning and Robotic Vision Confirmation
di: Azghadi, Seyed Alireza Rahimi, et al.
Pubblicazione: (2025)
di: Azghadi, Seyed Alireza Rahimi, et al.
Pubblicazione: (2025)
Understanding Video Transformers via Universal Concept Discovery
di: Kowal, Matthew, et al.
Pubblicazione: (2024)
di: Kowal, Matthew, et al.
Pubblicazione: (2024)
Region-Transformer: Self-Attention Region Based Class-Agnostic Point Cloud Segmentation
di: Gyawali, Dipesh, et al.
Pubblicazione: (2024)
di: Gyawali, Dipesh, et al.
Pubblicazione: (2024)
InterACT: Inter-dependency Aware Action Chunking with Hierarchical Attention Transformers for Bimanual Manipulation
di: Lee, Andrew, et al.
Pubblicazione: (2024)
di: Lee, Andrew, et al.
Pubblicazione: (2024)
CAPT: Category-level Articulation Estimation from a Single Point Cloud Using Transformer
di: Fu, Lian, et al.
Pubblicazione: (2024)
di: Fu, Lian, et al.
Pubblicazione: (2024)
M2DA: Multi-Modal Fusion Transformer Incorporating Driver Attention for Autonomous Driving
di: Xu, Dongyang, et al.
Pubblicazione: (2024)
di: Xu, Dongyang, et al.
Pubblicazione: (2024)
TransFusionOdom: Interpretable Transformer-based LiDAR-Inertial Fusion Odometry Estimation
di: Sun, Leyuan, et al.
Pubblicazione: (2023)
di: Sun, Leyuan, et al.
Pubblicazione: (2023)
X-VLA: Soft-Prompted Transformer as Scalable Cross-Embodiment Vision-Language-Action Model
di: Zheng, Jinliang, et al.
Pubblicazione: (2025)
di: Zheng, Jinliang, et al.
Pubblicazione: (2025)
Integrating Features for Recognizing Human Activities through Optimized Parameters in Graph Convolutional Networks and Transformer Architectures
di: Belal, Mohammad, et al.
Pubblicazione: (2024)
di: Belal, Mohammad, et al.
Pubblicazione: (2024)
Pair-VPR: Place-Aware Pre-training and Contrastive Pair Classification for Visual Place Recognition with Vision Transformers
di: Hausler, Stephen, et al.
Pubblicazione: (2024)
di: Hausler, Stephen, et al.
Pubblicazione: (2024)
DaFoEs: Mixing Datasets towards the generalization of vision-state deep-learning Force Estimation in Minimally Invasive Robotic Surgery
di: Reyzabal, Mikel De Iturrate, et al.
Pubblicazione: (2024)
di: Reyzabal, Mikel De Iturrate, et al.
Pubblicazione: (2024)
H-Net: A Multitask Architecture for Simultaneous 3D Force Estimation and Stereo Semantic Segmentation in Intracardiac Catheters
di: Fekri, Pedram, et al.
Pubblicazione: (2024)
di: Fekri, Pedram, et al.
Pubblicazione: (2024)
OmniNOCS: A unified NOCS dataset and model for 3D lifting of 2D objects
di: Krishnan, Akshay, et al.
Pubblicazione: (2024)
di: Krishnan, Akshay, et al.
Pubblicazione: (2024)
Validation & Exploration of Multimodal Deep-Learning Camera-Lidar Calibration models
di: Karramreddy, Venkat, et al.
Pubblicazione: (2024)
di: Karramreddy, Venkat, et al.
Pubblicazione: (2024)
Grounding Driving VLA via Inverse Kinematics
di: Park, Junsung, et al.
Pubblicazione: (2026)
di: Park, Junsung, et al.
Pubblicazione: (2026)
Planning with the Views via Scene Self-Exploration
di: Wang, Kangrui, et al.
Pubblicazione: (2026)
di: Wang, Kangrui, et al.
Pubblicazione: (2026)
Extending Deep Event Visual Odometry with Sparse Point-Cloud Export
di: Safdari, Alireza, et al.
Pubblicazione: (2026)
di: Safdari, Alireza, et al.
Pubblicazione: (2026)
Leveraging Foundation Models To learn the shape of semi-fluid deformable objects
di: Assal, Omar El, et al.
Pubblicazione: (2024)
di: Assal, Omar El, et al.
Pubblicazione: (2024)
PhotoBot: Reference-Guided Interactive Photography via Natural Language
di: Limoyo, Oliver, et al.
Pubblicazione: (2024)
di: Limoyo, Oliver, et al.
Pubblicazione: (2024)
sam-llm: interpretable lane change trajectoryprediction via parametric finetuning
di: Cao, Zhuo, et al.
Pubblicazione: (2025)
di: Cao, Zhuo, et al.
Pubblicazione: (2025)
Efficient Robotic Policy Learning via Latent Space Backward Planning
di: Liu, Dongxiu, et al.
Pubblicazione: (2025)
di: Liu, Dongxiu, et al.
Pubblicazione: (2025)
RoboSafe: Safeguarding Embodied Agents via Executable Safety Logic
di: Wang, Le, et al.
Pubblicazione: (2025)
di: Wang, Le, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Goal-conditioned dual-action imitation learning for dexterous dual-arm robot manipulation
di: Kim, Heecheol, et al.
Pubblicazione: (2022) -
EmbodiSwap for Zero-Shot Robot Imitation Learning
di: Dessalene, Eadom, et al.
Pubblicazione: (2025) -
TransForSeg: A Multitask Stereo ViT for Joint Stereo Segmentation and 3D Force Estimation in Catheterization
di: Fekri, Pedram, et al.
Pubblicazione: (2025) -
Accelerating Transformer-Based Monocular SLAM via Geometric Utility Scoring
di: Xiong, Xinmiao, et al.
Pubblicazione: (2026) -
Point-LN: A Lightweight Framework for Efficient Point Cloud Classification Using Non-Parametric Positional Encoding
di: Mohammadi, Marzieh, et al.
Pubblicazione: (2025)