Towards Robust Unsupervised Attention Prediction in Autonomous Driving
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qi, Mengshi, Bi, Xiaoyang, Zhu, Pengfei, Ma, Huadong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Balanced Multi-Modal Learning in 3D Human Pose Estimation
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Action Quality Assessment via Hierarchical Pose-guided Multi-stage Contrastive Regression
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Uncovering the human motion pattern: Pattern Memory-based Diffusion Model for Trajectory Prediction
par: Yang, Yuxin, et autres
Publié: (2024)
par: Yang, Yuxin, et autres
Publié: (2024)
Chain-of-Evidence Multimodal Reasoning for Few-shot Temporal Action Localization
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
T2SG: Traffic Topology Scene Graph for Topology Reasoning in Autonomous Driving
par: Lv, Changsheng, et autres
Publié: (2024)
par: Lv, Changsheng, et autres
Publié: (2024)
Improving Batch Normalization with TTA for Robust Object Detection in Self-Driving
par: Liao, Dacheng, et autres
Publié: (2024)
par: Liao, Dacheng, et autres
Publié: (2024)
DC-SAM: In-Context Segment Anything in Images and Videos via Dual Consistency
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Robust Disentangled Counterfactual Learning for Physical Audiovisual Commonsense Reasoning
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Learning Group Interactions and Semantic Intentions for Multi-Object Trajectory Prediction
par: Qi, Mengshi, et autres
Publié: (2024)
par: Qi, Mengshi, et autres
Publié: (2024)
Multi-Stage Contrastive Regression for Action Quality Assessment
par: An, Qi, et autres
Publié: (2024)
par: An, Qi, et autres
Publié: (2024)
Robo-SGG: Exploiting Layout-Oriented Normalization and Restitution Can Improve Robust Scene Graph Generation
par: Lv, Changsheng, et autres
Publié: (2025)
par: Lv, Changsheng, et autres
Publié: (2025)
VLM-Assisted Continual learning for Visual Question Answering in Self-Driving
par: Lin, Yuxin, et autres
Publié: (2025)
par: Lin, Yuxin, et autres
Publié: (2025)
Multimodal-Enhanced Objectness Learner for Corner Case Detection in Autonomous Driving
par: Xiao, Lixing, et autres
Publié: (2024)
par: Xiao, Lixing, et autres
Publié: (2024)
Towards Efficient Object Re-Identification with A Novel Cloud-Edge Collaborative Framework
par: Wang, Chuanming, et autres
Publié: (2024)
par: Wang, Chuanming, et autres
Publié: (2024)
Question-Aware Evidence Ledgers for Video Relational Reasoning
par: Ou, Yilin, et autres
Publié: (2026)
par: Ou, Yilin, et autres
Publié: (2026)
Decomposed Vector-Quantized Variational Autoencoder for Human Grasp Generation
par: Zhao, Zhe, et autres
Publié: (2024)
par: Zhao, Zhe, et autres
Publié: (2024)
Optimization of Autonomous Driving Image Detection Based on RFAConv and Triplet Attention
par: Ling, Zhipeng, et autres
Publié: (2024)
par: Ling, Zhipeng, et autres
Publié: (2024)
Global-Local Tree Search in VLMs for 3D Indoor Scene Generation
par: Deng, Wei, et autres
Publié: (2025)
par: Deng, Wei, et autres
Publié: (2025)
SWA-SOP: Spatially-aware Window Attention for Semantic Occupancy Prediction in Autonomous Driving
par: Cao, Helin, et autres
Publié: (2025)
par: Cao, Helin, et autres
Publié: (2025)
VLM-E2E: Enhancing End-to-End Autonomous Driving with Multimodal Driver Attention Fusion
par: Liu, Pei, et autres
Publié: (2025)
par: Liu, Pei, et autres
Publié: (2025)
Drive-KD: Multi-Teacher Distillation for VLMs in Autonomous Driving
par: Lian, Weitong, et autres
Publié: (2026)
par: Lian, Weitong, et autres
Publié: (2026)
RoGA: Towards Generalizable Deepfake Detection through Robust Gradient Alignment
par: Qiu, Lingyu, et autres
Publié: (2025)
par: Qiu, Lingyu, et autres
Publié: (2025)
Work Zones challenge VLM Trajectory Planning: Toward Mitigation and Robust Autonomous Driving
par: Liao, Yifan, et autres
Publié: (2025)
par: Liao, Yifan, et autres
Publié: (2025)
Segment-Anything Models Achieve Zero-shot Robustness in Autonomous Driving
par: Yan, Jun, et autres
Publié: (2024)
par: Yan, Jun, et autres
Publié: (2024)
Multi-Scale Spectral Attention Module-based Hyperspectral Segmentation in Autonomous Driving Scenarios
par: Shah, Imad Ali, et autres
Publié: (2025)
par: Shah, Imad Ali, et autres
Publié: (2025)
Searching Realistic-Looking Adversarial Objects For Autonomous Driving Systems
par: Sun, Shengxiang, et autres
Publié: (2024)
par: Sun, Shengxiang, et autres
Publié: (2024)
VidPrism: Heterogeneous Mixture of Experts for Image-to-Video Transfer
par: Lin, Rui, et autres
Publié: (2026)
par: Lin, Rui, et autres
Publié: (2026)
COTTA: Context-Aware Transfer Adaptation for Trajectory Prediction in Autonomous Driving
par: Park, Seohyoung, et autres
Publié: (2026)
par: Park, Seohyoung, et autres
Publié: (2026)
Uncertainty-Encoded Multi-Modal Fusion for Robust Object Detection in Autonomous Driving
par: Lou, Yang, et autres
Publié: (2023)
par: Lou, Yang, et autres
Publié: (2023)
Explainable Action Form Assessment by Exploiting Multimodal Chain-of-Thoughts Reasoning
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
A New Teacher-Reviewer-Student Framework for Semi-supervised 2D Human Pose Estimation
par: Yun, Wulian, et autres
Publié: (2025)
par: Yun, Wulian, et autres
Publié: (2025)
Semi-Supervised Teacher-Reference-Student Architecture for Action Quality Assessment
par: Yun, Wulian, et autres
Publié: (2024)
par: Yun, Wulian, et autres
Publié: (2024)
Invisible Triggers, Visible Threats! Road-Style Adversarial Creation Attack for Visual 3D Detection in Autonomous Driving
par: Wang, Jian, et autres
Publié: (2025)
par: Wang, Jian, et autres
Publié: (2025)
On the Real-World Adversarial Robustness of Real-Time Semantic Segmentation Models for Autonomous Driving
par: Rossolini, Giulio, et autres
Publié: (2022)
par: Rossolini, Giulio, et autres
Publié: (2022)
SUSTechGAN: Image Generation for Object Detection in Adverse Conditions of Autonomous Driving
par: Lan, Gongjin, et autres
Publié: (2024)
par: Lan, Gongjin, et autres
Publié: (2024)
Towards Camera Open-set 3D Object Detection for Autonomous Driving Scenarios
par: He, Zhuolin, et autres
Publié: (2024)
par: He, Zhuolin, et autres
Publié: (2024)
Learning Vision-Language-Action World Models for Autonomous Driving
par: Wang, Guoqing, et autres
Publié: (2026)
par: Wang, Guoqing, et autres
Publié: (2026)
Exploring Radar Data Representations in Autonomous Driving: A Comprehensive Review
par: Yao, Shanliang, et autres
Publié: (2023)
par: Yao, Shanliang, et autres
Publié: (2023)
GPT-4 Enhanced Multimodal Grounding for Autonomous Driving: Leveraging Cross-Modal Attention with Large Language Models
par: Liao, Haicheng, et autres
Publié: (2023)
par: Liao, Haicheng, et autres
Publié: (2023)
VL-DPO: Vision-Language-Guided Finetuning for Preference-Aligned Autonomous Driving
par: Xu, Zhefan, et autres
Publié: (2026)
par: Xu, Zhefan, et autres
Publié: (2026)
Documents similaires
-
Towards Balanced Multi-Modal Learning in 3D Human Pose Estimation
par: Qi, Mengshi, et autres
Publié: (2025) -
Action Quality Assessment via Hierarchical Pose-guided Multi-stage Contrastive Regression
par: Qi, Mengshi, et autres
Publié: (2025) -
Uncovering the human motion pattern: Pattern Memory-based Diffusion Model for Trajectory Prediction
par: Yang, Yuxin, et autres
Publié: (2024) -
Chain-of-Evidence Multimodal Reasoning for Few-shot Temporal Action Localization
par: Qi, Mengshi, et autres
Publié: (2025) -
T2SG: Traffic Topology Scene Graph for Topology Reasoning in Autonomous Driving
par: Lv, Changsheng, et autres
Publié: (2024)