UAV-OVO: Out-of-Viewpoint Generalization in UAV Action Recognition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xia, Yu, Zhang, Zhengbo, Zhang, Shuaihu, Tu, Zhigang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Masked Diffusion Vision-Language Models for Temporal Action Localization
par: Wang, Fengshun, et autres
Publié: (2026)
par: Wang, Fengshun, et autres
Publié: (2026)
Informative Sample Selection Model for Skeleton-based Action Recognition with Limited Training Samples
par: Tu, Zhigang, et autres
Publié: (2025)
par: Tu, Zhigang, et autres
Publié: (2025)
Frequency-Enhanced Diffusion Models: Curriculum-Guided Semantic Alignment for Zero-Shot Skeleton Action Recognition
par: Zhou, Yuxi, et autres
Publié: (2026)
par: Zhou, Yuxi, et autres
Publié: (2026)
EFSI-DETR: Efficient Frequency-Semantic Integration for Real-Time Small Object Detection in UAV Imagery
par: Xia, Yu, et autres
Publié: (2026)
par: Xia, Yu, et autres
Publié: (2026)
Expressive Keypoints for Skeleton-based Action Recognition via Skeleton Transformation
par: Yang, Yijie, et autres
Publié: (2024)
par: Yang, Yijie, et autres
Publié: (2024)
OwlSight: A Robust Illumination Adaptation Framework for Dark Video Human Action Recognition
par: Cheng, Shihao, et autres
Publié: (2025)
par: Cheng, Shihao, et autres
Publié: (2025)
Adaptive Prototype Model for Attribute-based Multi-label Few-shot Action Recognition
par: Xiao, Juefeng, et autres
Publié: (2025)
par: Xiao, Juefeng, et autres
Publié: (2025)
Leveraging Text-to-Image Diffusion Models for Unsupervised Visual Object Tracking
par: Zhang, Zhengbo, et autres
Publié: (2026)
par: Zhang, Zhengbo, et autres
Publié: (2026)
Beyond the Horizon: Decoupling Multi-View UAV Action Recognition via Partial Order Transfer
par: Liu, Wenxuan, et autres
Publié: (2025)
par: Liu, Wenxuan, et autres
Publié: (2025)
EVD4UAV: An Altitude-Sensitive Benchmark to Evade Vehicle Detection in UAV
par: Sun, Huiming, et autres
Publié: (2024)
par: Sun, Huiming, et autres
Publié: (2024)
FADE: A Dataset for Detecting Falling Objects around Buildings in Video
par: Tu, Zhigang, et autres
Publié: (2024)
par: Tu, Zhigang, et autres
Publié: (2024)
HUGE-Bench: A Benchmark for High-Level UAV Vision-Language-Action Tasks
par: Guo, Jingyu, et autres
Publié: (2026)
par: Guo, Jingyu, et autres
Publié: (2026)
UAV-VL-R1: Generalizing Vision-Language Models via Supervised Fine-Tuning and Multi-Stage GRPO for UAV Visual Reasoning
par: Guan, Jiajin, et autres
Publié: (2025)
par: Guan, Jiajin, et autres
Publié: (2025)
How Far are Modern Trackers from UAV-Anti-UAV? A Million-Scale Benchmark and New Baseline
par: Zhang, Chunhui, et autres
Publié: (2025)
par: Zhang, Chunhui, et autres
Publié: (2025)
Visual Place Recognition for Large-Scale UAV Applications
par: Papapetros, Ioannis Tsampikos, et autres
Publié: (2025)
par: Papapetros, Ioannis Tsampikos, et autres
Publié: (2025)
CST Anti-UAV: A Thermal Infrared Benchmark for Tiny UAV Tracking in Complex Scenes
par: Xie, Bin, et autres
Publié: (2025)
par: Xie, Bin, et autres
Publié: (2025)
MCOP: Multi-UAV Collaborative Occupancy Prediction
par: Lin, Zefu, et autres
Publié: (2025)
par: Lin, Zefu, et autres
Publié: (2025)
Learning to Generalize without Bias for Open-Vocabulary Action Recognition
par: Yu, Yating, et autres
Publié: (2025)
par: Yu, Yating, et autres
Publié: (2025)
An Event-based Fast Intensity Reconstruction Scheme for UAV Real-time Perception
par: Dong, Xin, et autres
Publié: (2025)
par: Dong, Xin, et autres
Publié: (2025)
UAV-Track VLA: Embodied Aerial Tracking via Vision-Language-Action Models
par: Zhang, Qiyao, et autres
Publié: (2026)
par: Zhang, Qiyao, et autres
Publié: (2026)
Generalization Evaluation of Deep Stereo Matching Methods for UAV-Based Forestry Applications
par: Lin, Yida, et autres
Publié: (2025)
par: Lin, Yida, et autres
Publié: (2025)
UAUTrack: Towards Unified Multimodal Anti-UAV Visual Tracking
par: Ren, Qionglin, et autres
Publié: (2025)
par: Ren, Qionglin, et autres
Publié: (2025)
Generative Motion Stylization of Cross-structure Characters within Canonical Motion Space
par: Zhang, Jiaxu, et autres
Publié: (2024)
par: Zhang, Jiaxu, et autres
Publié: (2024)
UAV-VisLoc: A Large-scale Dataset for UAV Visual Localization
par: Xu, Wenjia, et autres
Publié: (2024)
par: Xu, Wenjia, et autres
Publié: (2024)
Prototype-Based Low Altitude UAV Semantic Segmentation
par: Zhang, Da, et autres
Publié: (2026)
par: Zhang, Da, et autres
Publié: (2026)
Uni-HOI:A Unified framework for Learning the Joint distribution of Text and Human-Object Interaction
par: Zhang, Mengfei, et autres
Publié: (2026)
par: Zhang, Mengfei, et autres
Publié: (2026)
Can Vision-Language Models Think from the Sky? Unifying UAV Reasoning and Generation
par: Sun, Jintao, et autres
Publié: (2026)
par: Sun, Jintao, et autres
Publié: (2026)
Visual Prototype Conditioned Focal Region Generation for UAV-Based Object Detection
par: Li, Wenhao, et autres
Publié: (2026)
par: Li, Wenhao, et autres
Publié: (2026)
Unifying UAV Cross-View Geo-Localization via 3D Geometric Perception
par: Li, Haoyuan, et autres
Publié: (2026)
par: Li, Haoyuan, et autres
Publié: (2026)
M$^2$E-UAV: A Benchmark and Analysis for Onboard Motion-on-Motion Event-Based Tiny UAV Detection
par: Yan, Weiqi, et autres
Publié: (2026)
par: Yan, Weiqi, et autres
Publié: (2026)
UAV (Unmanned Aerial Vehicles): Diverse Applications of UAV Datasets in Segmentation, Classification, Detection, and Tracking
par: Rahman, Md. Mahfuzur, et autres
Publié: (2024)
par: Rahman, Md. Mahfuzur, et autres
Publié: (2024)
UAV-Rain1k: A Benchmark for Raindrop Removal from UAV Aerial Imagery
par: Chang, Wenhui, et autres
Publié: (2024)
par: Chang, Wenhui, et autres
Publié: (2024)
Improving Viewpoint-Invariance and Temporal Consistency for Action Detection
par: Porto, Yannick, et autres
Publié: (2026)
par: Porto, Yannick, et autres
Publié: (2026)
Radiance Field Learners As UAV First-Person Viewers
par: Yan, Liqi, et autres
Publié: (2024)
par: Yan, Liqi, et autres
Publié: (2024)
FALCON: Future-Aware Learning with Contextual Object-Centric Pretraining for UAV Action Recognition
par: Xian, Ruiqi, et autres
Publié: (2024)
par: Xian, Ruiqi, et autres
Publié: (2024)
TAE: Target-aware enhancer for nighttime UAV tracking
par: Chen, Yanyan, et autres
Publié: (2026)
par: Chen, Yanyan, et autres
Publié: (2026)
Dynamic Semantic-Aware Correlation Modeling for UAV Tracking
par: Zhou, Xinyu, et autres
Publié: (2025)
par: Zhou, Xinyu, et autres
Publié: (2025)
Layer-Guided UAV Tracking: Enhancing Efficiency and Occlusion Robustness
par: Zhou, Yang, et autres
Publié: (2026)
par: Zhou, Yang, et autres
Publié: (2026)
MambaTrack: Exploiting Dual-Enhancement for Night UAV Tracking
par: Zhang, Chunhui, et autres
Publié: (2024)
par: Zhang, Chunhui, et autres
Publié: (2024)
UAV-CB: A Complex-Background RGB-T Dataset and Local Frequency Bridge Network for UAV Detection
par: Huang, Shenghui, et autres
Publié: (2026)
par: Huang, Shenghui, et autres
Publié: (2026)
Documents similaires
-
Masked Diffusion Vision-Language Models for Temporal Action Localization
par: Wang, Fengshun, et autres
Publié: (2026) -
Informative Sample Selection Model for Skeleton-based Action Recognition with Limited Training Samples
par: Tu, Zhigang, et autres
Publié: (2025) -
Frequency-Enhanced Diffusion Models: Curriculum-Guided Semantic Alignment for Zero-Shot Skeleton Action Recognition
par: Zhou, Yuxi, et autres
Publié: (2026) -
EFSI-DETR: Efficient Frequency-Semantic Integration for Real-Time Small Object Detection in UAV Imagery
par: Xia, Yu, et autres
Publié: (2026) -
Expressive Keypoints for Skeleton-based Action Recognition via Skeleton Transformation
par: Yang, Yijie, et autres
Publié: (2024)