Multi-attention Associate Prediction Network for Visual Tracking
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Sun, Xinglong, Sun, Haijiang, Jiang, Shan, Wang, Jiacheng, Wei, Xilai, Hu, Zhonghe |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Target-aware Bidirectional Fusion Transformer for Aerial Object Tracking
von: Sun, Xinglong, et al.
Veröffentlicht: (2025)
von: Sun, Xinglong, et al.
Veröffentlicht: (2025)
GTA: Global Tracklet Association for Multi-Object Tracking in Sports
von: Sun, Jiacheng, et al.
Veröffentlicht: (2024)
von: Sun, Jiacheng, et al.
Veröffentlicht: (2024)
A Multi-Mode Structured Light 3D Imaging System with Multi-Source Information Fusion for Underwater Pipeline Detection
von: Hu, Qinghan, et al.
Veröffentlicht: (2025)
von: Hu, Qinghan, et al.
Veröffentlicht: (2025)
Text-Guided Channel Perturbation and Pretrained Knowledge Integration for Unified Multi-Modality Image Fusion
von: Li, Xilai, et al.
Veröffentlicht: (2025)
von: Li, Xilai, et al.
Veröffentlicht: (2025)
From Detection to Association: Learning Discriminative Object Embeddings for Multi-Object Tracking
von: Shao, Yuqing, et al.
Veröffentlicht: (2025)
von: Shao, Yuqing, et al.
Veröffentlicht: (2025)
Applications and Effect Evaluation of Generative Adversarial Networks in Semi-Supervised Learning
von: Hu, Jiyu, et al.
Veröffentlicht: (2025)
von: Hu, Jiyu, et al.
Veröffentlicht: (2025)
A Visual Self-attention Mechanism Facial Expression Recognition Network beyond Convnext
von: Nan, Bingyu, et al.
Veröffentlicht: (2025)
von: Nan, Bingyu, et al.
Veröffentlicht: (2025)
Floorplan-SLAM: A Real-Time, High-Accuracy, and Long-Term Multi-Session Point-Plane SLAM for Efficient Floorplan Reconstruction
von: Wang, Haolin, et al.
Veröffentlicht: (2025)
von: Wang, Haolin, et al.
Veröffentlicht: (2025)
SAMF: Small-Area-Aware Multi-focus Image Fusion for Object Detection
von: Li, Xilai, et al.
Veröffentlicht: (2024)
von: Li, Xilai, et al.
Veröffentlicht: (2024)
Progressive Scaling Visual Object Tracking
von: Hong, Jack, et al.
Veröffentlicht: (2025)
von: Hong, Jack, et al.
Veröffentlicht: (2025)
ODC-SA Net: Orthogonal Direction Enhancement and Scale Aware Network for Polyp Segmentation
von: Xu, Chenhao, et al.
Veröffentlicht: (2024)
von: Xu, Chenhao, et al.
Veröffentlicht: (2024)
Instance-level Visual Active Tracking with Occlusion-Aware Planning
von: Sun, Haowei, et al.
Veröffentlicht: (2026)
von: Sun, Haowei, et al.
Veröffentlicht: (2026)
C-DOG: Multi-View Multi-instance Feature Association Using Connected δ-Overlap Graphs
von: Sun, Yung-Hong, et al.
Veröffentlicht: (2025)
von: Sun, Yung-Hong, et al.
Veröffentlicht: (2025)
Adaptive Perception for Unified Visual Multi-modal Object Tracking
von: Hu, Xiantao, et al.
Veröffentlicht: (2025)
von: Hu, Xiantao, et al.
Veröffentlicht: (2025)
MGTraj: Multi-Granularity Goal-Guided Human Trajectory Prediction with Recursive Refinement Network
von: Sun, Ge, et al.
Veröffentlicht: (2025)
von: Sun, Ge, et al.
Veröffentlicht: (2025)
XVerse: Consistent Multi-Subject Control of Identity and Semantic Attributes via DiT Modulation
von: Chen, Bowen, et al.
Veröffentlicht: (2025)
von: Chen, Bowen, et al.
Veröffentlicht: (2025)
Learning a Neural Association Network for Self-supervised Multi-Object Tracking
von: Li, Shuai, et al.
Veröffentlicht: (2024)
von: Li, Shuai, et al.
Veröffentlicht: (2024)
Text-Audio-Visual-conditioned Diffusion Model for Video Saliency Prediction
von: Yu, Li, et al.
Veröffentlicht: (2025)
von: Yu, Li, et al.
Veröffentlicht: (2025)
GAC-Net_Geometric and attention-based Network for Depth Completion
von: Zhu, Kuang, et al.
Veröffentlicht: (2025)
von: Zhu, Kuang, et al.
Veröffentlicht: (2025)
MeMoSORT: Memory-Assisted Filtering and Motion-Adaptive Association Metric for Multi-Person Tracking
von: Wang, Yingjie, et al.
Veröffentlicht: (2025)
von: Wang, Yingjie, et al.
Veröffentlicht: (2025)
Cross-Modal Geometric Hierarchy Fusion: An Implicit-Submap Driven Framework for Resilient 3D Place Recognition
von: Jiang, Xiaohui, et al.
Veröffentlicht: (2025)
von: Jiang, Xiaohui, et al.
Veröffentlicht: (2025)
Basketball-SORT: An Association Method for Complex Multi-object Occlusion Problems in Basketball Multi-object Tracking
von: Hu, Qingrui, et al.
Veröffentlicht: (2024)
von: Hu, Qingrui, et al.
Veröffentlicht: (2024)
TTRD3: Texture Transfer Residual Denoising Dual Diffusion Model for Remote Sensing Image Super-Resolution
von: Liu, Yide, et al.
Veröffentlicht: (2025)
von: Liu, Yide, et al.
Veröffentlicht: (2025)
Bridging the Gap between Multi-focus and Multi-modal: A Focused Integration Framework for Multi-modal Image Fusion
von: Li, Xilai, et al.
Veröffentlicht: (2023)
von: Li, Xilai, et al.
Veröffentlicht: (2023)
Enhancing Multi-Camera Gymnast Tracking Through Domain Knowledge Integration
von: Yang, Fan, et al.
Veröffentlicht: (2025)
von: Yang, Fan, et al.
Veröffentlicht: (2025)
PriorProbe: Recovering Individual-Level Priors for Personalizing Neural Networks in Facial Expression Recognition
von: Yan, Haijiang, et al.
Veröffentlicht: (2026)
von: Yan, Haijiang, et al.
Veröffentlicht: (2026)
Unveiling the Power of Self-supervision for Multi-view Multi-human Association and Tracking
von: Feng, Wei, et al.
Veröffentlicht: (2024)
von: Feng, Wei, et al.
Veröffentlicht: (2024)
A Vanilla Multi-Task Framework for Dense Visual Prediction Solution to 1st VCL Challenge -- Multi-Task Robustness Track
von: Chen, Zehui, et al.
Veröffentlicht: (2024)
von: Chen, Zehui, et al.
Veröffentlicht: (2024)
FTPFusion: Frequency-Aware Infrared and Visible Video Fusion with Temporal Perturbation
von: Li, Xilai, et al.
Veröffentlicht: (2026)
von: Li, Xilai, et al.
Veröffentlicht: (2026)
Multi-Object Tracking by Hierarchical Visual Representations
von: Cao, Jinkun, et al.
Veröffentlicht: (2024)
von: Cao, Jinkun, et al.
Veröffentlicht: (2024)
MITracker: Multi-View Integration for Visual Object Tracking
von: Xu, Mengjie, et al.
Veröffentlicht: (2025)
von: Xu, Mengjie, et al.
Veröffentlicht: (2025)
MMA-UNet: A Multi-Modal Asymmetric UNet Architecture for Infrared and Visible Image Fusion
von: Huang, Jingxue, et al.
Veröffentlicht: (2024)
von: Huang, Jingxue, et al.
Veröffentlicht: (2024)
Adapting SAM 2 for Visual Object Tracking: 1st Place Solution for MMVPR Challenge Multi-Modal Tracking
von: Yang, Cheng-Yen, et al.
Veröffentlicht: (2025)
von: Yang, Cheng-Yen, et al.
Veröffentlicht: (2025)
Multi-Step Visual Reasoning with Visual Tokens Scaling and Verification
von: Bai, Tianyi, et al.
Veröffentlicht: (2025)
von: Bai, Tianyi, et al.
Veröffentlicht: (2025)
SDSTrack: Self-Distillation Symmetric Adapter Learning for Multi-Modal Visual Object Tracking
von: Hou, Xiaojun, et al.
Veröffentlicht: (2024)
von: Hou, Xiaojun, et al.
Veröffentlicht: (2024)
Robust Visual Localization via Semantic-Guided Multi-Scale Transformer
von: Tian, Zhongtao, et al.
Veröffentlicht: (2025)
von: Tian, Zhongtao, et al.
Veröffentlicht: (2025)
UniFormer: Unifying Convolution and Self-attention for Visual Recognition
von: Li, Kunchang, et al.
Veröffentlicht: (2022)
von: Li, Kunchang, et al.
Veröffentlicht: (2022)
Vision-Motion-Reference Alignment for Referring Multi-Object Tracking via Multi-Modal Large Language Models
von: Lv, Weiyi, et al.
Veröffentlicht: (2025)
von: Lv, Weiyi, et al.
Veröffentlicht: (2025)
PRISM: A Promptable and Robust Interactive Segmentation Model with Visual Prompts
von: Li, Hao, et al.
Veröffentlicht: (2024)
von: Li, Hao, et al.
Veröffentlicht: (2024)
Multi-branch Collaborative Learning Network for 3D Visual Grounding
von: Qian, Zhipeng, et al.
Veröffentlicht: (2024)
von: Qian, Zhipeng, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Target-aware Bidirectional Fusion Transformer for Aerial Object Tracking
von: Sun, Xinglong, et al.
Veröffentlicht: (2025) -
GTA: Global Tracklet Association for Multi-Object Tracking in Sports
von: Sun, Jiacheng, et al.
Veröffentlicht: (2024) -
A Multi-Mode Structured Light 3D Imaging System with Multi-Source Information Fusion for Underwater Pipeline Detection
von: Hu, Qinghan, et al.
Veröffentlicht: (2025) -
Text-Guided Channel Perturbation and Pretrained Knowledge Integration for Unified Multi-Modality Image Fusion
von: Li, Xilai, et al.
Veröffentlicht: (2025) -
From Detection to Association: Learning Discriminative Object Embeddings for Multi-Object Tracking
von: Shao, Yuqing, et al.
Veröffentlicht: (2025)