Dynamic Subframe Splitting and Spatio-Temporal Motion Entangled Sparse Attention for RGB-E Tracking
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Shao, Pengcheng, Xu, Tianyang, Zhu, Xuefeng, Wu, Xiaojun, Kittler, Josef |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
TENet: Targetness Entanglement Incorporating with Multi-Scale Pooling and Mutually-Guided Fusion for RGB-E Object Tracking
von: Shao, Pengcheng, et al.
Veröffentlicht: (2024)
von: Shao, Pengcheng, et al.
Veröffentlicht: (2024)
A Tri-Modal Dataset and a Baseline System for Tracking Unmanned Aerial Vehicles
von: Xu, Tianyang, et al.
Veröffentlicht: (2025)
von: Xu, Tianyang, et al.
Veröffentlicht: (2025)
Serial Over Parallel: Learning Continual Unification for Multi-Modal Visual Object Tracking and Benchmarking
von: Tang, Zhangyong, et al.
Veröffentlicht: (2025)
von: Tang, Zhangyong, et al.
Veröffentlicht: (2025)
Omni Survey for Multimodality Analysis in Visual Object Tracking
von: Tang, Zhangyong, et al.
Veröffentlicht: (2025)
von: Tang, Zhangyong, et al.
Veröffentlicht: (2025)
Revisiting RGBT Tracking Benchmarks from the Perspective of Modality Validity: A New Benchmark, Problem, and Solution
von: Tang, Zhangyong, et al.
Veröffentlicht: (2024)
von: Tang, Zhangyong, et al.
Veröffentlicht: (2024)
Adaptive Hyper-Graph Convolution Network for Skeleton-based Human Action Recognition with Virtual Connections
von: Zhou, Youwei, et al.
Veröffentlicht: (2024)
von: Zhou, Youwei, et al.
Veröffentlicht: (2024)
BusReF: Infrared-Visible images registration and fusion focus on reconstructible area using one set of features
von: Zhang, Zeyang, et al.
Veröffentlicht: (2023)
von: Zhang, Zeyang, et al.
Veröffentlicht: (2023)
Learning Progressive Adaptation for Multi-Modal Tracking
von: Wang, He, et al.
Veröffentlicht: (2026)
von: Wang, He, et al.
Veröffentlicht: (2026)
An Improved Graph Pooling Network for Skeleton-Based Action Recognition
von: Wu, Cong, et al.
Veröffentlicht: (2024)
von: Wu, Cong, et al.
Veröffentlicht: (2024)
MMDRFuse: Distilled Mini-Model with Dynamic Refresh for Multi-Modality Image Fusion
von: Deng, Yanglin, et al.
Veröffentlicht: (2024)
von: Deng, Yanglin, et al.
Veröffentlicht: (2024)
UASTrack: A Unified Adaptive Selection Framework with Modality-Customization in Single Object Tracking
von: Wang, He, et al.
Veröffentlicht: (2025)
von: Wang, He, et al.
Veröffentlicht: (2025)
Visual Object Tracking on Multi-modal RGB-D Videos: A Review
von: Zhu, Xue-Feng, et al.
Veröffentlicht: (2022)
von: Zhu, Xue-Feng, et al.
Veröffentlicht: (2022)
MambaVT: Spatio-Temporal Contextual Modeling for robust RGB-T Tracking
von: Lai, Simiao, et al.
Veröffentlicht: (2024)
von: Lai, Simiao, et al.
Veröffentlicht: (2024)
Towards Highly Transferable Vision-Language Attack via Semantic-Augmented Dynamic Contrastive Interaction
von: Li, Yuanbo, et al.
Veröffentlicht: (2026)
von: Li, Yuanbo, et al.
Veröffentlicht: (2026)
Collaborating Vision, Depth, and Thermal Signals for Multi-Modal Tracking: Dataset and Algorithm
von: Zhu, Xue-Feng, et al.
Veröffentlicht: (2025)
von: Zhu, Xue-Feng, et al.
Veröffentlicht: (2025)
Multi-Paradigm Collaborative Adversarial Attack Against Multi-Modal Large Language Models
von: Li, Yuanbo, et al.
Veröffentlicht: (2026)
von: Li, Yuanbo, et al.
Veröffentlicht: (2026)
Beyond Strict Pairing: Arbitrarily Paired Training for High-Performance Infrared and Visible Image Fusion
von: Deng, Yanglin, et al.
Veröffentlicht: (2026)
von: Deng, Yanglin, et al.
Veröffentlicht: (2026)
Dynamic Avatar-Scene Rendering from Human-centric Context
von: Wang, Wenqing, et al.
Veröffentlicht: (2025)
von: Wang, Wenqing, et al.
Veröffentlicht: (2025)
Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking
von: Li, Shenglan, et al.
Veröffentlicht: (2025)
von: Li, Shenglan, et al.
Veröffentlicht: (2025)
One Model for ALL: Low-Level Task Interaction Is a Key to Task-Agnostic Image Fusion
von: Cheng, Chunyang, et al.
Veröffentlicht: (2025)
von: Cheng, Chunyang, et al.
Veröffentlicht: (2025)
FusionBooster: A Unified Image Fusion Boosting Paradigm
von: Cheng, Chunyang, et al.
Veröffentlicht: (2023)
von: Cheng, Chunyang, et al.
Veröffentlicht: (2023)
MAGIC-Talk: Motion-aware Audio-Driven Talking Face Generation with Customizable Identity Control
von: Nazarieh, Fatemeh, et al.
Veröffentlicht: (2025)
von: Nazarieh, Fatemeh, et al.
Veröffentlicht: (2025)
SpatioTemporal Learning for Human Pose Estimation in Sparsely-Labeled Videos
von: Jiao, Yingying, et al.
Veröffentlicht: (2025)
von: Jiao, Yingying, et al.
Veröffentlicht: (2025)
Single Image, Any Face: Generalisable 3D Face Generation
von: Wang, Wenqing, et al.
Veröffentlicht: (2024)
von: Wang, Wenqing, et al.
Veröffentlicht: (2024)
MERGETUNE: Continued Fine-Tuning of Vision-Language Models
von: Wang, Wenqing, et al.
Veröffentlicht: (2026)
von: Wang, Wenqing, et al.
Veröffentlicht: (2026)
C2C: Component-to-Composition Learning for Zero-Shot Compositional Action Recognition
von: Li, Rongchang, et al.
Veröffentlicht: (2024)
von: Li, Rongchang, et al.
Veröffentlicht: (2024)
SMLNet: A SPD Manifold Learning Network for Infrared and Visible Image Fusion
von: Kang, Huan, et al.
Veröffentlicht: (2024)
von: Kang, Huan, et al.
Veröffentlicht: (2024)
TextFusion: Unveiling the Power of Textual Semantics for Controllable Image Fusion
von: Cheng, Chunyang, et al.
Veröffentlicht: (2023)
von: Cheng, Chunyang, et al.
Veröffentlicht: (2023)
GrFormer: A Novel Transformer on Grassmann Manifold for Infrared and Visible Image Fusion
von: Kang, Huan, et al.
Veröffentlicht: (2025)
von: Kang, Huan, et al.
Veröffentlicht: (2025)
EvaNet: Towards More Efficient and Consistent Infrared and Visible Image Fusion Assessment
von: Cheng, Chunyang, et al.
Veröffentlicht: (2026)
von: Cheng, Chunyang, et al.
Veröffentlicht: (2026)
TrackNetV5: Residual-Driven Spatio-Temporal Refinement and Motion Direction Decoupling for Fast Object Tracking
von: Tang, Haonan, et al.
Veröffentlicht: (2025)
von: Tang, Haonan, et al.
Veröffentlicht: (2025)
STCMOT: Spatio-Temporal Cohesion Learning for UAV-Based Multiple Object Tracking
von: Ma, Jianbo, et al.
Veröffentlicht: (2024)
von: Ma, Jianbo, et al.
Veröffentlicht: (2024)
RGB-Sonar Tracking Benchmark and Spatial Cross-Attention Transformer Tracker
von: Li, Yunfeng, et al.
Veröffentlicht: (2024)
von: Li, Yunfeng, et al.
Veröffentlicht: (2024)
MVAFormer: RGB-based Multi-View Spatio-Temporal Action Recognition with Transformer
von: Yamane, Taiga, et al.
Veröffentlicht: (2025)
von: Yamane, Taiga, et al.
Veröffentlicht: (2025)
Deepfake Detection with Spatio-Temporal Consistency and Attention
von: Chen, Yunzhuo, et al.
Veröffentlicht: (2025)
von: Chen, Yunzhuo, et al.
Veröffentlicht: (2025)
Transformer RGBT Tracking with Spatio-Temporal Multimodal Tokens
von: Sun, Dengdi, et al.
Veröffentlicht: (2024)
von: Sun, Dengdi, et al.
Veröffentlicht: (2024)
Autoregressive Queries for Adaptive Tracking with Spatio-TemporalTransformers
von: Xie, Jinxia, et al.
Veröffentlicht: (2024)
von: Xie, Jinxia, et al.
Veröffentlicht: (2024)
MSC: Multi-Scale Spatio-Temporal Causal Attention for Autoregressive Video Diffusion
von: Xu, Xunnong, et al.
Veröffentlicht: (2024)
von: Xu, Xunnong, et al.
Veröffentlicht: (2024)
Dynamic Motion Synthesis: Masked Audio-Text Conditioned Spatio-Temporal Transformers
von: Anisetty, Sohan, et al.
Veröffentlicht: (2024)
von: Anisetty, Sohan, et al.
Veröffentlicht: (2024)
Paving the Way for Point Cloud Video Representation Learning Using A PDE Model
von: Huang, Zhuoxu, et al.
Veröffentlicht: (2026)
von: Huang, Zhuoxu, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
TENet: Targetness Entanglement Incorporating with Multi-Scale Pooling and Mutually-Guided Fusion for RGB-E Object Tracking
von: Shao, Pengcheng, et al.
Veröffentlicht: (2024) -
A Tri-Modal Dataset and a Baseline System for Tracking Unmanned Aerial Vehicles
von: Xu, Tianyang, et al.
Veröffentlicht: (2025) -
Serial Over Parallel: Learning Continual Unification for Multi-Modal Visual Object Tracking and Benchmarking
von: Tang, Zhangyong, et al.
Veröffentlicht: (2025) -
Omni Survey for Multimodality Analysis in Visual Object Tracking
von: Tang, Zhangyong, et al.
Veröffentlicht: (2025) -
Revisiting RGBT Tracking Benchmarks from the Perspective of Modality Validity: A New Benchmark, Problem, and Solution
von: Tang, Zhangyong, et al.
Veröffentlicht: (2024)