Salvato in:
| Autori principali: | Lu, Andong, Wen, Mai, Wang, Jinhu, Guo, Yuanzhi, Li, Chenglong, Tang, Jin, Luo, Bin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2503.11218 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Breaking Shallow Limits: Task-Driven Pixel Fusion for Gap-free RGBT Tracking
di: Lu, Andong, et al.
Pubblicazione: (2025)
di: Lu, Andong, et al.
Pubblicazione: (2025)
RGBT Tracking via All-layer Multimodal Interactions with Progressive Fusion Mamba
di: Lu, Andong, et al.
Pubblicazione: (2024)
di: Lu, Andong, et al.
Pubblicazione: (2024)
AFter: Attention-based Fusion Router for RGBT Tracking
di: Lu, Andong, et al.
Pubblicazione: (2024)
di: Lu, Andong, et al.
Pubblicazione: (2024)
Modality-missing RGBT Tracking: Invertible Prompt Learning and High-quality Benchmarks
di: Lu, Andong, et al.
Pubblicazione: (2023)
di: Lu, Andong, et al.
Pubblicazione: (2023)
Transformer RGBT Tracking with Spatio-Temporal Multimodal Tokens
di: Sun, Dengdi, et al.
Pubblicazione: (2024)
di: Sun, Dengdi, et al.
Pubblicazione: (2024)
Breaking Modality Gap in RGBT Tracking: Coupled Knowledge Distillation
di: Lu, Andong, et al.
Pubblicazione: (2024)
di: Lu, Andong, et al.
Pubblicazione: (2024)
Nighttime Person Re-Identification via Collaborative Enhancement Network with Multi-domain Learning
di: Lu, Andong, et al.
Pubblicazione: (2023)
di: Lu, Andong, et al.
Pubblicazione: (2023)
Towards Robust Optical-SAR Object Detection under Missing Modalities: A Dynamic Quality-Aware Fusion Framework
di: Zhao, Zhicheng, et al.
Pubblicazione: (2025)
di: Zhao, Zhicheng, et al.
Pubblicazione: (2025)
Cross-modulated Attention Transformer for RGBT Tracking
di: Xiao, Yun, et al.
Pubblicazione: (2024)
di: Xiao, Yun, et al.
Pubblicazione: (2024)
Vehicle-centric Perception via Multimodal Structured Pre-training
di: Wu, Wentao, et al.
Pubblicazione: (2025)
di: Wu, Wentao, et al.
Pubblicazione: (2025)
Dynamic Disentangled Fusion Network for RGBT Tracking
di: Li, Chenglong, et al.
Pubblicazione: (2024)
di: Li, Chenglong, et al.
Pubblicazione: (2024)
ICPL-ReID: Identity-Conditional Prompt Learning for Multi-Spectral Object Re-Identification
di: Li, Shihao, et al.
Pubblicazione: (2025)
di: Li, Shihao, et al.
Pubblicazione: (2025)
UniModel: A Visual-Only Framework for Unified Multimodal Understanding and Generation
di: Zhang, Chi, et al.
Pubblicazione: (2025)
di: Zhang, Chi, et al.
Pubblicazione: (2025)
Visible-Thermal Multiple Object Tracking: Large-scale Video Dataset and Progressive Fusion Approach
di: Zhu, Yabin, et al.
Pubblicazione: (2024)
di: Zhu, Yabin, et al.
Pubblicazione: (2024)
Sparse-Dense Mixture of Experts Adapter for Multi-Modal Tracking
di: Zhu, Yabin, et al.
Pubblicazione: (2026)
di: Zhu, Yabin, et al.
Pubblicazione: (2026)
DeTrack: A Benchmark and Altitude-Aware Dual World Model for Drone-embodied Tracking
di: Hu, Guyue, et al.
Pubblicazione: (2026)
di: Hu, Guyue, et al.
Pubblicazione: (2026)
Towards Effective and Efficient Adversarial Defense with Diffusion Models for Robust Visual Tracking
di: Xu, Long, et al.
Pubblicazione: (2025)
di: Xu, Long, et al.
Pubblicazione: (2025)
Large Language Model Guided Progressive Feature Alignment for Multimodal UAV Object Detection
di: Wu, Wentao, et al.
Pubblicazione: (2025)
di: Wu, Wentao, et al.
Pubblicazione: (2025)
Decoupled Hierarchical Distillation for Multimodal Emotion Recognition
di: Li, Yong, et al.
Pubblicazione: (2026)
di: Li, Yong, et al.
Pubblicazione: (2026)
GLAD: Generative Language-Assisted Visual Tracking for Low-Semantic Templates
di: Luo, Xingyu, et al.
Pubblicazione: (2026)
di: Luo, Xingyu, et al.
Pubblicazione: (2026)
Unified Multimodal Visual Tracking with Dual Mixture-of-Experts
di: Hong, Lingyi, et al.
Pubblicazione: (2026)
di: Hong, Lingyi, et al.
Pubblicazione: (2026)
UAUTrack: Towards Unified Multimodal Anti-UAV Visual Tracking
di: Ren, Qionglin, et al.
Pubblicazione: (2025)
di: Ren, Qionglin, et al.
Pubblicazione: (2025)
Omni Survey for Multimodality Analysis in Visual Object Tracking
di: Tang, Zhangyong, et al.
Pubblicazione: (2025)
di: Tang, Zhangyong, et al.
Pubblicazione: (2025)
Towards Low-Latency Event Stream-based Visual Object Tracking: A Slow-Fast Approach
di: Wang, Shiao, et al.
Pubblicazione: (2025)
di: Wang, Shiao, et al.
Pubblicazione: (2025)
SpongeBob: Sync-Aware Harmonious Audio-Visual Generative Editing
di: Liang, Sen, et al.
Pubblicazione: (2026)
di: Liang, Sen, et al.
Pubblicazione: (2026)
Seeing What Matters: Visual Preference Policy Optimization for Visual Generation
di: Ni, Ziqi, et al.
Pubblicazione: (2025)
di: Ni, Ziqi, et al.
Pubblicazione: (2025)
Reward-Aware Trajectory Shaping for Few-step Visual Generation
di: Li, Rui, et al.
Pubblicazione: (2026)
di: Li, Rui, et al.
Pubblicazione: (2026)
Text-Guided Coarse-to-Fine Fusion Network for Robust Remote Sensing Visual Question Answering
di: Zhao, Zhicheng, et al.
Pubblicazione: (2024)
di: Zhao, Zhicheng, et al.
Pubblicazione: (2024)
Bridging the Scale Gap: Balanced Tiny and General Object Detection in Remote Sensing Imagery
di: Zhao, Zhicheng, et al.
Pubblicazione: (2025)
di: Zhao, Zhicheng, et al.
Pubblicazione: (2025)
Semantic Change Detection of Roads and Bridges: A Fine-grained Dataset and Multimodal Frequency-driven Detector
di: Shu, Qingling, et al.
Pubblicazione: (2025)
di: Shu, Qingling, et al.
Pubblicazione: (2025)
CM3AE: A Unified RGB Frame and Event-Voxel/-Frame Pre-training Framework
di: Wu, Wentao, et al.
Pubblicazione: (2025)
di: Wu, Wentao, et al.
Pubblicazione: (2025)
Learning Adaptive Fusion Bank for Multi-modal Salient Object Detection
di: Wang, Kunpeng, et al.
Pubblicazione: (2024)
di: Wang, Kunpeng, et al.
Pubblicazione: (2024)
Alignment-Free RGBT Salient Object Detection: Semantics-guided Asymmetric Correlation Network and A Unified Benchmark
di: Wang, Kunpeng, et al.
Pubblicazione: (2024)
di: Wang, Kunpeng, et al.
Pubblicazione: (2024)
Unified-modal Salient Object Detection via Adaptive Prompt Learning
di: Wang, Kunpeng, et al.
Pubblicazione: (2023)
di: Wang, Kunpeng, et al.
Pubblicazione: (2023)
Adapting Segment Anything Model to Multi-modal Salient Object Detection with Semantic Feature Fusion Guidance
di: Wang, Kunpeng, et al.
Pubblicazione: (2024)
di: Wang, Kunpeng, et al.
Pubblicazione: (2024)
Alignment-Free RGB-T Salient Object Detection: A Large-scale Dataset and Progressive Correlation Network
di: Wang, Kunpeng, et al.
Pubblicazione: (2024)
di: Wang, Kunpeng, et al.
Pubblicazione: (2024)
Compositional-Degradation UAV Image Restoration: Conditional Decoupled MoE Network and A Benchmark
di: Yan, Jinquan, et al.
Pubblicazione: (2026)
di: Yan, Jinquan, et al.
Pubblicazione: (2026)
Visual Text Generation in the Wild
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2024)
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2024)
Revisiting Disentanglement in Downstream Tasks: A Study on Its Necessity for Abstract Visual Reasoning
di: Nai, Ruiqian, et al.
Pubblicazione: (2024)
di: Nai, Ruiqian, et al.
Pubblicazione: (2024)
Bridging Continuous and Discrete Tokens for Autoregressive Visual Generation
di: Wang, Yuqing, et al.
Pubblicazione: (2025)
di: Wang, Yuqing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Breaking Shallow Limits: Task-Driven Pixel Fusion for Gap-free RGBT Tracking
di: Lu, Andong, et al.
Pubblicazione: (2025) -
RGBT Tracking via All-layer Multimodal Interactions with Progressive Fusion Mamba
di: Lu, Andong, et al.
Pubblicazione: (2024) -
AFter: Attention-based Fusion Router for RGBT Tracking
di: Lu, Andong, et al.
Pubblicazione: (2024) -
Modality-missing RGBT Tracking: Invertible Prompt Learning and High-quality Benchmarks
di: Lu, Andong, et al.
Pubblicazione: (2023) -
Transformer RGBT Tracking with Spatio-Temporal Multimodal Tokens
di: Sun, Dengdi, et al.
Pubblicazione: (2024)