EffOWT: Transfer Visual Language Models to Open-World Tracking Efficiently and Effectively
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Bingyang, Huang, Kaer, Li, Bin, Yan, Yiqiang, Zhang, Lihe, Lu, Huchuan, He, You |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ACTrack: Adding Spatio-Temporal Condition for Visual Object Tracking
por: Han, Yushan, et al.
Publicado: (2024)
por: Han, Yushan, et al.
Publicado: (2024)
High-Performance Few-Shot Segmentation with Foundation Models: An Empirical Study
por: Chang, Shijie, et al.
Publicado: (2024)
por: Chang, Shijie, et al.
Publicado: (2024)
Open-Vocabulary Camouflaged Object Segmentation
por: Pang, Youwei, et al.
Publicado: (2023)
por: Pang, Youwei, et al.
Publicado: (2023)
Referring Remote Sensing Image Segmentation with Cross-view Semantics Interaction Network
por: Yang, Jiaxing, et al.
Publicado: (2025)
por: Yang, Jiaxing, et al.
Publicado: (2025)
ArtCrafter: Text-Image Aligning Style Transfer via Embedding Reframing
por: Huang, Nisha, et al.
Publicado: (2025)
por: Huang, Nisha, et al.
Publicado: (2025)
ComPtr: Towards Diverse Bi-source Dense Prediction Tasks via A Simple yet General Complementary Transformer
por: Pang, Youwei, et al.
Publicado: (2023)
por: Pang, Youwei, et al.
Publicado: (2023)
Efficient Motion Prompt Learning for Robust Visual Tracking
por: Zhao, Jie, et al.
Publicado: (2025)
por: Zhao, Jie, et al.
Publicado: (2025)
Exploring Dynamic Transformer for Efficient Object Tracking
por: Zhu, Jiawen, et al.
Publicado: (2024)
por: Zhu, Jiawen, et al.
Publicado: (2024)
Spatial Semantic Recurrent Mining for Referring Image Segmentation
por: Yang, Jiaxing, et al.
Publicado: (2024)
por: Yang, Jiaxing, et al.
Publicado: (2024)
OWT: A Foundational Organ-Wise Tokenization Framework for Medical Imaging
por: Song, Sifan, et al.
Publicado: (2025)
por: Song, Sifan, et al.
Publicado: (2025)
Two-stream Beats One-stream: Asymmetric Siamese Network for Efficient Visual Tracking
por: Zhu, Jiawen, et al.
Publicado: (2025)
por: Zhu, Jiawen, et al.
Publicado: (2025)
Beyond Mask: Rethinking Guidance Types in Few-shot Segmentation
por: Chang, Shijie, et al.
Publicado: (2024)
por: Chang, Shijie, et al.
Publicado: (2024)
Towards Diverse Binary Segmentation via A Simple yet General Gated Network
por: Zhao, Xiaoqi, et al.
Publicado: (2023)
por: Zhao, Xiaoqi, et al.
Publicado: (2023)
Multi-view Aggregation Network for Dichotomous Image Segmentation
por: Yu, Qian, et al.
Publicado: (2024)
por: Yu, Qian, et al.
Publicado: (2024)
Exploiting Lightweight Hierarchical ViT and Dynamic Framework for Efficient Visual Tracking
por: Kang, Ben, et al.
Publicado: (2025)
por: Kang, Ben, et al.
Publicado: (2025)
Eff-GRot: Efficient and Generalizable Rotation Estimation with Transformers
por: Mathioulakis, Fanis, et al.
Publicado: (2025)
por: Mathioulakis, Fanis, et al.
Publicado: (2025)
UETrack: A Unified and Efficient Framework for Single Object Tracking
por: Kang, Ben, et al.
Publicado: (2026)
por: Kang, Ben, et al.
Publicado: (2026)
Towards Real-Time Open-Vocabulary Video Instance Segmentation
por: Yan, Bin, et al.
Publicado: (2024)
por: Yan, Bin, et al.
Publicado: (2024)
ZoomNeXt: A Unified Collaborative Pyramid Network for Camouflaged Object Detection
por: Pang, Youwei, et al.
Publicado: (2023)
por: Pang, Youwei, et al.
Publicado: (2023)
Tracking with Human-Intent Reasoning
por: Zhu, Jiawen, et al.
Publicado: (2023)
por: Zhu, Jiawen, et al.
Publicado: (2023)
Boosting Continual Learning of Vision-Language Models via Mixture-of-Experts Adapters
por: Yu, Jiazuo, et al.
Publicado: (2024)
por: Yu, Jiazuo, et al.
Publicado: (2024)
MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models
por: Li, Xiaomin, et al.
Publicado: (2024)
por: Li, Xiaomin, et al.
Publicado: (2024)
EffLoc: Lightweight Vision Transformer for Efficient 6-DOF Camera Relocalization
por: Xiao, Zhendong, et al.
Publicado: (2024)
por: Xiao, Zhendong, et al.
Publicado: (2024)
Adaptive Multi-source Predictor for Zero-shot Video Object Segmentation
por: Zhao, Xiaoqi, et al.
Publicado: (2023)
por: Zhao, Xiaoqi, et al.
Publicado: (2023)
Hybrid-SORT: Weak Cues Matter for Online Multi-Object Tracking
por: Yang, Mingzhan, et al.
Publicado: (2023)
por: Yang, Mingzhan, et al.
Publicado: (2023)
UniSegDiff: Boosting Unified Lesion Segmentation via a Staged Diffusion Model
por: Hu, Yilong, et al.
Publicado: (2025)
por: Hu, Yilong, et al.
Publicado: (2025)
Unified Sequence-to-Sequence Learning for Single- and Multi-Modal Visual Object Tracking
por: Chen, Xin, et al.
Publicado: (2023)
por: Chen, Xin, et al.
Publicado: (2023)
SRRT: Exploring Search Region Regulation for Visual Object Tracking
por: Zhu, Jiawen, et al.
Publicado: (2022)
por: Zhu, Jiawen, et al.
Publicado: (2022)
DCPT: Darkness Clue-Prompted Tracking in Nighttime UAVs
por: Zhu, Jiawen, et al.
Publicado: (2023)
por: Zhu, Jiawen, et al.
Publicado: (2023)
Multi-modal Instruction Tuned LLMs with Fine-grained Visual Perception
por: He, Junwen, et al.
Publicado: (2024)
por: He, Junwen, et al.
Publicado: (2024)
RAGTrack: Language-aware RGBT Tracking with Retrieval-Augmented Generation
por: Li, Hao, et al.
Publicado: (2026)
por: Li, Hao, et al.
Publicado: (2026)
Rethinking Evaluation of Infrared Small Target Detection
por: Pang, Youwei, et al.
Publicado: (2025)
por: Pang, Youwei, et al.
Publicado: (2025)
RELO: Reinforcement Learning to Localize for Visual Object Tracking
por: Chen, Xin, et al.
Publicado: (2026)
por: Chen, Xin, et al.
Publicado: (2026)
UniMMAD: Unified Multi-Modal and Multi-Class Anomaly Detection via MoE-Driven Feature Decompression
por: Zhao, Yuan, et al.
Publicado: (2025)
por: Zhao, Yuan, et al.
Publicado: (2025)
EffNetViTLoRA: An Efficient Hybrid Deep Learning Approach for Alzheimer's Disease Diagnosis
por: Khatooni, Mahdieh Behjat, et al.
Publicado: (2025)
por: Khatooni, Mahdieh Behjat, et al.
Publicado: (2025)
Towards Effective and Efficient Adversarial Defense with Diffusion Models for Robust Visual Tracking
por: Xu, Long, et al.
Publicado: (2025)
por: Xu, Long, et al.
Publicado: (2025)
UniPT: Universal Parallel Tuning for Transfer Learning with Efficient Parameter and Memory
por: Diao, Haiwen, et al.
Publicado: (2023)
por: Diao, Haiwen, et al.
Publicado: (2023)
High-Precision Dichotomous Image Segmentation via Probing Diffusion Capacity
por: Yu, Qian, et al.
Publicado: (2024)
por: Yu, Qian, et al.
Publicado: (2024)
Towards Cross-Platform Generalization: Domain Adaptive 3D Detection with Augmentation and Pseudo-Labeling
por: Feng, Xiyan, et al.
Publicado: (2026)
por: Feng, Xiyan, et al.
Publicado: (2026)
MaTe: Images Are All You Need for Material Transfer via Diffusion Transformer
por: Huang, Nisha, et al.
Publicado: (2026)
por: Huang, Nisha, et al.
Publicado: (2026)
Ejemplares similares
-
ACTrack: Adding Spatio-Temporal Condition for Visual Object Tracking
por: Han, Yushan, et al.
Publicado: (2024) -
High-Performance Few-Shot Segmentation with Foundation Models: An Empirical Study
por: Chang, Shijie, et al.
Publicado: (2024) -
Open-Vocabulary Camouflaged Object Segmentation
por: Pang, Youwei, et al.
Publicado: (2023) -
Referring Remote Sensing Image Segmentation with Cross-view Semantics Interaction Network
por: Yang, Jiaxing, et al.
Publicado: (2025) -
ArtCrafter: Text-Image Aligning Style Transfer via Embedding Reframing
por: Huang, Nisha, et al.
Publicado: (2025)