Tell Me What to Track: Infusing Robust Language Guidance for Enhanced Referring Multi-Object Tracking
Fuente:
arXiv
Saved in:
| Main Authors: | Huang, Wenjun, Ni, Yang, Chen, Hanning, He, Yirui, Bryant, Ian, Liu, Yezi, Imani, Mohsen |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
LVLM_CSP: Accelerating Large Vision Language Models via Clustering, Scattering, and Pruning for Reasoning Segmentation
by: Chen, Hanning, et al.
Published: (2025)
by: Chen, Hanning, et al.
Published: (2025)
TaskCLIP: Extend Large Vision-Language Model for Task Oriented Object Detection
by: Chen, Hanning, et al.
Published: (2024)
by: Chen, Hanning, et al.
Published: (2024)
Recover-to-Forget: Gradient Reconstruction from LoRA for Efficient LLM Unlearning
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
LUNE: Efficient LLM Unlearning via LoRA Fine-Tuning with Negative Examples
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
Cauchy-Schwarz Fairness Regularizer
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
Recoverable Anonymization for Pose Estimation: A Privacy-Enhancing Approach
by: Huang, Wenjun, et al.
Published: (2024)
by: Huang, Wenjun, et al.
Published: (2024)
VLTP: Vision-Language Guided Token Pruning for Task-Oriented Segmentation
by: Chen, Hanning, et al.
Published: (2024)
by: Chen, Hanning, et al.
Published: (2024)
Enabling Group Fairness in Graph Unlearning via Bi-level Debiasing
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
MERIT: Multi-domain Efficient RAW Image Translation
by: Huang, Wenjun, et al.
Published: (2026)
by: Huang, Wenjun, et al.
Published: (2026)
Promoting Fairness in Link Prediction with Graph Enhancement
by: Liu, Yezi, et al.
Published: (2024)
by: Liu, Yezi, et al.
Published: (2024)
Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?
by: Chen, Zhiling, et al.
Published: (2025)
by: Chen, Zhiling, et al.
Published: (2025)
Expanding Event Modality Applications through a Robust CLIP-Based Encoder
by: Jeong, Sungheon, et al.
Published: (2024)
by: Jeong, Sungheon, et al.
Published: (2024)
Mitigating Bias in Graph Hyperdimensional Computing
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
Vision Language Model for Interpretable and Fine-grained Detection of Safety Compliance in Diverse Workplaces
by: Chen, Zhiling, et al.
Published: (2024)
by: Chen, Zhiling, et al.
Published: (2024)
Fair Context Learning for Evidence-Balanced Test-Time Adaptation in Vision-Language Models
by: Yun, Sanggeon, et al.
Published: (2026)
by: Yun, Sanggeon, et al.
Published: (2026)
EcoSense: Energy-Efficient Intelligent Sensing for In-Shore Ship Detection through Edge-Cloud Collaboration
by: Huang, Wenjun, et al.
Published: (2024)
by: Huang, Wenjun, et al.
Published: (2024)
EchoTrack: Auditory Referring Multi-Object Tracking for Autonomous Driving
by: Lin, Jiacheng, et al.
Published: (2024)
by: Lin, Jiacheng, et al.
Published: (2024)
Temporal-Enhanced Multimodal Transformer for Referring Multi-Object Tracking and Segmentation
by: Xiao, Changcheng, et al.
Published: (2024)
by: Xiao, Changcheng, et al.
Published: (2024)
Draft and Refine with Visual Experts
by: Jeong, Sungheon, et al.
Published: (2025)
by: Jeong, Sungheon, et al.
Published: (2025)
QUILL: An Algorithm-Architecture Co-Design for Cache-Local Deformable Attention
by: Oh, Hyunwoo, et al.
Published: (2025)
by: Oh, Hyunwoo, et al.
Published: (2025)
Bootstrapping Referring Multi-Object Tracking
by: Zhang, Yani, et al.
Published: (2024)
by: Zhang, Yani, et al.
Published: (2024)
DeconfuseTrack:Dealing with Confusion for Multi-Object Tracking
by: Huang, Cheng, et al.
Published: (2024)
by: Huang, Cheng, et al.
Published: (2024)
Cognitive Disentanglement for Referring Multi-Object Tracking
by: Liang, Shaofeng, et al.
Published: (2025)
by: Liang, Shaofeng, et al.
Published: (2025)
Rethinking Two-Stage Referring-by-Tracking in Referring Multi-Object Tracking: Make it Strong Again
by: Li, Weize, et al.
Published: (2025)
by: Li, Weize, et al.
Published: (2025)
Cross-View Referring Multi-Object Tracking
by: Chen, Sijia, et al.
Published: (2024)
by: Chen, Sijia, et al.
Published: (2024)
TrackMe:A Simple and Effective Multiple Object Tracking Annotation Tool
by: Phan, Thinh, et al.
Published: (2024)
by: Phan, Thinh, et al.
Published: (2024)
HybridTrack: A Hybrid Approach for Robust Multi-Object Tracking
by: Di Bella, Leandro, et al.
Published: (2025)
by: Di Bella, Leandro, et al.
Published: (2025)
DiffusionTrack: Diffusion Model For Multi-Object Tracking
by: Luo, Run, et al.
Published: (2023)
by: Luo, Run, et al.
Published: (2023)
Vision-Motion-Reference Alignment for Referring Multi-Object Tracking via Multi-Modal Large Language Models
by: Lv, Weiyi, et al.
Published: (2025)
by: Lv, Weiyi, et al.
Published: (2025)
ReferGPT: Towards Zero-Shot Referring Multi-Object Tracking
by: Chamiti, Tzoulio, et al.
Published: (2025)
by: Chamiti, Tzoulio, et al.
Published: (2025)
COAL: Counterfactual and Observation-Enhanced Alignment Learning for Discriminative Referring Multi-Object Tracking
by: Jia, Shukun, et al.
Published: (2026)
by: Jia, Shukun, et al.
Published: (2026)
AerialMind: Towards Referring Multi-Object Tracking in UAV Scenarios
by: Chen, Chenglizhao, et al.
Published: (2025)
by: Chen, Chenglizhao, et al.
Published: (2025)
SAMOFT: Robust Multi-Object Tracking via Region and Flow
by: Wang, Yanchao, et al.
Published: (2026)
by: Wang, Yanchao, et al.
Published: (2026)
Encoder-Free Knowledge-Graph Reasoning with LLMs via Hyperdimensional Path Retrieval
by: Liu, Yezi, et al.
Published: (2025)
by: Liu, Yezi, et al.
Published: (2025)
MeMOTR: Long-Term Memory-Augmented Transformer for Multi-Object Tracking
by: Gao, Ruopeng, et al.
Published: (2023)
by: Gao, Ruopeng, et al.
Published: (2023)
PacketCLIP: Multi-Modal Embedding of Network Traffic and Language for Cybersecurity Reasoning
by: Masukawa, Ryozo, et al.
Published: (2025)
by: Masukawa, Ryozo, et al.
Published: (2025)
MEX: Memory-efficient Approach to Referring Multi-Object Tracking
by: Tran, Huu-Thien, et al.
Published: (2025)
by: Tran, Huu-Thien, et al.
Published: (2025)
STORM: End-to-End Referring Multi-Object Tracking in Videos
by: Lu, Zijia, et al.
Published: (2026)
by: Lu, Zijia, et al.
Published: (2026)
Omnidirectional Multi-Object Tracking
by: Luo, Kai, et al.
Published: (2025)
by: Luo, Kai, et al.
Published: (2025)
Tracking the Unstable: Appearance-Guided Motion Modeling for Robust Multi-Object Tracking in UAV-Captured Videos
by: Ma, Jianbo, et al.
Published: (2025)
by: Ma, Jianbo, et al.
Published: (2025)
Similar Items
-
LVLM_CSP: Accelerating Large Vision Language Models via Clustering, Scattering, and Pruning for Reasoning Segmentation
by: Chen, Hanning, et al.
Published: (2025) -
TaskCLIP: Extend Large Vision-Language Model for Task Oriented Object Detection
by: Chen, Hanning, et al.
Published: (2024) -
Recover-to-Forget: Gradient Reconstruction from LoRA for Efficient LLM Unlearning
by: Liu, Yezi, et al.
Published: (2025) -
LUNE: Efficient LLM Unlearning via LoRA Fine-Tuning with Negative Examples
by: Liu, Yezi, et al.
Published: (2025) -
Cauchy-Schwarz Fairness Regularizer
by: Liu, Yezi, et al.
Published: (2025)