Interactive Tracking: A Human-in-the-Loop Paradigm with Memory-Augmented Adaptation
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Yuqing, Zeng, Guotian, Yuan, Zhenqiao, He, Zhenyu, Li, Xin, Wang, Yaowei, Yang, Ming-Hsuan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
RTracker: Recoverable Tracking via PN Tree Structured Memory
por: Huang, Yuqing, et al.
Publicado: (2024)
por: Huang, Yuqing, et al.
Publicado: (2024)
1st Place Solution for MOSE Track in CVPR 2024 PVUW Workshop: Complex Video Object Segmentation
por: Miao, Deshui, et al.
Publicado: (2024)
por: Miao, Deshui, et al.
Publicado: (2024)
Discriminative Spatial-Semantic VOS Solution: 1st Place Solution for 6th LSVOS
por: Miao, Deshui, et al.
Publicado: (2024)
por: Miao, Deshui, et al.
Publicado: (2024)
Drift-Resilient Temporal Priors for Visual Tracking
por: Huang, Yuqing, et al.
Publicado: (2026)
por: Huang, Yuqing, et al.
Publicado: (2026)
Learning Spatial-Semantic Features for Robust Video Object Segmentation
por: Li, Xin, et al.
Publicado: (2024)
por: Li, Xin, et al.
Publicado: (2024)
Harnessing Vision-Language Pretrained Models with Temporal-Aware Adaptation for Referring Video Object Segmentation
por: Zhou, Zikun, et al.
Publicado: (2024)
por: Zhou, Zikun, et al.
Publicado: (2024)
Detector-in-the-Loop Tracking: Active Memory Rectification for Stable Glottic Opening Localization
por: Wang, Huayu, et al.
Publicado: (2026)
por: Wang, Huayu, et al.
Publicado: (2026)
Cluster-Wise Spatio-Temporal Masking for Efficient Video-Language Pretraining
por: Zhuang, Weijun, et al.
Publicado: (2026)
por: Zhuang, Weijun, et al.
Publicado: (2026)
Spatial-Temporal Multi-level Association for Video Object Segmentation
por: Miao, Deshui, et al.
Publicado: (2024)
por: Miao, Deshui, et al.
Publicado: (2024)
Progressive Domain Adaptation for Thermal Infrared Object Tracking
por: Li, Qiao, et al.
Publicado: (2024)
por: Li, Qiao, et al.
Publicado: (2024)
Gaga: Group Any Gaussians via 3D-aware Memory Bank
por: Lyu, Weijie, et al.
Publicado: (2024)
por: Lyu, Weijie, et al.
Publicado: (2024)
OAMVOS:2nd Report for 5th PVUW MOSE Track
por: Miao, Deshui, et al.
Publicado: (2026)
por: Miao, Deshui, et al.
Publicado: (2026)
Exploring Human-in-the-Loop Test-Time Adaptation by Synergizing Active Learning and Model Selection
por: Li, Yushu, et al.
Publicado: (2024)
por: Li, Yushu, et al.
Publicado: (2024)
Continual Adaptation: Environment-Conditional Parameter Generation for Object Detection in Dynamic Scenarios
por: Li, Deng, et al.
Publicado: (2025)
por: Li, Deng, et al.
Publicado: (2025)
Reasmory: 3D Reconstruction as Explicit Memory for VLMs Spatial Reasoning
por: He, Jixuan, et al.
Publicado: (2026)
por: He, Jixuan, et al.
Publicado: (2026)
Interaction Replica: Tracking Human-Object Interaction and Scene Changes From Human Motion
por: Guzov, Vladimir, et al.
Publicado: (2022)
por: Guzov, Vladimir, et al.
Publicado: (2022)
Interactive Multi-Head Self-Attention with Linear Complexity
por: Kang, Hankyul, et al.
Publicado: (2024)
por: Kang, Hankyul, et al.
Publicado: (2024)
Minimal Interaction Separated Tuning: A New Paradigm for Visual Adaptation
por: Tang, Ningyuan, et al.
Publicado: (2024)
por: Tang, Ningyuan, et al.
Publicado: (2024)
IFTD: Image Feature Triangle Descriptor for Loop Detection in Driving Scenes
por: Lang, Fengtian, et al.
Publicado: (2024)
por: Lang, Fengtian, et al.
Publicado: (2024)
DS-Det: Single-Query Paradigm and Attention Disentangled Learning for Flexible Object Detection
por: Cao, Guiping, et al.
Publicado: (2025)
por: Cao, Guiping, et al.
Publicado: (2025)
FOCUS: Unified Vision-Language Modeling for Interactive Editing Driven by Referential Segmentation
por: Yang, Fan, et al.
Publicado: (2025)
por: Yang, Fan, et al.
Publicado: (2025)
PhysiGen: Integrating Collision-Aware Physical Constraints for High-Fidelity Human-Human Interaction Generation
por: Lei, Nan, et al.
Publicado: (2026)
por: Lei, Nan, et al.
Publicado: (2026)
Weakly Supervised 3D Object Detection via Multi-Level Visual Guidance
por: Huang, Kuan-Chih, et al.
Publicado: (2023)
por: Huang, Kuan-Chih, et al.
Publicado: (2023)
MergeMix: A Unified Augmentation Paradigm for Visual and Multi-Modal Understanding
por: Jin, Xin, et al.
Publicado: (2025)
por: Jin, Xin, et al.
Publicado: (2025)
Shifting Adaptation from Weight Space to Memory Space: A Memory-Augmented Agent for Medical Image Segmentation
por: Chen, Bowen, et al.
Publicado: (2026)
por: Chen, Bowen, et al.
Publicado: (2026)
Adaptive Hardness-driven Augmentation and Alignment Strategies for Multi-Source Domain Adaptations
por: Yuxiang, Yang, et al.
Publicado: (2025)
por: Yuxiang, Yang, et al.
Publicado: (2025)
SceneAdapt: Scene-aware Adaptation of Human Motion Diffusion
por: Cho, Jungbin, et al.
Publicado: (2025)
por: Cho, Jungbin, et al.
Publicado: (2025)
MAP-VLA: Memory-Augmented Prompting for Vision-Language-Action Model in Robotic Manipulation
por: Li, Runhao, et al.
Publicado: (2025)
por: Li, Runhao, et al.
Publicado: (2025)
UniHash: Unifying Pointwise and Pairwise Hashing Paradigms
por: Ma, Xiaoxu, et al.
Publicado: (2026)
por: Ma, Xiaoxu, et al.
Publicado: (2026)
InterTrack: Tracking Human Object Interaction without Object Templates
por: Xie, Xianghui, et al.
Publicado: (2024)
por: Xie, Xianghui, et al.
Publicado: (2024)
SAMOFT: Robust Multi-Object Tracking via Region and Flow
por: Wang, Yanchao, et al.
Publicado: (2026)
por: Wang, Yanchao, et al.
Publicado: (2026)
L3A: Label-Augmented Analytic Adaptation for Multi-Label Class Incremental Learning
por: Zhang, Xiang, et al.
Publicado: (2025)
por: Zhang, Xiang, et al.
Publicado: (2025)
Chat-Edit-3D: Interactive 3D Scene Editing via Text Prompts
por: Fang, Shuangkang, et al.
Publicado: (2024)
por: Fang, Shuangkang, et al.
Publicado: (2024)
Closing the Confusion Loop: CLIP-Guided Alignment for Source-Free Domain Adaptation
por: Wang, Shanshan, et al.
Publicado: (2026)
por: Wang, Shanshan, et al.
Publicado: (2026)
Mamba-FSCIL: Dynamic Adaptation with Selective State Space Model for Few-Shot Class-Incremental Learning
por: Li, Xiaojie, et al.
Publicado: (2024)
por: Li, Xiaojie, et al.
Publicado: (2024)
Towards Long Video Understanding via Fine-detailed Video Story Generation
por: You, Zeng, et al.
Publicado: (2024)
por: You, Zeng, et al.
Publicado: (2024)
MeMOTR: Long-Term Memory-Augmented Transformer for Multi-Object Tracking
por: Gao, Ruopeng, et al.
Publicado: (2023)
por: Gao, Ruopeng, et al.
Publicado: (2023)
Beyond SOT: Tracking Multiple Generic Objects at Once
por: Mayer, Christoph, et al.
Publicado: (2022)
por: Mayer, Christoph, et al.
Publicado: (2022)
SelaVPR++: Towards Seamless Adaptation of Foundation Models for Efficient Place Recognition
por: Lu, Feng, et al.
Publicado: (2025)
por: Lu, Feng, et al.
Publicado: (2025)
LoopExpose: An Unsupervised Framework for Arbitrary-Length Exposure Correction
por: Li, Ao, et al.
Publicado: (2025)
por: Li, Ao, et al.
Publicado: (2025)
Ejemplares similares
-
RTracker: Recoverable Tracking via PN Tree Structured Memory
por: Huang, Yuqing, et al.
Publicado: (2024) -
1st Place Solution for MOSE Track in CVPR 2024 PVUW Workshop: Complex Video Object Segmentation
por: Miao, Deshui, et al.
Publicado: (2024) -
Discriminative Spatial-Semantic VOS Solution: 1st Place Solution for 6th LSVOS
por: Miao, Deshui, et al.
Publicado: (2024) -
Drift-Resilient Temporal Priors for Visual Tracking
por: Huang, Yuqing, et al.
Publicado: (2026) -
Learning Spatial-Semantic Features for Robust Video Object Segmentation
por: Li, Xin, et al.
Publicado: (2024)