Beyond SOT: Tracking Multiple Generic Objects at Once
Fuente:
arXiv
Salvato in:
| Autori principali: | Mayer, Christoph, Danelljan, Martin, Yang, Ming-Hsuan, Ferrari, Vittorio, Van Gool, Luc, Kuznetsova, Alina |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SLAck: Semantic, Location, and Appearance Aware Open-Vocabulary Tracking
di: Li, Siyuan, et al.
Pubblicazione: (2024)
di: Li, Siyuan, et al.
Pubblicazione: (2024)
PIV3CAMS: a multi-camera dataset for multiple computer vision problems and its application to novel view-point synthesis
di: Kim, Sohyeong, et al.
Pubblicazione: (2024)
di: Kim, Sohyeong, et al.
Pubblicazione: (2024)
Probabilistic Sampling of Balanced K-Means using Adiabatic Quantum Computing
di: Zaech, Jan-Nico, et al.
Pubblicazione: (2023)
di: Zaech, Jan-Nico, et al.
Pubblicazione: (2023)
Walker: Self-supervised Multiple Object Tracking by Walking on Temporal Appearance Graphs
di: Segu, Mattia, et al.
Pubblicazione: (2024)
di: Segu, Mattia, et al.
Pubblicazione: (2024)
Samba: Synchronized Set-of-Sequences Modeling for Multiple Object Tracking
di: Segu, Mattia, et al.
Pubblicazione: (2024)
di: Segu, Mattia, et al.
Pubblicazione: (2024)
Matching Anything by Segmenting Anything
di: Li, Siyuan, et al.
Pubblicazione: (2024)
di: Li, Siyuan, et al.
Pubblicazione: (2024)
Contrastive Learning for Multi-Object Tracking with Transformers
di: De Plaen, Pierre-François, et al.
Pubblicazione: (2023)
di: De Plaen, Pierre-François, et al.
Pubblicazione: (2023)
Efficient Video Object Segmentation via Modulated Cross-Attention Memory
di: Shaker, Abdelrahman, et al.
Pubblicazione: (2024)
di: Shaker, Abdelrahman, et al.
Pubblicazione: (2024)
UniSOT: A Unified Framework for Multi-Modality Single Object Tracking
di: Ma, Yinchao, et al.
Pubblicazione: (2025)
di: Ma, Yinchao, et al.
Pubblicazione: (2025)
Lego: Learning to Disentangle and Invert Personalized Concepts Beyond Object Appearance in Text-to-Image Diffusion Models
di: Motamed, Saman, et al.
Pubblicazione: (2023)
di: Motamed, Saman, et al.
Pubblicazione: (2023)
Single-Model and Any-Modality for Video Object Tracking
di: Wu, Zongwei, et al.
Pubblicazione: (2023)
di: Wu, Zongwei, et al.
Pubblicazione: (2023)
Incremental Object Detection with Prompt-based Methods
di: Neuwirth-Trapp, Matthias, et al.
Pubblicazione: (2025)
di: Neuwirth-Trapp, Matthias, et al.
Pubblicazione: (2025)
RICO: Two Realistic Benchmarks and an In-Depth Analysis for Incremental Learning in Object Detection
di: Neuwirth-Trapp, Matthias, et al.
Pubblicazione: (2025)
di: Neuwirth-Trapp, Matthias, et al.
Pubblicazione: (2025)
RGB-D Indiscernible Object Counting in Underwater Scenes
di: Sun, Guolei, et al.
Pubblicazione: (2023)
di: Sun, Guolei, et al.
Pubblicazione: (2023)
Enhanced Multi-Scale Cross-Attention for Person Image Generation
di: Tang, Hao, et al.
Pubblicazione: (2025)
di: Tang, Hao, et al.
Pubblicazione: (2025)
Graph Transformer GANs with Graph Masked Modeling for Architectural Layout Generation
di: Tang, Hao, et al.
Pubblicazione: (2024)
di: Tang, Hao, et al.
Pubblicazione: (2024)
Camera-Only 3D Panoptic Scene Completion for Autonomous Driving through Differentiable Object Shapes
di: Marinello, Nicola, et al.
Pubblicazione: (2025)
di: Marinello, Nicola, et al.
Pubblicazione: (2025)
Test-time Training for Hyperspectral Image Super-resolution
di: Li, Ke, et al.
Pubblicazione: (2024)
di: Li, Ke, et al.
Pubblicazione: (2024)
Optimizing against Infeasible Inclusions from Data for Semantic Segmentation through Morphology
di: Basu, Shamik, et al.
Pubblicazione: (2024)
di: Basu, Shamik, et al.
Pubblicazione: (2024)
Bayesian Self-Training for Semi-Supervised 3D Segmentation
di: Unal, Ozan, et al.
Pubblicazione: (2024)
di: Unal, Ozan, et al.
Pubblicazione: (2024)
From Synchrony to Sequence: Exo-to-Ego Generation via Interpolation
di: Mahdi, Mohammad, et al.
Pubblicazione: (2026)
di: Mahdi, Mohammad, et al.
Pubblicazione: (2026)
One2Any: One-Reference 6D Pose Estimation for Any Object
di: Liu, Mengya, et al.
Pubblicazione: (2025)
di: Liu, Mengya, et al.
Pubblicazione: (2025)
SIGHT: Synthesizing Image-Text Conditioned and Geometry-Guided 3D Hand-Object Trajectories
di: Gavryushin, Alexey, et al.
Pubblicazione: (2025)
di: Gavryushin, Alexey, et al.
Pubblicazione: (2025)
TrafficBots V1.5: Traffic Simulation via Conditional VAEs and Transformers with Relative Pose Encoding
di: Zhang, Zhejun, et al.
Pubblicazione: (2024)
di: Zhang, Zhejun, et al.
Pubblicazione: (2024)
EvenNICER-SLAM: Event-based Neural Implicit Encoding SLAM
di: Chen, Shi, et al.
Pubblicazione: (2024)
di: Chen, Shi, et al.
Pubblicazione: (2024)
Learning Generative Interactive Environments By Trained Agent Exploration
di: Kazemi, Naser, et al.
Pubblicazione: (2024)
di: Kazemi, Naser, et al.
Pubblicazione: (2024)
Strategic Preys Make Acute Predators: Enhancing Camouflaged Object Detectors by Generating Camouflaged Objects
di: He, Chunming, et al.
Pubblicazione: (2023)
di: He, Chunming, et al.
Pubblicazione: (2023)
Investigating the Effectiveness of Cross-Attention to Unlock Zero-Shot Editing of Text-to-Video Diffusion Models
di: Motamed, Saman, et al.
Pubblicazione: (2024)
di: Motamed, Saman, et al.
Pubblicazione: (2024)
SAMOFT: Robust Multi-Object Tracking via Region and Flow
di: Wang, Yanchao, et al.
Pubblicazione: (2026)
di: Wang, Yanchao, et al.
Pubblicazione: (2026)
Sharing Key Semantics in Transformer Makes Efficient Image Restoration
di: Ren, Bin, et al.
Pubblicazione: (2024)
di: Ren, Bin, et al.
Pubblicazione: (2024)
What You Have is What You Track: Adaptive and Robust Multimodal Tracking
di: Tan, Yuedong, et al.
Pubblicazione: (2025)
di: Tan, Yuedong, et al.
Pubblicazione: (2025)
Beyond Task-Driven Features for Object Detection
di: Zhou, Meilun, et al.
Pubblicazione: (2026)
di: Zhou, Meilun, et al.
Pubblicazione: (2026)
SoccerNet-Tracking: Multiple Object Tracking Dataset and Benchmark in Soccer Videos
di: Cioppa, Anthony, et al.
Pubblicazione: (2022)
di: Cioppa, Anthony, et al.
Pubblicazione: (2022)
Towards Online Real-Time Memory-based Video Inpainting Transformers
di: Thiry, Guillaume, et al.
Pubblicazione: (2024)
di: Thiry, Guillaume, et al.
Pubblicazione: (2024)
Condition-Invariant Semantic Segmentation
di: Sakaridis, Christos, et al.
Pubblicazione: (2023)
di: Sakaridis, Christos, et al.
Pubblicazione: (2023)
MatIR: A Hybrid Mamba-Transformer Image Restoration Model
di: Wen, Juan, et al.
Pubblicazione: (2025)
di: Wen, Juan, et al.
Pubblicazione: (2025)
CAFuser: Condition-Aware Multimodal Fusion for Robust Semantic Perception of Driving Scenes
di: Broedermann, Tim, et al.
Pubblicazione: (2024)
di: Broedermann, Tim, et al.
Pubblicazione: (2024)
Sun Off, Lights On: Photorealistic Monocular Nighttime Simulation for Robust Semantic Perception
di: Tzevelekakis, Konstantinos, et al.
Pubblicazione: (2024)
di: Tzevelekakis, Konstantinos, et al.
Pubblicazione: (2024)
Fine-Grained Spatial and Verbal Losses for 3D Visual Grounding
di: Dey, Sombit, et al.
Pubblicazione: (2024)
di: Dey, Sombit, et al.
Pubblicazione: (2024)
VOID: Video Object and Interaction Deletion
di: Motamed, Saman, et al.
Pubblicazione: (2026)
di: Motamed, Saman, et al.
Pubblicazione: (2026)
Documenti analoghi
-
SLAck: Semantic, Location, and Appearance Aware Open-Vocabulary Tracking
di: Li, Siyuan, et al.
Pubblicazione: (2024) -
PIV3CAMS: a multi-camera dataset for multiple computer vision problems and its application to novel view-point synthesis
di: Kim, Sohyeong, et al.
Pubblicazione: (2024) -
Probabilistic Sampling of Balanced K-Means using Adiabatic Quantum Computing
di: Zaech, Jan-Nico, et al.
Pubblicazione: (2023) -
Walker: Self-supervised Multiple Object Tracking by Walking on Temporal Appearance Graphs
di: Segu, Mattia, et al.
Pubblicazione: (2024) -
Samba: Synchronized Set-of-Sequences Modeling for Multiple Object Tracking
di: Segu, Mattia, et al.
Pubblicazione: (2024)