STORM: Segment, Track, and Object Re-Localization from a Single Image
Fuente:
arXiv
Salvato in:
| Autori principali: | Deng, Yu, Cao, Teng, Shindo, Hikaru, Delfosse, Quentin, Xue, Jiahong, Kersting, Kristian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Boosting Object Representation Learning via Motion and Object Continuity
di: Delfosse, Quentin, et al.
Pubblicazione: (2022)
di: Delfosse, Quentin, et al.
Pubblicazione: (2022)
OCAtari: Object-Centric Atari 2600 Reinforcement Learning Environments
di: Delfosse, Quentin, et al.
Pubblicazione: (2023)
di: Delfosse, Quentin, et al.
Pubblicazione: (2023)
Learning Differentiable Logic Programs for Abstract Visual Reasoning
di: Shindo, Hikaru, et al.
Pubblicazione: (2023)
di: Shindo, Hikaru, et al.
Pubblicazione: (2023)
DeiSAM: Segment Anything with Deictic Prompting
di: Shindo, Hikaru, et al.
Pubblicazione: (2024)
di: Shindo, Hikaru, et al.
Pubblicazione: (2024)
V-LoL: A Diagnostic Dataset for Visual Logical Learning
di: Helff, Lukas, et al.
Pubblicazione: (2023)
di: Helff, Lukas, et al.
Pubblicazione: (2023)
SuperPose: Improved 6D Pose Estimation with Robust Tracking and Mask-Free Initialization
di: Deng, Yu, et al.
Pubblicazione: (2024)
di: Deng, Yu, et al.
Pubblicazione: (2024)
ART: Adaptive Relation Tuning for Generalized Relation Prediction
di: Sudhakaran, Gopika, et al.
Pubblicazione: (2025)
di: Sudhakaran, Gopika, et al.
Pubblicazione: (2025)
Pix2Code: Learning to Compose Neural Visual Concepts as Programs
di: Wüst, Antonia, et al.
Pubblicazione: (2024)
di: Wüst, Antonia, et al.
Pubblicazione: (2024)
STORM: End-to-End Referring Multi-Object Tracking in Videos
di: Lu, Zijia, et al.
Pubblicazione: (2026)
di: Lu, Zijia, et al.
Pubblicazione: (2026)
GRAIL: Autonomous Concept Grounding for Neuro-Symbolic Reinforcement Learning
di: Shindo, Hikaru, et al.
Pubblicazione: (2026)
di: Shindo, Hikaru, et al.
Pubblicazione: (2026)
Image Coding for Machines with Edge Information Learning Using Segment Anything
di: Shindo, Takahiro, et al.
Pubblicazione: (2024)
di: Shindo, Takahiro, et al.
Pubblicazione: (2024)
TrackTeller: Temporal Multimodal 3D Grounding for Behavior-Dependent Object References
di: Yu, Jiahong, et al.
Pubblicazione: (2025)
di: Yu, Jiahong, et al.
Pubblicazione: (2025)
Joint Counting, Detection and Re-Identification for Multi-Object Tracking
di: Ren, Weihong, et al.
Pubblicazione: (2022)
di: Ren, Weihong, et al.
Pubblicazione: (2022)
Enhancing Video Object Segmentation in TrackRAD Using XMem Memory Network
di: Deng, Pengchao, et al.
Pubblicazione: (2025)
di: Deng, Pengchao, et al.
Pubblicazione: (2025)
A Simple Video Segmenter by Tracking Objects Along Axial Trajectories
di: He, Ju, et al.
Pubblicazione: (2023)
di: He, Ju, et al.
Pubblicazione: (2023)
ClickTrack: Towards Real-time Interactive Single Object Tracking
di: Wang, Kuiran, et al.
Pubblicazione: (2024)
di: Wang, Kuiran, et al.
Pubblicazione: (2024)
BlendRL: A Framework for Merging Symbolic and Neural Policy Learning
di: Shindo, Hikaru, et al.
Pubblicazione: (2024)
di: Shindo, Hikaru, et al.
Pubblicazione: (2024)
Temporal-Enhanced Multimodal Transformer for Referring Multi-Object Tracking and Segmentation
di: Xiao, Changcheng, et al.
Pubblicazione: (2024)
di: Xiao, Changcheng, et al.
Pubblicazione: (2024)
Instance-Level Moving Object Segmentation from a Single Image with Events
di: Wan, Zhexiong, et al.
Pubblicazione: (2025)
di: Wan, Zhexiong, et al.
Pubblicazione: (2025)
STORM: Internalized Modeling for Spatial-Temporal Reasoning in Video-Language Models
di: Liang, Yiming, et al.
Pubblicazione: (2026)
di: Liang, Yiming, et al.
Pubblicazione: (2026)
Segment Anything for Video: A Comprehensive Review of Video Object Segmentation and Tracking from Past to Future
di: Xu, Guoping, et al.
Pubblicazione: (2025)
di: Xu, Guoping, et al.
Pubblicazione: (2025)
An Effective Solution for the CVPR 2026 8th UG2+ Challenge Track 3: Dynamic Object Segmentation in Turbulence
di: Li, Hongzhen, et al.
Pubblicazione: (2026)
di: Li, Hongzhen, et al.
Pubblicazione: (2026)
P2Object: Single Point Supervised Object Detection and Instance Segmentation
di: Chen, Pengfei, et al.
Pubblicazione: (2025)
di: Chen, Pengfei, et al.
Pubblicazione: (2025)
STORM: Token-Efficient Long Video Understanding for Multimodal LLMs
di: Jiang, Jindong, et al.
Pubblicazione: (2025)
di: Jiang, Jindong, et al.
Pubblicazione: (2025)
No Safe Dose: How Training Data Drives Unsafe Image Generation
di: Friedrich, Felix, et al.
Pubblicazione: (2026)
di: Friedrich, Felix, et al.
Pubblicazione: (2026)
STORM: Strategic Orchestration of Modalities for Rare Event Classification
di: Kamboj, Payal, et al.
Pubblicazione: (2024)
di: Kamboj, Payal, et al.
Pubblicazione: (2024)
EAFormer: Scene Text Segmentation with Edge-Aware Transformers
di: Yu, Haiyang, et al.
Pubblicazione: (2024)
di: Yu, Haiyang, et al.
Pubblicazione: (2024)
History-Aware Transformation of ReID Features for Multiple Object Tracking
di: Gao, Ruopeng, et al.
Pubblicazione: (2025)
di: Gao, Ruopeng, et al.
Pubblicazione: (2025)
Beyond Traditional Single Object Tracking: A Survey
di: Abdelaziz, Omar, et al.
Pubblicazione: (2024)
di: Abdelaziz, Omar, et al.
Pubblicazione: (2024)
Single-Model and Any-Modality for Video Object Tracking
di: Wu, Zongwei, et al.
Pubblicazione: (2023)
di: Wu, Zongwei, et al.
Pubblicazione: (2023)
Stylistic-STORM (ST-STORM) : Perceiving the Semantic Nature of Appearance
di: Ouattara, Hamed, et al.
Pubblicazione: (2026)
di: Ouattara, Hamed, et al.
Pubblicazione: (2026)
Beyond Euclidean Prototypes: Spectral Disentanglement and Geodesic Matching for Few-Shot Medical Image Segmentation
di: Jia, Penghao, et al.
Pubblicazione: (2026)
di: Jia, Penghao, et al.
Pubblicazione: (2026)
360VOTS: Visual Object Tracking and Segmentation in Omnidirectional Videos
di: Xu, Yinzhe, et al.
Pubblicazione: (2024)
di: Xu, Yinzhe, et al.
Pubblicazione: (2024)
SAM3-Adapter: Efficient Adaptation of Segment Anything 3 for Camouflage Object Segmentation, Shadow Detection, and Medical Image Segmentation
di: Chen, Tianrun, et al.
Pubblicazione: (2025)
di: Chen, Tianrun, et al.
Pubblicazione: (2025)
FlowTrack: Point-level Flow Network for 3D Single Object Tracking
di: Li, Shuo, et al.
Pubblicazione: (2024)
di: Li, Shuo, et al.
Pubblicazione: (2024)
VPIT: Real-time Embedded Single Object 3D Tracking Using Voxel Pseudo Images
di: Oleksiienko, Illia, et al.
Pubblicazione: (2022)
di: Oleksiienko, Illia, et al.
Pubblicazione: (2022)
METok: Multi-Stage Event-based Token Compression for Efficient Long Video Understanding
di: Wang, Mengyue, et al.
Pubblicazione: (2025)
di: Wang, Mengyue, et al.
Pubblicazione: (2025)
Multi-Object Tracking by Hierarchical Visual Representations
di: Cao, Jinkun, et al.
Pubblicazione: (2024)
di: Cao, Jinkun, et al.
Pubblicazione: (2024)
Segment Anything with Motion, Geometry, and Semantic Adaptation for Complex Nonlinear Visual Object Tracking
di: Zhu, Deyi, et al.
Pubblicazione: (2026)
di: Zhu, Deyi, et al.
Pubblicazione: (2026)
MSITrack: A Challenging Benchmark for Multispectral Single Object Tracking
di: Feng, Tao, et al.
Pubblicazione: (2025)
di: Feng, Tao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Boosting Object Representation Learning via Motion and Object Continuity
di: Delfosse, Quentin, et al.
Pubblicazione: (2022) -
OCAtari: Object-Centric Atari 2600 Reinforcement Learning Environments
di: Delfosse, Quentin, et al.
Pubblicazione: (2023) -
Learning Differentiable Logic Programs for Abstract Visual Reasoning
di: Shindo, Hikaru, et al.
Pubblicazione: (2023) -
DeiSAM: Segment Anything with Deictic Prompting
di: Shindo, Hikaru, et al.
Pubblicazione: (2024) -
V-LoL: A Diagnostic Dataset for Visual Logical Learning
di: Helff, Lukas, et al.
Pubblicazione: (2023)