Tetris: Tile-level Sampling for Efficient and High-Fidelity Video Object Tracking
Fuente:
arXiv
Salvato in:
| Autori principali: | Kittivorawong, Chanwut, Chao, Alena, Si, Charlie, Cheung, Alvin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Spatialyze: A Geospatial Video Analytics System with Spatial-Aware Optimizations
di: Kittivorawong, Chanwut, et al.
Pubblicazione: (2023)
di: Kittivorawong, Chanwut, et al.
Pubblicazione: (2023)
TWIX: Automatically Reconstructing Structured Data from Templatized Documents
di: Lin, Yiming, et al.
Pubblicazione: (2025)
di: Lin, Yiming, et al.
Pubblicazione: (2025)
YUV20K: A Complexity-Driven Benchmark and Trajectory-Aware Alignment Model for Video Camouflaged Object Detection
di: Liu, Yiyu, et al.
Pubblicazione: (2026)
di: Liu, Yiyu, et al.
Pubblicazione: (2026)
LOVO: Efficient Complex Object Query in Large-Scale Video Datasets
di: Liu, Yuxin, et al.
Pubblicazione: (2025)
di: Liu, Yuxin, et al.
Pubblicazione: (2025)
TRACER: Efficient Object Re-Identification in Networked Cameras through Adaptive Query Processing
di: Chunduri, Pramod, et al.
Pubblicazione: (2025)
di: Chunduri, Pramod, et al.
Pubblicazione: (2025)
VideoTetris: Towards Compositional Text-to-Video Generation
di: Tian, Ye, et al.
Pubblicazione: (2024)
di: Tian, Ye, et al.
Pubblicazione: (2024)
MEVDT: Multi-Modal Event-Based Vehicle Detection and Tracking Dataset
di: Shair, Zaid A. El, et al.
Pubblicazione: (2024)
di: Shair, Zaid A. El, et al.
Pubblicazione: (2024)
VideoScoop: A Non-Traditional Domain-Independent Framework For Video Analysis
di: Billah, Hafsa
Pubblicazione: (2025)
di: Billah, Hafsa
Pubblicazione: (2025)
Mining Platoon Patterns from Traffic Videos
di: Bei, Yijun, et al.
Pubblicazione: (2024)
di: Bei, Yijun, et al.
Pubblicazione: (2024)
OS-W2S: An Automatic Labeling Engine for Language-Guided Open-Set Aerial Object Detection
di: Wei, Guoting, et al.
Pubblicazione: (2025)
di: Wei, Guoting, et al.
Pubblicazione: (2025)
Manipulating a Tetris-Inspired 3D Video Representation
di: Godbole, Mihir
Pubblicazione: (2024)
di: Godbole, Mihir
Pubblicazione: (2024)
Towards a Flexible Scale-out Framework for Efficient Visual Data Query Processing
di: Verma, Rohit, et al.
Pubblicazione: (2024)
di: Verma, Rohit, et al.
Pubblicazione: (2024)
Legible Label Layout for Data Visualization, Algorithm and Integration into Vega-Lite
di: Kittivorawong, Chanwut
Pubblicazione: (2024)
di: Kittivorawong, Chanwut
Pubblicazione: (2024)
Extract-Transform-Load for Video Streams
di: Kossmann, Ferdinand, et al.
Pubblicazione: (2023)
di: Kossmann, Ferdinand, et al.
Pubblicazione: (2023)
MuseTalk: Real-Time High-Fidelity Video Dubbing via Spatio-Temporal Sampling
di: Zhang, Yue, et al.
Pubblicazione: (2024)
di: Zhang, Yue, et al.
Pubblicazione: (2024)
Efficient-vDiT: Efficient Video Diffusion Transformers With Attention Tile
di: Ding, Hangliang, et al.
Pubblicazione: (2025)
di: Ding, Hangliang, et al.
Pubblicazione: (2025)
SketchQL Demonstration: Zero-shot Video Moment Querying with Sketches
di: Wu, Renzhi, et al.
Pubblicazione: (2024)
di: Wu, Renzhi, et al.
Pubblicazione: (2024)
FlashVideo: Flowing Fidelity to Detail for Efficient High-Resolution Video Generation
di: Zhang, Shilong, et al.
Pubblicazione: (2025)
di: Zhang, Shilong, et al.
Pubblicazione: (2025)
TextAlign: Preference Alignment for Text Rendering with Hierarchical Rewards
di: Cui, Mingxuan, et al.
Pubblicazione: (2026)
di: Cui, Mingxuan, et al.
Pubblicazione: (2026)
FineState-Bench: Benchmarking State-Conditioned Grounding for Fine-grained GUI State Setting
di: Ji, Fengxian, et al.
Pubblicazione: (2026)
di: Ji, Fengxian, et al.
Pubblicazione: (2026)
LAND: A Longitudinal Analysis of Neuromorphic Datasets
di: Cohen, Gregory, et al.
Pubblicazione: (2026)
di: Cohen, Gregory, et al.
Pubblicazione: (2026)
DarkDriving: A Real-World Day and Night Aligned Dataset for Autonomous Driving in the Dark Environment
di: Wang, Wuqi, et al.
Pubblicazione: (2026)
di: Wang, Wuqi, et al.
Pubblicazione: (2026)
R4-CGQA: Retrieval-based Vision Language Models for Computer Graphics Image Quality Assessment
di: Li, Zhuangzi, et al.
Pubblicazione: (2026)
di: Li, Zhuangzi, et al.
Pubblicazione: (2026)
Major TOM: Expandable Datasets for Earth Observation
di: Francis, Alistair, et al.
Pubblicazione: (2024)
di: Francis, Alistair, et al.
Pubblicazione: (2024)
K-FACE: A Large-Scale KIST Face Database in Consideration with Unconstrained Environments
di: Choi, Yeji, et al.
Pubblicazione: (2021)
di: Choi, Yeji, et al.
Pubblicazione: (2021)
Non-central panorama indoor dataset
di: Berenguel-Baeta, Bruno, et al.
Pubblicazione: (2024)
di: Berenguel-Baeta, Bruno, et al.
Pubblicazione: (2024)
DPCD: A Quality Assessment Database for Dynamic Point Clouds
di: Liu, Yating, et al.
Pubblicazione: (2025)
di: Liu, Yating, et al.
Pubblicazione: (2025)
Mapping Urban Villages in China: Progress and Challenges
di: Cao, Rui, et al.
Pubblicazione: (2025)
di: Cao, Rui, et al.
Pubblicazione: (2025)
Research on Image Processing and Vectorization Storage Based on Garage Electronic Maps
di: Dou, Nan, et al.
Pubblicazione: (2024)
di: Dou, Nan, et al.
Pubblicazione: (2024)
TokBench: Evaluating Your Visual Tokenizer before Visual Generation
di: Wu, Junfeng, et al.
Pubblicazione: (2025)
di: Wu, Junfeng, et al.
Pubblicazione: (2025)
MarineEval: Assessing the Marine Intelligence of Vision-Language Models
di: Wong, YuK-Kwan, et al.
Pubblicazione: (2025)
di: Wong, YuK-Kwan, et al.
Pubblicazione: (2025)
Earth System Data Cubes: Avenues for advancing Earth system research
di: Montero, David, et al.
Pubblicazione: (2024)
di: Montero, David, et al.
Pubblicazione: (2024)
Vector search with small radiuses
di: Szilvasy, Gergely, et al.
Pubblicazione: (2024)
di: Szilvasy, Gergely, et al.
Pubblicazione: (2024)
Global and Dense Embeddings of Earth: Major TOM Floating in the Latent Space
di: Czerkawski, Mikolaj, et al.
Pubblicazione: (2024)
di: Czerkawski, Mikolaj, et al.
Pubblicazione: (2024)
Histologic Dataset of Normal and Atypical Mitotic Figures on Human Breast Cancer (AMi-Br)
di: Bertram, Christof A., et al.
Pubblicazione: (2025)
di: Bertram, Christof A., et al.
Pubblicazione: (2025)
Vision meets algae: A novel way for microalgae recognization and health monitor
di: Zhou, Shizheng, et al.
Pubblicazione: (2022)
di: Zhou, Shizheng, et al.
Pubblicazione: (2022)
SafeSora: Towards Safety Alignment of Text2Video Generation via a Human Preference Dataset
di: Dai, Josef, et al.
Pubblicazione: (2024)
di: Dai, Josef, et al.
Pubblicazione: (2024)
Single-Model and Any-Modality for Video Object Tracking
di: Wu, Zongwei, et al.
Pubblicazione: (2023)
di: Wu, Zongwei, et al.
Pubblicazione: (2023)
LazyVLM: Neuro-Symbolic Approach to Video Analytics
di: Jian, Xiangru, et al.
Pubblicazione: (2025)
di: Jian, Xiangru, et al.
Pubblicazione: (2025)
AtomoVideo: High Fidelity Image-to-Video Generation
di: Gong, Litong, et al.
Pubblicazione: (2024)
di: Gong, Litong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Spatialyze: A Geospatial Video Analytics System with Spatial-Aware Optimizations
di: Kittivorawong, Chanwut, et al.
Pubblicazione: (2023) -
TWIX: Automatically Reconstructing Structured Data from Templatized Documents
di: Lin, Yiming, et al.
Pubblicazione: (2025) -
YUV20K: A Complexity-Driven Benchmark and Trajectory-Aware Alignment Model for Video Camouflaged Object Detection
di: Liu, Yiyu, et al.
Pubblicazione: (2026) -
LOVO: Efficient Complex Object Query in Large-Scale Video Datasets
di: Liu, Yuxin, et al.
Pubblicazione: (2025) -
TRACER: Efficient Object Re-Identification in Networked Cameras through Adaptive Query Processing
di: Chunduri, Pramod, et al.
Pubblicazione: (2025)