Optimal Video Compression using Pixel Shift Tracking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Panneerselvam, Hitesh Saai Mananchery, Anand, Smit |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploring the Limits of Semantic Image Compression at Micro-bits per Pixel
par: Dotzel, Jordan, et autres
Publié: (2024)
par: Dotzel, Jordan, et autres
Publié: (2024)
OTT-Vid: Optimal Transport Temporal Token Compression for Video Large Language Models
par: Kang, Minseok, et autres
Publié: (2026)
par: Kang, Minseok, et autres
Publié: (2026)
Motion-Grounded Video Reasoning: Understanding and Perceiving Motion at Pixel Level
par: Deng, Andong, et autres
Publié: (2024)
par: Deng, Andong, et autres
Publié: (2024)
Conditional Video Generation for High-Efficiency Video Compression
par: Yi, Fangqiu, et autres
Publié: (2025)
par: Yi, Fangqiu, et autres
Publié: (2025)
DeepFake Detection in Dyadic Video Calls using Point of Gaze Tracking
par: Kohler, Odin, et autres
Publié: (2025)
par: Kohler, Odin, et autres
Publié: (2025)
Temporal Object-Aware Vision Transformer for Few-Shot Video Object Detection
par: Kumar, Yogesh, et autres
Publié: (2025)
par: Kumar, Yogesh, et autres
Publié: (2025)
Accurate and Fast Compressed Video Captioning
par: Shen, Yaojie, et autres
Publié: (2023)
par: Shen, Yaojie, et autres
Publié: (2023)
Efficient Video Diffusion with Sparse Information Transmission for Video Compression
par: Zhou, Mingde, et autres
Publié: (2026)
par: Zhou, Mingde, et autres
Publié: (2026)
DC-VideoGen: Efficient Video Generation with Deep Compression Video Autoencoder
par: Chen, Junyu, et autres
Publié: (2025)
par: Chen, Junyu, et autres
Publié: (2025)
PixelGen: Improving Pixel Diffusion with Perceptual Supervision
par: Ma, Zehong, et autres
Publié: (2026)
par: Ma, Zehong, et autres
Publié: (2026)
CompTrack: Information Bottleneck-Guided Low-Rank Dynamic Token Compression for Point Cloud Tracking
par: Zhou, Sifan, et autres
Publié: (2025)
par: Zhou, Sifan, et autres
Publié: (2025)
Beyond Spatial Frequency: Pixel-wise Temporal Frequency-based Deepfake Video Detection
par: Kim, Taehoon, et autres
Publié: (2025)
par: Kim, Taehoon, et autres
Publié: (2025)
SPARROW: Learning Spatial Precision and Temporal Referential Consistency in Pixel-Grounded Video MLLMs
par: Alansari, Mohamad, et autres
Publié: (2026)
par: Alansari, Mohamad, et autres
Publié: (2026)
PixelArena: A benchmark for Pixel-Precision Visual Intelligence
par: Liang, Feng, et autres
Publié: (2025)
par: Liang, Feng, et autres
Publié: (2025)
Pix2Gif: Motion-Guided Diffusion for GIF Generation
par: Kandala, Hitesh, et autres
Publié: (2024)
par: Kandala, Hitesh, et autres
Publié: (2024)
See Without Decoding: Motion-Vector-Based Tracking in Compressed Video
par: Duché, Axel, et autres
Publié: (2026)
par: Duché, Axel, et autres
Publié: (2026)
TinySAM 2: Extreme Memory Compression for Efficient Track Anything Model
par: Ding, Zhaoyuan, et autres
Publié: (2026)
par: Ding, Zhaoyuan, et autres
Publié: (2026)
Compressed-Domain-Aware Online Video Super-Resolution
par: Wang, Yuhang, et autres
Publié: (2026)
par: Wang, Yuhang, et autres
Publié: (2026)
Latent-Compressed Variational Autoencoder for Video Diffusion Models
par: Guan, Jiarui, et autres
Publié: (2026)
par: Guan, Jiarui, et autres
Publié: (2026)
UniPixel: Unified Object Referring and Segmentation for Pixel-Level Visual Reasoning
par: Liu, Ye, et autres
Publié: (2025)
par: Liu, Ye, et autres
Publié: (2025)
Not All Pixels Are Equal: Pixel-wise Meta-Learning for Medical Segmentation with Noisy Labels
par: Mu, Chenyu, et autres
Publié: (2025)
par: Mu, Chenyu, et autres
Publié: (2025)
When Better Eyes Lead to Blindness: A Diagnostic Study of the Information Bottleneck in CNN-LSTM Image Captioning Models
par: Gupta, Hitesh Kumar
Publié: (2025)
par: Gupta, Hitesh Kumar
Publié: (2025)
Motion Guided Token Compression for Efficient Masked Video Modeling
par: Feng, Yukun, et autres
Publié: (2024)
par: Feng, Yukun, et autres
Publié: (2024)
xGen-VideoSyn-1: High-fidelity Text-to-Video Synthesis with Compressed Representations
par: Qin, Can, et autres
Publié: (2024)
par: Qin, Can, et autres
Publié: (2024)
Low-Bitrate Video Compression through Semantic-Conditioned Diffusion
par: Wang, Lingdong, et autres
Publié: (2025)
par: Wang, Lingdong, et autres
Publié: (2025)
StreamingTOM: Streaming Token Compression for Efficient Video Understanding
par: Chen, Xueyi, et autres
Publié: (2025)
par: Chen, Xueyi, et autres
Publié: (2025)
Shifting AI Efficiency From Model-Centric to Data-Centric Compression
par: Liu, Xuyang, et autres
Publié: (2025)
par: Liu, Xuyang, et autres
Publié: (2025)
When Tracking Fails: Analyzing Failure Modes of SAM2 for Point-Based Tracking in Surgical Videos
par: Jang, Woowon, et autres
Publié: (2025)
par: Jang, Woowon, et autres
Publié: (2025)
VOVTrack: Exploring the Potentiality in Videos for Open-Vocabulary Object Tracking
par: Qian, Zekun, et autres
Publié: (2024)
par: Qian, Zekun, et autres
Publié: (2024)
STORM: End-to-End Referring Multi-Object Tracking in Videos
par: Lu, Zijia, et autres
Publié: (2026)
par: Lu, Zijia, et autres
Publié: (2026)
Beyond Pixels: Introducing Geometric-Semantic World Priors for Video-based Embodied Models via Spatio-temporal Alignment
par: Tang, Jinzhou, et autres
Publié: (2025)
par: Tang, Jinzhou, et autres
Publié: (2025)
Impact of Video Compression Artifacts on Fisheye Camera Visual Perception Tasks
par: Sakthi, Madhumitha, et autres
Publié: (2024)
par: Sakthi, Madhumitha, et autres
Publié: (2024)
Task-Aware KV Compression For Cost-Effective Long Video Understanding
par: Qin, Minghao, et autres
Publié: (2025)
par: Qin, Minghao, et autres
Publié: (2025)
A Paradigm Shift: Fully End-to-End Training for Temporal Sentence Grounding in Videos
par: He, Allen, et autres
Publié: (2026)
par: He, Allen, et autres
Publié: (2026)
Heterogeneous Graph Transformer for Multiple Tiny Object Tracking in RGB-T Videos
par: Xu, Qingyu, et autres
Publié: (2024)
par: Xu, Qingyu, et autres
Publié: (2024)
TrackDiffusion: Tracklet-Conditioned Video Generation via Diffusion Models
par: Li, Pengxiang, et autres
Publié: (2023)
par: Li, Pengxiang, et autres
Publié: (2023)
PolypSegTrack: Unified Foundation Model for Colonoscopy Video Analysis
par: Choudhuri, Anwesa, et autres
Publié: (2025)
par: Choudhuri, Anwesa, et autres
Publié: (2025)
Deep Pulse-Signal Magnification for remote Heart Rate Estimation in Compressed Videos
par: Comas, Joaquim, et autres
Publié: (2024)
par: Comas, Joaquim, et autres
Publié: (2024)
Model Compression using Progressive Channel Pruning
par: Guo, Jinyang, et autres
Publié: (2025)
par: Guo, Jinyang, et autres
Publié: (2025)
Advanced Sign Language Video Generation with Compressed and Quantized Multi-Condition Tokenization
par: Wang, Cong, et autres
Publié: (2025)
par: Wang, Cong, et autres
Publié: (2025)
Documents similaires
-
Exploring the Limits of Semantic Image Compression at Micro-bits per Pixel
par: Dotzel, Jordan, et autres
Publié: (2024) -
OTT-Vid: Optimal Transport Temporal Token Compression for Video Large Language Models
par: Kang, Minseok, et autres
Publié: (2026) -
Motion-Grounded Video Reasoning: Understanding and Perceiving Motion at Pixel Level
par: Deng, Andong, et autres
Publié: (2024) -
Conditional Video Generation for High-Efficiency Video Compression
par: Yi, Fangqiu, et autres
Publié: (2025) -
DeepFake Detection in Dyadic Video Calls using Point of Gaze Tracking
par: Kohler, Odin, et autres
Publié: (2025)