Spatio-Temporal Correlation Guided Geometric Partitioning for Versatile Video Coding
Fuente:
arXiv
Salvato in:
| Autori principali: | Meng, Xuewei, Jia, Chuanmin, Zhang, Xinfeng, Wang, Shanshe, Ma, Siwei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Perceptual Video Coding for Machines via Satisfied Machine Ratio Modeling
di: Zhang, Qi, et al.
Pubblicazione: (2022)
di: Zhang, Qi, et al.
Pubblicazione: (2022)
Advanced Learning-Based Inter Prediction for Future Video Coding
di: Zhao, Yanchen, et al.
Pubblicazione: (2024)
di: Zhao, Yanchen, et al.
Pubblicazione: (2024)
Predicting Satisfied User and Machine Ratio for Compressed Images: A Unified Approach
di: Zhang, Qi, et al.
Pubblicazione: (2024)
di: Zhang, Qi, et al.
Pubblicazione: (2024)
MAFS: Masked Autoencoder for Infrared-Visible Image Fusion and Semantic Segmentation
di: Wang, Liying, et al.
Pubblicazione: (2025)
di: Wang, Liying, et al.
Pubblicazione: (2025)
A Neural-network Enhanced Video Coding Framework beyond ECM
di: Zhao, Yanchen, et al.
Pubblicazione: (2024)
di: Zhao, Yanchen, et al.
Pubblicazione: (2024)
Spatio-Temporal Distortion Aware Omnidirectional Video Super-Resolution
di: An, Hongyu, et al.
Pubblicazione: (2024)
di: An, Hongyu, et al.
Pubblicazione: (2024)
HGC-Avatar: Hierarchical Gaussian Compression for Streamable Dynamic 3D Avatars
di: Tang, Haocheng, et al.
Pubblicazione: (2025)
di: Tang, Haocheng, et al.
Pubblicazione: (2025)
Textural-Perceptual Joint Learning for No-Reference Super-Resolution Image Quality Assessment
di: Liu, Yuqing, et al.
Pubblicazione: (2022)
di: Liu, Yuqing, et al.
Pubblicazione: (2022)
L-STEC: Learned Video Compression with Long-term Spatio-Temporal Enhanced Context
di: Zhang, Tiange, et al.
Pubblicazione: (2025)
di: Zhang, Tiange, et al.
Pubblicazione: (2025)
Context-Guided Spatio-Temporal Video Grounding
di: Gu, Xin, et al.
Pubblicazione: (2024)
di: Gu, Xin, et al.
Pubblicazione: (2024)
A Joint Visual Compression and Perception Framework for Neuralmorphic Spiking Camera
di: Feng, Kexiang, et al.
Pubblicazione: (2025)
di: Feng, Kexiang, et al.
Pubblicazione: (2025)
ProSplat: Improved Feed-Forward 3D Gaussian Splatting for Wide-Baseline Sparse Views
di: Lu, Xiaohan, et al.
Pubblicazione: (2025)
di: Lu, Xiaohan, et al.
Pubblicazione: (2025)
Video Compression with Hierarchical Temporal Neural Representation
di: Zhu, Jun, et al.
Pubblicazione: (2026)
di: Zhu, Jun, et al.
Pubblicazione: (2026)
Machine Perception-Driven Image Compression: A Layered Generative Approach
di: Zhang, Yuefeng, et al.
Pubblicazione: (2023)
di: Zhang, Yuefeng, et al.
Pubblicazione: (2023)
TinySplat: Feedforward Approach for Generating Compact 3D Scene Representation
di: Song, Zetian, et al.
Pubblicazione: (2025)
di: Song, Zetian, et al.
Pubblicazione: (2025)
CANeRV: Content Adaptive Neural Representation for Video Compression
di: Tang, Lv, et al.
Pubblicazione: (2025)
di: Tang, Lv, et al.
Pubblicazione: (2025)
Iterative Network for Image Super-Resolution
di: Liu, Yuqing, et al.
Pubblicazione: (2020)
di: Liu, Yuqing, et al.
Pubblicazione: (2020)
Hierarchical Similarity Learning for Aliasing Suppression Image Super-Resolution
di: Liu, Yuqing, et al.
Pubblicazione: (2022)
di: Liu, Yuqing, et al.
Pubblicazione: (2022)
Learning Weighting Map for Bit-Depth Expansion within a Rational Range
di: Liu, Yuqing, et al.
Pubblicazione: (2022)
di: Liu, Yuqing, et al.
Pubblicazione: (2022)
SRNeRV: A Scale-wise Recursive Framework for Neural Video Representation
di: Wang, Jia, et al.
Pubblicazione: (2026)
di: Wang, Jia, et al.
Pubblicazione: (2026)
AdapEdit: Spatio-Temporal Guided Adaptive Editing Algorithm for Text-Based Continuity-Sensitive Image Editing
di: Ma, Zhiyuan, et al.
Pubblicazione: (2023)
di: Ma, Zhiyuan, et al.
Pubblicazione: (2023)
STGV: Spatio-Temporal Hash Encoding for Gaussian-based Video Representation
di: Lin, Jierun, et al.
Pubblicazione: (2026)
di: Lin, Jierun, et al.
Pubblicazione: (2026)
Spatio-Temporal Difference Guided Motion Deblurring with the Complementary Vision Sensor
di: Meng, Yapeng, et al.
Pubblicazione: (2026)
di: Meng, Yapeng, et al.
Pubblicazione: (2026)
UHD-GPGNet: UHD Video Denoising via Gaussian-Process-Guided Local Spatio-Temporal Modeling
di: He, Weiyuan, et al.
Pubblicazione: (2026)
di: He, Weiyuan, et al.
Pubblicazione: (2026)
VideoFusion: A Spatio-Temporal Collaborative Network for Multi-modal Video Fusion
di: Tang, Linfeng, et al.
Pubblicazione: (2025)
di: Tang, Linfeng, et al.
Pubblicazione: (2025)
Cluster-Wise Spatio-Temporal Masking for Efficient Video-Language Pretraining
di: Zhuang, Weijun, et al.
Pubblicazione: (2026)
di: Zhuang, Weijun, et al.
Pubblicazione: (2026)
VideoZeroBench: Probing the Limits of Video MLLMs with Spatio-Temporal Evidence Verification
di: Meng, Jiahao, et al.
Pubblicazione: (2026)
di: Meng, Jiahao, et al.
Pubblicazione: (2026)
Correlation-Guided Query-Dependency Calibration for Video Temporal Grounding
di: Moon, WonJun, et al.
Pubblicazione: (2023)
di: Moon, WonJun, et al.
Pubblicazione: (2023)
Towards Long-Form Spatio-Temporal Video Grounding
di: Gu, Xin, et al.
Pubblicazione: (2026)
di: Gu, Xin, et al.
Pubblicazione: (2026)
Video-Language Alignment via Spatio-Temporal Graph Transformer
di: Zhang, Shi-Xue, et al.
Pubblicazione: (2024)
di: Zhang, Shi-Xue, et al.
Pubblicazione: (2024)
Beyond Boxes: Mask-Guided Spatio-Temporal Feature Aggregation for Video Object Detection
di: Hashmi, Khurram Azeem, et al.
Pubblicazione: (2024)
di: Hashmi, Khurram Azeem, et al.
Pubblicazione: (2024)
V-CAST: Video Curvature-Aware Spatio-Temporal Pruning for Efficient Video Large Language Models
di: Lin, Xinying, et al.
Pubblicazione: (2026)
di: Lin, Xinying, et al.
Pubblicazione: (2026)
Spatial Degradation-Aware and Temporal Consistent Diffusion Model for Compressed Video Super-Resolution
di: An, Hongyu, et al.
Pubblicazione: (2025)
di: An, Hongyu, et al.
Pubblicazione: (2025)
EventSTU: Event-Guided Efficient Spatio-Temporal Understanding for Video Large Language Models
di: Xu, Wenhao, et al.
Pubblicazione: (2025)
di: Xu, Wenhao, et al.
Pubblicazione: (2025)
Track the Answer: Extending TextVQA from Image to Video with Spatio-Temporal Clues
di: Zhang, Yan, et al.
Pubblicazione: (2024)
di: Zhang, Yan, et al.
Pubblicazione: (2024)
VideoChat-R1: Enhancing Spatio-Temporal Perception via Reinforcement Fine-Tuning
di: Li, Xinhao, et al.
Pubblicazione: (2025)
di: Li, Xinhao, et al.
Pubblicazione: (2025)
Patch Spatio-Temporal Relation Prediction for Video Anomaly Detection
di: Shen, Hao, et al.
Pubblicazione: (2024)
di: Shen, Hao, et al.
Pubblicazione: (2024)
SpatioTemporal Difference Network for Video Depth Super-Resolution
di: Wang, Zhengxue, et al.
Pubblicazione: (2025)
di: Wang, Zhengxue, et al.
Pubblicazione: (2025)
FiLA-Video: Spatio-Temporal Compression for Fine-Grained Long Video Understanding
di: Guo, Yanan, et al.
Pubblicazione: (2025)
di: Guo, Yanan, et al.
Pubblicazione: (2025)
Detector-Empowered Video Large Language Model for Efficient Spatio-Temporal Grounding
di: Gao, Shida, et al.
Pubblicazione: (2025)
di: Gao, Shida, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Perceptual Video Coding for Machines via Satisfied Machine Ratio Modeling
di: Zhang, Qi, et al.
Pubblicazione: (2022) -
Advanced Learning-Based Inter Prediction for Future Video Coding
di: Zhao, Yanchen, et al.
Pubblicazione: (2024) -
Predicting Satisfied User and Machine Ratio for Compressed Images: A Unified Approach
di: Zhang, Qi, et al.
Pubblicazione: (2024) -
MAFS: Masked Autoencoder for Infrared-Visible Image Fusion and Semantic Segmentation
di: Wang, Liying, et al.
Pubblicazione: (2025) -
A Neural-network Enhanced Video Coding Framework beyond ECM
di: Zhao, Yanchen, et al.
Pubblicazione: (2024)