Salvato in:
| Autori principali: | Wang, Zhiting, Zhou, Qiangong, Yang, Kangjie, Liu, Zongyang, Mao, Xin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2407.07325 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HiDE: Hierarchical Dictionary-Based Entropy Modeling for Learned Image Compression
di: Xiong, Haoxuan, et al.
Pubblicazione: (2026)
di: Xiong, Haoxuan, et al.
Pubblicazione: (2026)
Temporal Inconsistency Guidance for Super-resolution Video Quality Assessment
di: Li, Yixiao, et al.
Pubblicazione: (2024)
di: Li, Yixiao, et al.
Pubblicazione: (2024)
Context and Pixel Aware Large Language Model for Video Quality Assessment
di: Wen, Wen, et al.
Pubblicazione: (2025)
di: Wen, Wen, et al.
Pubblicazione: (2025)
CMTA: Leveraging Cross-Modal Temporal Artifacts for Generalizable AI-Generated Video Detection
di: Wang, Hang, et al.
Pubblicazione: (2026)
di: Wang, Hang, et al.
Pubblicazione: (2026)
Boosting Neural Video Representation via Online Structural Reparameterization
di: Li, Ziyi, et al.
Pubblicazione: (2025)
di: Li, Ziyi, et al.
Pubblicazione: (2025)
MSVD-Indonesian: A Benchmark for Multimodal Video-Text Tasks in Indonesian
di: Hendria, Willy Fitra
Pubblicazione: (2023)
di: Hendria, Willy Fitra
Pubblicazione: (2023)
Enhancing octree-based context models for point cloud geometry compression with attention-based child node number prediction
di: Sun, Chang, et al.
Pubblicazione: (2024)
di: Sun, Chang, et al.
Pubblicazione: (2024)
LiteGPT: Large Vision-Language Model for Joint Chest X-ray Localization and Classification Task
di: Le-Duc, Khai, et al.
Pubblicazione: (2024)
di: Le-Duc, Khai, et al.
Pubblicazione: (2024)
Analysis of Video Quality Datasets via Design of Minimalistic Video Quality Models
di: Sun, Wei, et al.
Pubblicazione: (2023)
di: Sun, Wei, et al.
Pubblicazione: (2023)
Ola: Pushing the Frontiers of Omni-Modal Language Model
di: Liu, Zuyan, et al.
Pubblicazione: (2025)
di: Liu, Zuyan, et al.
Pubblicazione: (2025)
CPLIP: Zero-Shot Learning for Histopathology with Comprehensive Vision-Language Alignment
di: Javed, Sajid, et al.
Pubblicazione: (2024)
di: Javed, Sajid, et al.
Pubblicazione: (2024)
Object-Attribute-Relation Representation Based Video Semantic Communication
di: Du, Qiyuan, et al.
Pubblicazione: (2024)
di: Du, Qiyuan, et al.
Pubblicazione: (2024)
ICME 2025 Grand Challenge on Video Super-Resolution for Video Conferencing
di: Naderi, Babak, et al.
Pubblicazione: (2025)
di: Naderi, Babak, et al.
Pubblicazione: (2025)
Multi-task Just Recognizable Difference for Video Coding for Machines: Database, Model, and Coding Application
di: Liu, Junqi, et al.
Pubblicazione: (2026)
di: Liu, Junqi, et al.
Pubblicazione: (2026)
Optimizing Multimodal LLMs for Egocentric Video Understanding: A Solution for the HD-EPIC VQA Challenge
di: Yang, Sicheng, et al.
Pubblicazione: (2026)
di: Yang, Sicheng, et al.
Pubblicazione: (2026)
JND-Guided Light-Weight Neural Pre-Filter for Perceptual Image Coding
di: He, Chenlong, et al.
Pubblicazione: (2025)
di: He, Chenlong, et al.
Pubblicazione: (2025)
LFACon: Introducing Anglewise Attention to No-Reference Quality Assessment in Light Field Space
di: Qu, Qiang, et al.
Pubblicazione: (2023)
di: Qu, Qiang, et al.
Pubblicazione: (2023)
Perceptual Video Quality Assessment: A Survey
di: Min, Xiongkuo, et al.
Pubblicazione: (2024)
di: Min, Xiongkuo, et al.
Pubblicazione: (2024)
AIM 2024 Challenge on Video Super-Resolution Quality Assessment: Methods and Results
di: Molodetskikh, Ivan, et al.
Pubblicazione: (2024)
di: Molodetskikh, Ivan, et al.
Pubblicazione: (2024)
SANR: Scene-Aware Neural Representation for Light Field Image Compression with Rate-Distortion Optimization
di: Zhang, Gai, et al.
Pubblicazione: (2025)
di: Zhang, Gai, et al.
Pubblicazione: (2025)
Scalable Event-Based Video Streaming for Machines with MoQ
di: Freeman, Andrew C.
Pubblicazione: (2025)
di: Freeman, Andrew C.
Pubblicazione: (2025)
Leveraging Compressed Frame Sizes For Ultra-Fast Video Classification
di: Han, Yuxing, et al.
Pubblicazione: (2024)
di: Han, Yuxing, et al.
Pubblicazione: (2024)
In-Loop Filtering Using Learned Look-Up Tables for Video Coding
di: Li, Zhuoyuan, et al.
Pubblicazione: (2025)
di: Li, Zhuoyuan, et al.
Pubblicazione: (2025)
Benchmarking Conventional and Learned Video Codecs with a Low-Delay Configuration
di: Teng, Siyue, et al.
Pubblicazione: (2024)
di: Teng, Siyue, et al.
Pubblicazione: (2024)
Ensuring Reliable Participation in Subjective Video Quality Tests Across Platforms
di: Naderi, Babak, et al.
Pubblicazione: (2025)
di: Naderi, Babak, et al.
Pubblicazione: (2025)
MSNeRV: Neural Video Representation with Multi-Scale Feature Fusion
di: Zhu, Jun, et al.
Pubblicazione: (2025)
di: Zhu, Jun, et al.
Pubblicazione: (2025)
Enhancing Blind Video Quality Assessment with Rich Quality-aware Features
di: Sun, Wei, et al.
Pubblicazione: (2024)
di: Sun, Wei, et al.
Pubblicazione: (2024)
DIVA-VQA: Detecting Inter-frame Variations in UGC Video Quality
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
Releasing the Parameter Latency of Neural Representation for High-Efficiency Video Compression
di: Zhang, Gai, et al.
Pubblicazione: (2024)
di: Zhang, Gai, et al.
Pubblicazione: (2024)
AIM 2024 Challenge on Compressed Video Quality Assessment: Methods and Results
di: Smirnov, Maksim, et al.
Pubblicazione: (2024)
di: Smirnov, Maksim, et al.
Pubblicazione: (2024)
Safe-VAR: Safe Visual Autoregressive Model for Text-to-Image Generative Watermarking
di: Wang, Ziyi, et al.
Pubblicazione: (2025)
di: Wang, Ziyi, et al.
Pubblicazione: (2025)
Towards Robust and Generalizable Continuous Space-Time Video Super-Resolution with Events
di: Wei, Shuoyan, et al.
Pubblicazione: (2025)
di: Wei, Shuoyan, et al.
Pubblicazione: (2025)
Sphere-GAN: a GAN-based Approach for Saliency Estimation in 360° Videos
di: Wahba, Mahmoud Z. A., et al.
Pubblicazione: (2025)
di: Wahba, Mahmoud Z. A., et al.
Pubblicazione: (2025)
Recent Advances of End-to-End Video Coding Technologies for AVS Standard Development
di: Sheng, Xihua, et al.
Pubblicazione: (2026)
di: Sheng, Xihua, et al.
Pubblicazione: (2026)
An Efficient Quality Metric for Video Frame Interpolation Based on Motion-Field Divergence
di: Daly, Conall, et al.
Pubblicazione: (2025)
di: Daly, Conall, et al.
Pubblicazione: (2025)
ICME 2025 Generalizable HDR and SDR Video Quality Measurement Grand Challenge
di: Chen, Yixu, et al.
Pubblicazione: (2025)
di: Chen, Yixu, et al.
Pubblicazione: (2025)
A Near-Raw Talking-Head Video Dataset for Various Computer Vision Tasks
di: Naderi, Babak, et al.
Pubblicazione: (2026)
di: Naderi, Babak, et al.
Pubblicazione: (2026)
Convolutions Need Registers Too: HVS-Inspired Dynamic Attention for Video Quality Assessment
di: Mithila, Mayesha Maliha R., et al.
Pubblicazione: (2026)
di: Mithila, Mayesha Maliha R., et al.
Pubblicazione: (2026)
NeRV360: Neural Representation for 360-Degree Videos with a Viewport Decoder
di: Arai, Daichi, et al.
Pubblicazione: (2025)
di: Arai, Daichi, et al.
Pubblicazione: (2025)
CAMP-VQA: Caption-Embedded Multimodal Perception for No-Reference Quality Assessment of Compressed Video
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
HiDE: Hierarchical Dictionary-Based Entropy Modeling for Learned Image Compression
di: Xiong, Haoxuan, et al.
Pubblicazione: (2026) -
Temporal Inconsistency Guidance for Super-resolution Video Quality Assessment
di: Li, Yixiao, et al.
Pubblicazione: (2024) -
Context and Pixel Aware Large Language Model for Video Quality Assessment
di: Wen, Wen, et al.
Pubblicazione: (2025) -
CMTA: Leveraging Cross-Modal Temporal Artifacts for Generalizable AI-Generated Video Detection
di: Wang, Hang, et al.
Pubblicazione: (2026) -
Boosting Neural Video Representation via Online Structural Reparameterization
di: Li, Ziyi, et al.
Pubblicazione: (2025)