FDIM: A Feature-distance-based Generic Video Quality Metric for Versatile Codecs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Jiayi, Zhang, Lichun, Zhuang, Xiaoqi, Zhang, Jiaqi, Yu, Lu, Zhao, Yin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Versatile Transition Generation with Image-to-Video Diffusion
par: Yang, Zuhao, et autres
Publié: (2025)
par: Yang, Zuhao, et autres
Publié: (2025)
VideoElevator: Elevating Video Generation Quality with Versatile Text-to-Image Diffusion Models
par: Zhang, Yabo, et autres
Publié: (2024)
par: Zhang, Yabo, et autres
Publié: (2024)
Hierarchical Codec Diffusion for Video-to-Speech Generation
par: Ye, Jiaxin, et autres
Publié: (2026)
par: Ye, Jiaxin, et autres
Publié: (2026)
QEMesh: Employing A Quadric Error Metrics-Based Representation for Mesh Generation
par: Li, Jiaqi, et autres
Publié: (2025)
par: Li, Jiaqi, et autres
Publié: (2025)
CodecCap: High-Fidelity Codec-Inspired Residual Modeling for Dense Video Captioning
par: Lin, Zihan, et autres
Publié: (2026)
par: Lin, Zihan, et autres
Publié: (2026)
VBench++: Comprehensive and Versatile Benchmark Suite for Video Generative Models
par: Huang, Ziqi, et autres
Publié: (2024)
par: Huang, Ziqi, et autres
Publié: (2024)
Metric3Dv2: A Versatile Monocular Geometric Foundation Model for Zero-shot Metric Depth and Surface Normal Estimation
par: Hu, Mu, et autres
Publié: (2024)
par: Hu, Mu, et autres
Publié: (2024)
Image Quality Assessment for Machines: Paradigm, Large-scale Database, and Models
par: Wang, Xiaoqi, et autres
Publié: (2025)
par: Wang, Xiaoqi, et autres
Publié: (2025)
V2Edit: Versatile Video Diffusion Editor for Videos and 3D Scenes
par: Zhang, Yanming, et autres
Publié: (2025)
par: Zhang, Yanming, et autres
Publié: (2025)
PreciseCache: Precise Feature Caching for Efficient and High-fidelity Video Generation
par: Wang, Jiangshan, et autres
Publié: (2026)
par: Wang, Jiangshan, et autres
Publié: (2026)
Ensemble Predicate Decoding for Unbiased Scene Graph Generation
par: Feng, Jiasong, et autres
Publié: (2024)
par: Feng, Jiasong, et autres
Publié: (2024)
NVDS+: Towards Efficient and Versatile Neural Stabilizer for Video Depth Estimation
par: Wang, Yiran, et autres
Publié: (2023)
par: Wang, Yiran, et autres
Publié: (2023)
Feature4X: Bridging Any Monocular Video to 4D Agentic AI with Versatile Gaussian Feature Fields
par: Zhou, Shijie, et autres
Publié: (2025)
par: Zhou, Shijie, et autres
Publié: (2025)
GRACE: Designing Generative Face Video Codec via Agile Hardware-Centric Workflow
par: Wan, Rui, et autres
Publié: (2025)
par: Wan, Rui, et autres
Publié: (2025)
ComPtr: Towards Diverse Bi-source Dense Prediction Tasks via A Simple yet General Complementary Transformer
par: Pang, Youwei, et autres
Publié: (2023)
par: Pang, Youwei, et autres
Publié: (2023)
No-Reference Image Quality Assessment with Global-Local Progressive Integration and Semantic-Aligned Quality Transfer
par: Wang, Xiaoqi, et autres
Publié: (2024)
par: Wang, Xiaoqi, et autres
Publié: (2024)
Towards Diverse Binary Segmentation via A Simple yet General Gated Network
par: Zhao, Xiaoqi, et autres
Publié: (2023)
par: Zhao, Xiaoqi, et autres
Publié: (2023)
Uniform Discrete Diffusion with Metric Path for Video Generation
par: Deng, Haoge, et autres
Publié: (2025)
par: Deng, Haoge, et autres
Publié: (2025)
LvBench: A Benchmark for Long-form Video Understanding with Versatile Multi-modal Question Answering
par: Zhang, Hongjie, et autres
Publié: (2023)
par: Zhang, Hongjie, et autres
Publié: (2023)
World Consistency Score: A Unified Metric for Video Generation Quality
par: Rakheja, Akshat, et autres
Publié: (2025)
par: Rakheja, Akshat, et autres
Publié: (2025)
Subjective-Aligned Dataset and Metric for Text-to-Video Quality Assessment
par: Kou, Tengchuan, et autres
Publié: (2024)
par: Kou, Tengchuan, et autres
Publié: (2024)
BlockVid: Block Diffusion for High-Quality and Consistent Minute-Long Video Generation
par: Zhang, Zeyu, et autres
Publié: (2025)
par: Zhang, Zeyu, et autres
Publié: (2025)
Map Feature Perception Metric for Map Generation Quality Assessment and Loss Optimization
par: Sun, Chenxing, et autres
Publié: (2025)
par: Sun, Chenxing, et autres
Publié: (2025)
Adaptive Multi-source Predictor for Zero-shot Video Object Segmentation
par: Zhao, Xiaoqi, et autres
Publié: (2023)
par: Zhao, Xiaoqi, et autres
Publié: (2023)
Compression of 3D Gaussian Splatting with Optimized Feature Planes and Standard Video Codecs
par: Lee, Soonbin, et autres
Publié: (2025)
par: Lee, Soonbin, et autres
Publié: (2025)
Towards A Better Metric for Text-to-Video Generation
par: Wu, Jay Zhangjie, et autres
Publié: (2024)
par: Wu, Jay Zhangjie, et autres
Publié: (2024)
AdaCodec: A Predictive Visual Code for Video MLLMs
par: Hou, Haowen, et autres
Publié: (2026)
par: Hou, Haowen, et autres
Publié: (2026)
UniMMAD: Unified Multi-Modal and Multi-Class Anomaly Detection via MoE-Driven Feature Decompression
par: Zhao, Yuan, et autres
Publié: (2025)
par: Zhao, Yuan, et autres
Publié: (2025)
OmniV2V: Versatile Video Generation and Editing via Dynamic Content Manipulation
par: Liang, Sen, et autres
Publié: (2025)
par: Liang, Sen, et autres
Publié: (2025)
A Versatile Multimodal Agent for Multimedia Content Generation
par: Zhang, Daoan, et autres
Publié: (2026)
par: Zhang, Daoan, et autres
Publié: (2026)
VideoREPA: Learning Physics for Video Generation through Relational Alignment with Foundation Models
par: Zhang, Xiangdong, et autres
Publié: (2025)
par: Zhang, Xiangdong, et autres
Publié: (2025)
No-Reference Rendered Video Quality Assessment: Dataset and Metrics
par: Yang, Sipeng, et autres
Publié: (2025)
par: Yang, Sipeng, et autres
Publié: (2025)
Multi-view Aggregation Network for Dichotomous Image Segmentation
par: Yu, Qian, et autres
Publié: (2024)
par: Yu, Qian, et autres
Publié: (2024)
A Comparative Study of Perceptual Quality Metrics for Audio-driven Talking Head Videos
par: Zhang, Weixia, et autres
Publié: (2024)
par: Zhang, Weixia, et autres
Publié: (2024)
Enabling Versatile Controls for Video Diffusion Models
par: Zhang, Xu, et autres
Publié: (2025)
par: Zhang, Xu, et autres
Publié: (2025)
Spatio-Temporal Correlation Guided Geometric Partitioning for Versatile Video Coding
par: Meng, Xuewei, et autres
Publié: (2026)
par: Meng, Xuewei, et autres
Publié: (2026)
ByTheWay: Boost Your Text-to-Video Generation Model to Higher Quality in a Training-free Way
par: Bu, Jiazi, et autres
Publié: (2024)
par: Bu, Jiazi, et autres
Publié: (2024)
VideoSketcher: Video Models Prior Enable Versatile Sequential Sketch Generation
par: Ren, Hui, et autres
Publié: (2026)
par: Ren, Hui, et autres
Publié: (2026)
Video Mamba Suite: State Space Model as a Versatile Alternative for Video Understanding
par: Chen, Guo, et autres
Publié: (2024)
par: Chen, Guo, et autres
Publié: (2024)
A Task is Worth One Word: Learning with Task Prompts for High-Quality Versatile Image Inpainting
par: Zhuang, Junhao, et autres
Publié: (2023)
par: Zhuang, Junhao, et autres
Publié: (2023)
Documents similaires
-
Versatile Transition Generation with Image-to-Video Diffusion
par: Yang, Zuhao, et autres
Publié: (2025) -
VideoElevator: Elevating Video Generation Quality with Versatile Text-to-Image Diffusion Models
par: Zhang, Yabo, et autres
Publié: (2024) -
Hierarchical Codec Diffusion for Video-to-Speech Generation
par: Ye, Jiaxin, et autres
Publié: (2026) -
QEMesh: Employing A Quadric Error Metrics-Based Representation for Mesh Generation
par: Li, Jiaqi, et autres
Publié: (2025) -
CodecCap: High-Fidelity Codec-Inspired Residual Modeling for Dense Video Captioning
par: Lin, Zihan, et autres
Publié: (2026)