Exploring AIGC Video Quality: A Focus on Visual Harmony, Video-Text Consistency and Domain Distribution Gap
Fuente:
arXiv
Salvato in:
| Autori principali: | Qu, Bowen, Liang, Xiaoyu, Sun, Shangkun, Gao, Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency
di: Sun, Shangkun, et al.
Pubblicazione: (2025)
di: Sun, Shangkun, et al.
Pubblicazione: (2025)
VE-Bench: Subjective-Aligned Benchmark Suite for Text-Driven Video Editing Quality Assessment
di: Sun, Shangkun, et al.
Pubblicazione: (2024)
di: Sun, Shangkun, et al.
Pubblicazione: (2024)
IE-Critic-R1: Advancing the Explanatory Measurement of Text-Driven Image Editing for Human Perception Alignment
di: Qu, Bowen, et al.
Pubblicazione: (2025)
di: Qu, Bowen, et al.
Pubblicazione: (2025)
IE-Bench: Advancing the Measurement of Text-Driven Image Editing for Human Perception Alignment
di: Sun, Shangkun, et al.
Pubblicazione: (2025)
di: Sun, Shangkun, et al.
Pubblicazione: (2025)
Advancing Video Quality Assessment for AIGC
di: Yue, Xinli, et al.
Pubblicazione: (2024)
di: Yue, Xinli, et al.
Pubblicazione: (2024)
Lumen: Consistent Video Relighting and Harmonious Background Replacement with Video Generative Models
di: Zeng, Jianshu, et al.
Pubblicazione: (2025)
di: Zeng, Jianshu, et al.
Pubblicazione: (2025)
Adversarially Masked Video Consistency for Unsupervised Domain Adaptation
di: Zhu, Xiaoyu, et al.
Pubblicazione: (2024)
di: Zhu, Xiaoyu, et al.
Pubblicazione: (2024)
Benchmarking Multi-dimensional AIGC Video Quality Assessment: A Dataset and Unified Model
di: Zhang, Zhichao, et al.
Pubblicazione: (2024)
di: Zhang, Zhichao, et al.
Pubblicazione: (2024)
Flow4Agent: Long-form Video Understanding via Motion Prior from Optical Flow
di: Liu, Ruyang, et al.
Pubblicazione: (2025)
di: Liu, Ruyang, et al.
Pubblicazione: (2025)
JVID: Joint Video-Image Diffusion for Visual-Quality and Temporal-Consistency in Video Generation
di: Reynaud, Hadrien, et al.
Pubblicazione: (2024)
di: Reynaud, Hadrien, et al.
Pubblicazione: (2024)
Rethinking Video Segmentation with Masked Video Consistency: Did the Model Learn as Intended?
di: Liang, Chen, et al.
Pubblicazione: (2024)
di: Liang, Chen, et al.
Pubblicazione: (2024)
TIER: Text-Image Encoder-based Regression for AIGC Image Quality Assessment
di: Yuan, Jiquan, et al.
Pubblicazione: (2024)
di: Yuan, Jiquan, et al.
Pubblicazione: (2024)
PPLLaVA: Varied Video Sequence Understanding With Prompt Guidance
di: Sun, Shangkun, et al.
Pubblicazione: (2024)
di: Sun, Shangkun, et al.
Pubblicazione: (2024)
VideoUFO: A Million-Scale User-Focused Dataset for Text-to-Video Generation
di: Wang, Wenhao, et al.
Pubblicazione: (2025)
di: Wang, Wenhao, et al.
Pubblicazione: (2025)
Text-Video Retrieval with Global-Local Semantic Consistent Learning
di: Zhang, Haonan, et al.
Pubblicazione: (2024)
di: Zhang, Haonan, et al.
Pubblicazione: (2024)
V-CORE: Temporally Consistent Video Understanding for Video-LLM
di: Kang, Zhengjian, et al.
Pubblicazione: (2026)
di: Kang, Zhengjian, et al.
Pubblicazione: (2026)
VideoGen-Eval: Agent-based System for Video Generation Evaluation
di: Yang, Yuhang, et al.
Pubblicazione: (2025)
di: Yang, Yuhang, et al.
Pubblicazione: (2025)
Text-Audio-Visual-conditioned Diffusion Model for Video Saliency Prediction
di: Yu, Li, et al.
Pubblicazione: (2025)
di: Yu, Li, et al.
Pubblicazione: (2025)
ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation
di: Ren, Weiming, et al.
Pubblicazione: (2024)
di: Ren, Weiming, et al.
Pubblicazione: (2024)
Fréchet Video Motion Distance: A Metric for Evaluating Motion Consistency in Videos
di: Liu, Jiahe, et al.
Pubblicazione: (2024)
di: Liu, Jiahe, et al.
Pubblicazione: (2024)
FastVideoEdit: Leveraging Consistency Models for Efficient Text-to-Video Editing
di: Zhang, Youyuan, et al.
Pubblicazione: (2024)
di: Zhang, Youyuan, et al.
Pubblicazione: (2024)
Bringing Textual Prompt to AI-Generated Image Quality Assessment
di: Qu, Bowen, et al.
Pubblicazione: (2024)
di: Qu, Bowen, et al.
Pubblicazione: (2024)
Encapsulated Composition of Text-to-Image and Text-to-Video Models for High-Quality Video Synthesis
di: Su, Tongtong, et al.
Pubblicazione: (2025)
di: Su, Tongtong, et al.
Pubblicazione: (2025)
VideoElevator: Elevating Video Generation Quality with Versatile Text-to-Image Diffusion Models
di: Zhang, Yabo, et al.
Pubblicazione: (2024)
di: Zhang, Yabo, et al.
Pubblicazione: (2024)
Text-Animator: Controllable Visual Text Video Generation
di: Liu, Lin, et al.
Pubblicazione: (2024)
di: Liu, Lin, et al.
Pubblicazione: (2024)
Harmony4D: A Video Dataset for In-The-Wild Close Human Interactions
di: Khirodkar, Rawal, et al.
Pubblicazione: (2024)
di: Khirodkar, Rawal, et al.
Pubblicazione: (2024)
Harmony: Harmonizing Audio and Video Generation through Cross-Task Synergy
di: Hu, Teng, et al.
Pubblicazione: (2025)
di: Hu, Teng, et al.
Pubblicazione: (2025)
Ivy-Fake: A Unified Explainable Framework and Benchmark for Image and Video AIGC Detection
di: Jiang, Changjiang, et al.
Pubblicazione: (2025)
di: Jiang, Changjiang, et al.
Pubblicazione: (2025)
Enhancing Video Memorability Prediction with Text-Motion Cross-modal Contrastive Loss and Its Application in Video Summarization
di: Zhu, Zhiyi, et al.
Pubblicazione: (2025)
di: Zhu, Zhiyi, et al.
Pubblicazione: (2025)
World Consistency Score: A Unified Metric for Video Generation Quality
di: Rakheja, Akshat, et al.
Pubblicazione: (2025)
di: Rakheja, Akshat, et al.
Pubblicazione: (2025)
STCDiT: Spatio-Temporally Consistent Diffusion Transformer for High-Quality Video Super-Resolution
di: Chen, Junyang, et al.
Pubblicazione: (2025)
di: Chen, Junyang, et al.
Pubblicazione: (2025)
VQAThinker: Exploring Generalizable and Explainable Video Quality Assessment via Reinforcement Learning
di: Cao, Linhan, et al.
Pubblicazione: (2025)
di: Cao, Linhan, et al.
Pubblicazione: (2025)
FVAR: Visual Autoregressive Modeling via Next Focus Prediction
di: Li, Xiaofan, et al.
Pubblicazione: (2025)
di: Li, Xiaofan, et al.
Pubblicazione: (2025)
What You See Is What Matters: A Novel Visual and Physics-Based Metric for Evaluating Video Generation Quality
di: Wang, Zihan, et al.
Pubblicazione: (2024)
di: Wang, Zihan, et al.
Pubblicazione: (2024)
DropletVideo: A Dataset and Approach to Explore Integral Spatio-Temporal Consistent Video Generation
di: Zhang, Runze, et al.
Pubblicazione: (2025)
di: Zhang, Runze, et al.
Pubblicazione: (2025)
Reinforcing Video Reasoning with Focused Thinking
di: Dang, Jisheng, et al.
Pubblicazione: (2025)
di: Dang, Jisheng, et al.
Pubblicazione: (2025)
When Numbers Speak: Aligning Textual Numerals and Visual Instances in Text-to-Video Diffusion Models
di: Sun, Zhengyang, et al.
Pubblicazione: (2026)
di: Sun, Zhengyang, et al.
Pubblicazione: (2026)
MV-Adapter: Multimodal Video Transfer Learning for Video Text Retrieval
di: Jin, Xiaojie, et al.
Pubblicazione: (2023)
di: Jin, Xiaojie, et al.
Pubblicazione: (2023)
Learnable Motion-Focused Tokenization for Effective and Efficient Video Unsupervised Domain Adaptation
di: Liu, Tzu Ling, et al.
Pubblicazione: (2026)
di: Liu, Tzu Ling, et al.
Pubblicazione: (2026)
Video-R4: Reinforcing Text-Rich Video Reasoning with Visual Rumination
di: Tang, Yolo Y., et al.
Pubblicazione: (2025)
di: Tang, Yolo Y., et al.
Pubblicazione: (2025)
Documenti analoghi
-
Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency
di: Sun, Shangkun, et al.
Pubblicazione: (2025) -
VE-Bench: Subjective-Aligned Benchmark Suite for Text-Driven Video Editing Quality Assessment
di: Sun, Shangkun, et al.
Pubblicazione: (2024) -
IE-Critic-R1: Advancing the Explanatory Measurement of Text-Driven Image Editing for Human Perception Alignment
di: Qu, Bowen, et al.
Pubblicazione: (2025) -
IE-Bench: Advancing the Measurement of Text-Driven Image Editing for Human Perception Alignment
di: Sun, Shangkun, et al.
Pubblicazione: (2025) -
Advancing Video Quality Assessment for AIGC
di: Yue, Xinli, et al.
Pubblicazione: (2024)