Evaluating Design Video Generation: Metrics for Compositional Fidelity
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Deganutti, Adrienne, Cao, Dingning, Seol, Jaejung, Hirsch, Elad, Mehta, Purvanshi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Graphic-Design-Bench: A Comprehensive Benchmark for Evaluating AI on Graphic Design Tasks
par: Deganutti, Adrienne, et autres
Publié: (2026)
par: Deganutti, Adrienne, et autres
Publié: (2026)
LICA: Layered Image Composition Annotations for Graphic Design Research
par: Hirsch, Elad, et autres
Publié: (2026)
par: Hirsch, Elad, et autres
Publié: (2026)
TASTE: A Designer-Annotated Multi-Dimensional Preference Dataset for AI-Generated Graphic Design
par: Zhu, Haonan, et autres
Publié: (2026)
par: Zhu, Haonan, et autres
Publié: (2026)
VividFace: A Diffusion-Based Hybrid Framework for High-Fidelity Video Face Swapping
par: Shao, Hao, et autres
Publié: (2024)
par: Shao, Hao, et autres
Publié: (2024)
Objectness Similarity: Capturing Object-Level Fidelity in 3D Scene Evaluation
par: Uchida, Yuiko, et autres
Publié: (2025)
par: Uchida, Yuiko, et autres
Publié: (2025)
SeqTex: Generate Mesh Textures in Video Sequence
par: Yuan, Ze, et autres
Publié: (2025)
par: Yuan, Ze, et autres
Publié: (2025)
A Survey on Quality Metrics for Text-to-Image Generation
par: Hartwig, Sebastian, et autres
Publié: (2024)
par: Hartwig, Sebastian, et autres
Publié: (2024)
Make It Count: Text-to-Image Generation with an Accurate Number of Objects
par: Binyamin, Lital, et autres
Publié: (2024)
par: Binyamin, Lital, et autres
Publié: (2024)
VideoMV: Consistent Multi-View Generation Based on Large Video Generative Model
par: Zuo, Qi, et autres
Publié: (2024)
par: Zuo, Qi, et autres
Publié: (2024)
FabricDiffusion: High-Fidelity Texture Transfer for 3D Garments Generation from In-The-Wild Clothing Images
par: Zhang, Cheng, et autres
Publié: (2024)
par: Zhang, Cheng, et autres
Publié: (2024)
Physical Simulator In-the-Loop Video Generation
par: Foo, Lin Geng, et autres
Publié: (2026)
par: Foo, Lin Geng, et autres
Publié: (2026)
Mixture of Contexts for Long Video Generation
par: Cai, Shengqu, et autres
Publié: (2025)
par: Cai, Shengqu, et autres
Publié: (2025)
Object-level Visual Prompts for Compositional Image Generation
par: Parmar, Gaurav, et autres
Publié: (2025)
par: Parmar, Gaurav, et autres
Publié: (2025)
Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control
par: Gu, Zekai, et autres
Publié: (2025)
par: Gu, Zekai, et autres
Publié: (2025)
Bridging Text and Video Generation: A Survey
par: Kumar, Nilay, et autres
Publié: (2025)
par: Kumar, Nilay, et autres
Publié: (2025)
AMG: Avatar Motion Guided Video Generation
par: Yang, Zhangsihao, et autres
Publié: (2024)
par: Yang, Zhangsihao, et autres
Publié: (2024)
ScaffoldAvatar: High-Fidelity Gaussian Avatars with Patch Expressions
par: Aneja, Shivangi, et autres
Publié: (2025)
par: Aneja, Shivangi, et autres
Publié: (2025)
DesignAsCode: Bridging Structural Editability and Visual Fidelity in Graphic Design Generation
par: Liu, Ziyuan, et autres
Publié: (2026)
par: Liu, Ziyuan, et autres
Publié: (2026)
CASIM: Composite Aware Semantic Injection for Text to Motion Generation
par: Chang, Che-Jui, et autres
Publié: (2025)
par: Chang, Che-Jui, et autres
Publié: (2025)
Using Gaussian Splats to Create High-Fidelity Facial Geometry and Texture
par: He, Haodi, et autres
Publié: (2025)
par: He, Haodi, et autres
Publié: (2025)
ObjectMover: Generative Object Movement with Video Prior
par: Yu, Xin, et autres
Publié: (2025)
par: Yu, Xin, et autres
Publié: (2025)
Frankenstein: Generating Semantic-Compositional 3D Scenes in One Tri-Plane
par: Yan, Han, et autres
Publié: (2024)
par: Yan, Han, et autres
Publié: (2024)
LAYOUTDREAMER: Physics-guided Layout for Text-to-3D Compositional Scene Generation
par: Zhou, Yang, et autres
Publié: (2025)
par: Zhou, Yang, et autres
Publié: (2025)
RealWonder: Real-Time Physical Action-Conditioned Video Generation
par: Liu, Wei, et autres
Publié: (2026)
par: Liu, Wei, et autres
Publié: (2026)
MV-S2V: Multi-View Subject-Consistent Video Generation
par: Song, Ziyang, et autres
Publié: (2026)
par: Song, Ziyang, et autres
Publié: (2026)
3DPhysVideo: Consistency-Guided Flow SDE for Video Generation via 3D Scene Reconstruction and Physical Simulation
par: Kim, Hwidong, et autres
Publié: (2026)
par: Kim, Hwidong, et autres
Publié: (2026)
DepthCrafter: Generating Consistent Long Depth Sequences for Open-world Videos
par: Hu, Wenbo, et autres
Publié: (2024)
par: Hu, Wenbo, et autres
Publié: (2024)
SVGauge: Towards Human-Aligned Evaluation for SVG Generation
par: Zini, Leonardo, et autres
Publié: (2025)
par: Zini, Leonardo, et autres
Publié: (2025)
WonderZoom: Multi-Scale 3D World Generation
par: Cao, Jin, et autres
Publié: (2025)
par: Cao, Jin, et autres
Publié: (2025)
WorldScore: A Unified Evaluation Benchmark for World Generation
par: Duan, Haoyi, et autres
Publié: (2025)
par: Duan, Haoyi, et autres
Publié: (2025)
Intelligent Artistic Typography: A Comprehensive Review of Artistic Text Design and Generation
par: Bai, Yuhang, et autres
Publié: (2024)
par: Bai, Yuhang, et autres
Publié: (2024)
Taming Video Models for 3D and 4D Generation via Zero-Shot Camera Control
par: Song, Chenxi, et autres
Publié: (2025)
par: Song, Chenxi, et autres
Publié: (2025)
VideoPanda: Video Panoramic Diffusion with Multi-view Attention
par: Xie, Kevin, et autres
Publié: (2025)
par: Xie, Kevin, et autres
Publié: (2025)
Zero-shot Sequential Neuro-symbolic Reasoning for Automatically Generating Architecture Schematic Designs
par: Kodnongbua, Milin, et autres
Publié: (2024)
par: Kodnongbua, Milin, et autres
Publié: (2024)
InfiniCube: Unbounded and Controllable Dynamic 3D Driving Scene Generation with World-Guided Video Models
par: Lu, Yifan, et autres
Publié: (2024)
par: Lu, Yifan, et autres
Publié: (2024)
DiffHDR: Re-Exposing LDR Videos with Video Diffusion Models
par: Yu, Zhengming, et autres
Publié: (2026)
par: Yu, Zhengming, et autres
Publié: (2026)
FreeOrbit4D: Training-Free Arbitrary Camera Redirection for Monocular Videos via Foreground-Complete 4D Reconstruction
par: Cao, Wei, et autres
Publié: (2026)
par: Cao, Wei, et autres
Publié: (2026)
MetricGold: Leveraging Text-To-Image Latent Diffusion Models for Metric Depth Estimation
par: Shah, Ansh, et autres
Publié: (2024)
par: Shah, Ansh, et autres
Publié: (2024)
ReLumix: Extending Image Relighting to Video via Video Diffusion Models
par: Wang, Lezhong, et autres
Publié: (2025)
par: Wang, Lezhong, et autres
Publié: (2025)
Parameter-Free Neural Lens Blur Rendering for High-Fidelity Composites
par: Ruan, Lingyan, et autres
Publié: (2025)
par: Ruan, Lingyan, et autres
Publié: (2025)
Documents similaires
-
Graphic-Design-Bench: A Comprehensive Benchmark for Evaluating AI on Graphic Design Tasks
par: Deganutti, Adrienne, et autres
Publié: (2026) -
LICA: Layered Image Composition Annotations for Graphic Design Research
par: Hirsch, Elad, et autres
Publié: (2026) -
TASTE: A Designer-Annotated Multi-Dimensional Preference Dataset for AI-Generated Graphic Design
par: Zhu, Haonan, et autres
Publié: (2026) -
VividFace: A Diffusion-Based Hybrid Framework for High-Fidelity Video Face Swapping
par: Shao, Hao, et autres
Publié: (2024) -
Objectness Similarity: Capturing Object-Level Fidelity in 3D Scene Evaluation
par: Uchida, Yuiko, et autres
Publié: (2025)