FlashEval: Towards Fast and Accurate Evaluation of Text-to-image Diffusion Generative Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Lin, Zhao, Tianchen, Lin, Zinan, Ning, Xuefei, Dai, Guohao, Yang, Huazhong, Wang, Yu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
MixDQ: Memory-Efficient Few-Step Text-to-Image Diffusion Models with Metric-Decoupled Mixed Precision Quantization
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
Linear Combination of Saved Checkpoints Makes Consistency and Diffusion Models Better
di: Liu, Enshu, et al.
Pubblicazione: (2024)
di: Liu, Enshu, et al.
Pubblicazione: (2024)
DiTFastAttn: Attention Compression for Diffusion Transformer Models
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
GenMAC: Compositional Text-to-Video Generation with Multi-Agent Collaboration
di: Huang, Kaiyi, et al.
Pubblicazione: (2024)
di: Huang, Kaiyi, et al.
Pubblicazione: (2024)
Distilled Decoding 1: One-step Sampling of Image Auto-regressive Models with Flow Matching
di: Liu, Enshu, et al.
Pubblicazione: (2024)
di: Liu, Enshu, et al.
Pubblicazione: (2024)
Accelerating Auto-regressive Text-to-Image Generation with Training-free Speculative Jacobi Decoding
di: Teng, Yao, et al.
Pubblicazione: (2024)
di: Teng, Yao, et al.
Pubblicazione: (2024)
AccDiffusion: An Accurate Method for Higher-Resolution Image Generation
di: Lin, Zhihang, et al.
Pubblicazione: (2024)
di: Lin, Zhihang, et al.
Pubblicazione: (2024)
FrameFusion: Combining Similarity and Importance for Video Token Reduction on Large Vision Language Models
di: Fu, Tianyu, et al.
Pubblicazione: (2024)
di: Fu, Tianyu, et al.
Pubblicazione: (2024)
Latent Zoning Network: A Unified Principle for Generative Modeling, Representation Learning, and Classification
di: Lin, Zinan, et al.
Pubblicazione: (2025)
di: Lin, Zinan, et al.
Pubblicazione: (2025)
SJD++: Improved Speculative Jacobi Decoding for Training-free Acceleration of Discrete Auto-regressive Text-to-Image Generation
di: Teng, Yao, et al.
Pubblicazione: (2025)
di: Teng, Yao, et al.
Pubblicazione: (2025)
DiM: Diffusion Mamba for Efficient High-Resolution Image Synthesis
di: Teng, Yao, et al.
Pubblicazione: (2024)
di: Teng, Yao, et al.
Pubblicazione: (2024)
FilMaster: Bridging Cinematic Principles and Generative AI for Automated Film Generation
di: Huang, Kaiyi, et al.
Pubblicazione: (2025)
di: Huang, Kaiyi, et al.
Pubblicazione: (2025)
MBQ: Modality-Balanced Quantization for Large Vision-Language Models
di: Li, Shiyao, et al.
Pubblicazione: (2024)
di: Li, Shiyao, et al.
Pubblicazione: (2024)
FlashCap: Millisecond-Accurate Human Motion Capture via Flashing LEDs and Event-Based Vision
di: Wu, Zekai, et al.
Pubblicazione: (2026)
di: Wu, Zekai, et al.
Pubblicazione: (2026)
LiteVAR: Compressing Visual Autoregressive Modelling with Efficient Attention and Quantization
di: Xie, Rui, et al.
Pubblicazione: (2024)
di: Xie, Rui, et al.
Pubblicazione: (2024)
Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers
di: Feng, Weilun, et al.
Pubblicazione: (2025)
di: Feng, Weilun, et al.
Pubblicazione: (2025)
CILP-FGDI: Exploiting Vision-Language Model for Generalizable Person Re-Identification
di: Zhao, Huazhong, et al.
Pubblicazione: (2025)
di: Zhao, Huazhong, et al.
Pubblicazione: (2025)
LRQ-DiT: Log-Rotation Post-Training Quantization of Diffusion Transformers for Image and Video Generation
di: Yang, Lianwei, et al.
Pubblicazione: (2025)
di: Yang, Lianwei, et al.
Pubblicazione: (2025)
Towards More Accurate Diffusion Model Acceleration with A Timestep Tuner
di: Xia, Mengfei, et al.
Pubblicazione: (2023)
di: Xia, Mengfei, et al.
Pubblicazione: (2023)
CineScene: Implicit 3D as Effective Scene Representation for Cinematic Video Generation
di: Huang, Kaiyi, et al.
Pubblicazione: (2026)
di: Huang, Kaiyi, et al.
Pubblicazione: (2026)
AccDiffusion v2: Towards More Accurate Higher-Resolution Diffusion Extrapolation
di: Lin, Zhihang, et al.
Pubblicazione: (2024)
di: Lin, Zhihang, et al.
Pubblicazione: (2024)
Fast and Accurate Object Detection on Asymmetrical Receptive Field
di: Lin, Tianhao
Pubblicazione: (2023)
di: Lin, Tianhao
Pubblicazione: (2023)
PosterMaker: Towards High-Quality Product Poster Generation with Accurate Text Rendering
di: Gao, Yifan, et al.
Pubblicazione: (2025)
di: Gao, Yifan, et al.
Pubblicazione: (2025)
SALAD: Achieve High-Sparsity Attention via Efficient Linear Attention Tuning for Video Diffusion Transformer
di: Fang, Tongcheng, et al.
Pubblicazione: (2026)
di: Fang, Tongcheng, et al.
Pubblicazione: (2026)
Defending Text-to-image Diffusion Models: Surprising Efficacy of Textual Perturbations Against Backdoor Attacks
di: Chew, Oscar, et al.
Pubblicazione: (2024)
di: Chew, Oscar, et al.
Pubblicazione: (2024)
Seek for Incantations: Towards Accurate Text-to-Image Diffusion Synthesis through Prompt Engineering
di: Yu, Chang, et al.
Pubblicazione: (2024)
di: Yu, Chang, et al.
Pubblicazione: (2024)
CLIP-DFGS: A Hard Sample Mining Method for CLIP in Generalizable Person Re-Identification
di: Zhao, Huazhong, et al.
Pubblicazione: (2024)
di: Zhao, Huazhong, et al.
Pubblicazione: (2024)
Diffusion Noise Feature: Accurate and Fast Generated Image Detection
di: Zhang, Yichi, et al.
Pubblicazione: (2023)
di: Zhang, Yichi, et al.
Pubblicazione: (2023)
VideoGen-Eval: Agent-based System for Video Generation Evaluation
di: Yang, Yuhang, et al.
Pubblicazione: (2025)
di: Yang, Yuhang, et al.
Pubblicazione: (2025)
Skeleton-of-Thought: Prompting LLMs for Efficient Parallel Generation
di: Ning, Xuefei, et al.
Pubblicazione: (2023)
di: Ning, Xuefei, et al.
Pubblicazione: (2023)
Towards Lifelong Few-Shot Customization of Text-to-Image Diffusion
di: Song, Nan, et al.
Pubblicazione: (2024)
di: Song, Nan, et al.
Pubblicazione: (2024)
Unleashing Vecset Diffusion Model for Fast Shape Generation
di: Lai, Zeqiang, et al.
Pubblicazione: (2025)
di: Lai, Zeqiang, et al.
Pubblicazione: (2025)
HandEval: Taking the First Step Towards Hand Quality Evaluation in Generated Images
di: Wang, Zichuan, et al.
Pubblicazione: (2025)
di: Wang, Zichuan, et al.
Pubblicazione: (2025)
SpecDiff: Accelerating Diffusion Model Inference with Self-Speculation
di: Pan, Jiayi, et al.
Pubblicazione: (2025)
di: Pan, Jiayi, et al.
Pubblicazione: (2025)
EvalCrafter: Benchmarking and Evaluating Large Video Generation Models
di: Liu, Yaofang, et al.
Pubblicazione: (2023)
di: Liu, Yaofang, et al.
Pubblicazione: (2023)
ST-LDM: A Universal Framework for Text-Grounded Object Generation in Real Images
di: Xue, Xiangtian, et al.
Pubblicazione: (2024)
di: Xue, Xiangtian, et al.
Pubblicazione: (2024)
DiffBIR: Towards Blind Image Restoration with Generative Diffusion Prior
di: Lin, Xinqi, et al.
Pubblicazione: (2023)
di: Lin, Xinqi, et al.
Pubblicazione: (2023)
SeedVR: Seeding Infinity in Diffusion Transformer Towards Generic Video Restoration
di: Wang, Jianyi, et al.
Pubblicazione: (2025)
di: Wang, Jianyi, et al.
Pubblicazione: (2025)
Uncovering the Text Embedding in Text-to-Image Diffusion Models
di: Yu, Hu, et al.
Pubblicazione: (2024)
di: Yu, Hu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation
di: Zhao, Tianchen, et al.
Pubblicazione: (2024) -
MixDQ: Memory-Efficient Few-Step Text-to-Image Diffusion Models with Metric-Decoupled Mixed Precision Quantization
di: Zhao, Tianchen, et al.
Pubblicazione: (2024) -
Linear Combination of Saved Checkpoints Makes Consistency and Diffusion Models Better
di: Liu, Enshu, et al.
Pubblicazione: (2024) -
DiTFastAttn: Attention Compression for Diffusion Transformer Models
di: Yuan, Zhihang, et al.
Pubblicazione: (2024) -
GenMAC: Compositional Text-to-Video Generation with Multi-Agent Collaboration
di: Huang, Kaiyi, et al.
Pubblicazione: (2024)