G-Refine: A General Quality Refiner for Text-to-Image Generation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Chunyi, Wu, Haoning, Hao, Hongkun, Zhang, Zicheng, Kou, Tengchaun, Chen, Chaofeng, Bai, Lei, Liu, Xiaohong, Lin, Weisi, Zhai, Guangtao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Q-Refine: A Perceptual Quality Refiner for AI-Generated Image
von: Li, Chunyi, et al.
Veröffentlicht: (2024)
von: Li, Chunyi, et al.
Veröffentlicht: (2024)
Q-Bench: A Benchmark for General-Purpose Foundation Models on Low-level Vision
von: Wu, Haoning, et al.
Veröffentlicht: (2023)
von: Wu, Haoning, et al.
Veröffentlicht: (2023)
Image Quality Assessment: From Human to Machine Preference
von: Li, Chunyi, et al.
Veröffentlicht: (2025)
von: Li, Chunyi, et al.
Veröffentlicht: (2025)
Dual-Branch Network for Portrait Image Quality Assessment
von: Sun, Wei, et al.
Veröffentlicht: (2024)
von: Sun, Wei, et al.
Veröffentlicht: (2024)
R-Bench: Are your Large Multimodal Model Robust to Real-world Corruptions?
von: Li, Chunyi, et al.
Veröffentlicht: (2024)
von: Li, Chunyi, et al.
Veröffentlicht: (2024)
Towards Explainable Partial-AIGC Image Quality Assessment
von: Qian, Jiaying, et al.
Veröffentlicht: (2025)
von: Qian, Jiaying, et al.
Veröffentlicht: (2025)
Q-Adapt: Adapting LMM for Visual Quality Assessment with Progressive Instruction Tuning
von: Lu, Yiting, et al.
Veröffentlicht: (2025)
von: Lu, Yiting, et al.
Veröffentlicht: (2025)
Teaching LMMs for Image Quality Scoring and Interpreting
von: Zhang, Zicheng, et al.
Veröffentlicht: (2025)
von: Zhang, Zicheng, et al.
Veröffentlicht: (2025)
AIS 2024 Challenge on Video Quality Assessment of User-Generated Content: Methods and Results
von: Conde, Marcos V., et al.
Veröffentlicht: (2024)
von: Conde, Marcos V., et al.
Veröffentlicht: (2024)
Subjective-Aligned Dataset and Metric for Text-to-Video Quality Assessment
von: Kou, Tengchuan, et al.
Veröffentlicht: (2024)
von: Kou, Tengchuan, et al.
Veröffentlicht: (2024)
LMM-PCQA: Assisting Point Cloud Quality Assessment with LMM
von: Zhang, Zicheng, et al.
Veröffentlicht: (2024)
von: Zhang, Zicheng, et al.
Veröffentlicht: (2024)
TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning
von: Xie, Jingjing, et al.
Veröffentlicht: (2024)
von: Xie, Jingjing, et al.
Veröffentlicht: (2024)
ELIQ: A Label-Free Framework for Quality Assessment of Evolving AI-Generated Images
von: Li, Xinyue, et al.
Veröffentlicht: (2026)
von: Li, Xinyue, et al.
Veröffentlicht: (2026)
Exploring Rich Subjective Quality Information for Image Quality Assessment in the Wild
von: Min, Xiongkuo, et al.
Veröffentlicht: (2024)
von: Min, Xiongkuo, et al.
Veröffentlicht: (2024)
Q-Bench+: A Benchmark for Multi-modal Foundation Models on Low-level Vision from Single Images to Pairs
von: Zhang, Zicheng, et al.
Veröffentlicht: (2024)
von: Zhang, Zicheng, et al.
Veröffentlicht: (2024)
ESIQA: Perceptual Quality Assessment of Vision-Pro-based Egocentric Spatial Images
von: Zhu, Xilei, et al.
Veröffentlicht: (2024)
von: Zhu, Xilei, et al.
Veröffentlicht: (2024)
Enhancing Blind Video Quality Assessment with Rich Quality-aware Features
von: Sun, Wei, et al.
Veröffentlicht: (2024)
von: Sun, Wei, et al.
Veröffentlicht: (2024)
HarmonyIQA: Pioneering Benchmark and Model for Image Harmonization Quality Assessment
von: Xu, Zitong, et al.
Veröffentlicht: (2025)
von: Xu, Zitong, et al.
Veröffentlicht: (2025)
Audio-Visual Quality Assessment for User Generated Content: Database and Method
von: Cao, Yuqin, et al.
Veröffentlicht: (2023)
von: Cao, Yuqin, et al.
Veröffentlicht: (2023)
LMM4Edit: Benchmarking and Evaluating Multimodal Image Editing with LMMs
von: Xu, Zitong, et al.
Veröffentlicht: (2025)
von: Xu, Zitong, et al.
Veröffentlicht: (2025)
DPC-VQA: Decoupling Quality Perception and Residual Calibration for Video Quality Assessment
von: Li, Xinyue, et al.
Veröffentlicht: (2026)
von: Li, Xinyue, et al.
Veröffentlicht: (2026)
LayerT2V: A Unified Multi-Layer Video Generation Framework
von: Li, Guangzhao, et al.
Veröffentlicht: (2025)
von: Li, Guangzhao, et al.
Veröffentlicht: (2025)
PoseTalk: Text-and-Audio-based Pose Control and Motion Refinement for One-Shot Talking Head Generation
von: Ling, Jun, et al.
Veröffentlicht: (2024)
von: Ling, Jun, et al.
Veröffentlicht: (2024)
VQA$^2$: Visual Question Answering for Video Quality Assessment
von: Jia, Ziheng, et al.
Veröffentlicht: (2024)
von: Jia, Ziheng, et al.
Veröffentlicht: (2024)
AGAV-Rater: Adapting Large Multimodal Model for AI-Generated Audio-Visual Quality Assessment
von: Cao, Yuqin, et al.
Veröffentlicht: (2025)
von: Cao, Yuqin, et al.
Veröffentlicht: (2025)
GAOT: Generating Articulated Objects Through Text-Guided Diffusion Models
von: Sun, Hao, et al.
Veröffentlicht: (2025)
von: Sun, Hao, et al.
Veröffentlicht: (2025)
Light-VQA+: A Video Quality Assessment Model for Exposure Correction with Vision-Language Guidance
von: Zhou, Xunchu, et al.
Veröffentlicht: (2024)
von: Zhou, Xunchu, et al.
Veröffentlicht: (2024)
ESVQA: Perceptual Quality Assessment of Egocentric Spatial Videos
von: Zhu, Xilei, et al.
Veröffentlicht: (2024)
von: Zhu, Xilei, et al.
Veröffentlicht: (2024)
Generalized Jersey Number Recognition Using Multi-task Learning With Orientation-guided Weight Refinement
von: Lin, Yung-Hui, et al.
Veröffentlicht: (2024)
von: Lin, Yung-Hui, et al.
Veröffentlicht: (2024)
MISC: Ultra-low Bitrate Image Semantic Compression Driven by Large Multimodal Model
von: Li, Chunyi, et al.
Veröffentlicht: (2024)
von: Li, Chunyi, et al.
Veröffentlicht: (2024)
Multi-scale Activation, Refinement, and Aggregation: Exploring Diverse Cues for Fine-Grained Bird Recognition
von: Zhang, Zhicheng, et al.
Veröffentlicht: (2025)
von: Zhang, Zhicheng, et al.
Veröffentlicht: (2025)
AIGIQA-20K: A Large Database for AI-Generated Image Quality Assessment
von: Li, Chunyi, et al.
Veröffentlicht: (2024)
von: Li, Chunyi, et al.
Veröffentlicht: (2024)
Generative Frame Sampler for Long Video Understanding
von: Yao, Linli, et al.
Veröffentlicht: (2025)
von: Yao, Linli, et al.
Veröffentlicht: (2025)
Hand1000: Generating Realistic Hands from Text with Only 1,000 Images
von: Zhang, Haozhuo, et al.
Veröffentlicht: (2024)
von: Zhang, Haozhuo, et al.
Veröffentlicht: (2024)
MVBIND: Self-Supervised Music Recommendation For Videos Via Embedding Space Binding
von: Teng, Jiajie, et al.
Veröffentlicht: (2024)
von: Teng, Jiajie, et al.
Veröffentlicht: (2024)
Scaling Audio-Visual Quality Assessment Dataset via Crowdsourcing
von: Yang, Renyu, et al.
Veröffentlicht: (2026)
von: Yang, Renyu, et al.
Veröffentlicht: (2026)
Q-Bench-Video: Benchmarking the Video Quality Understanding of LMMs
von: Zhang, Zicheng, et al.
Veröffentlicht: (2024)
von: Zhang, Zicheng, et al.
Veröffentlicht: (2024)
Towards Open-ended Visual Quality Comparison
von: Wu, Haoning, et al.
Veröffentlicht: (2024)
von: Wu, Haoning, et al.
Veröffentlicht: (2024)
A-Bench: Are LMMs Masters at Evaluating AI-generated Images?
von: Zhang, Zicheng, et al.
Veröffentlicht: (2024)
von: Zhang, Zicheng, et al.
Veröffentlicht: (2024)
Multimodal Large Language Model is a Human-Aligned Annotator for Text-to-Image Generation
von: Wu, Xun, et al.
Veröffentlicht: (2024)
von: Wu, Xun, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Q-Refine: A Perceptual Quality Refiner for AI-Generated Image
von: Li, Chunyi, et al.
Veröffentlicht: (2024) -
Q-Bench: A Benchmark for General-Purpose Foundation Models on Low-level Vision
von: Wu, Haoning, et al.
Veröffentlicht: (2023) -
Image Quality Assessment: From Human to Machine Preference
von: Li, Chunyi, et al.
Veröffentlicht: (2025) -
Dual-Branch Network for Portrait Image Quality Assessment
von: Sun, Wei, et al.
Veröffentlicht: (2024) -
R-Bench: Are your Large Multimodal Model Robust to Real-world Corruptions?
von: Li, Chunyi, et al.
Veröffentlicht: (2024)