A Review on Generative AI For Text-To-Image and Image-To-Image Generation and Implications To Scientific Images
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sordo, Zineb, Chagnon, Eric, Ushizima, Daniela |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Foundation Models for Zero-Shot Segmentation of Scientific Images without AI-Ready Data
par: Mukherjee, Shubhabrata, et autres
Publié: (2025)
par: Mukherjee, Shubhabrata, et autres
Publié: (2025)
PKU-AIGIQA-4K: A Perceptual Quality Assessment Database for Both Text-to-Image and Image-to-Image AI-Generated Images
par: Yuan, Jiquan, et autres
Publié: (2024)
par: Yuan, Jiquan, et autres
Publié: (2024)
Prompt Refinement with Image Pivot for Text-to-Image Generation
par: Zhan, Jingtao, et autres
Publié: (2024)
par: Zhan, Jingtao, et autres
Publié: (2024)
ImageDoctor: Diagnosing Text-to-Image Generation via Grounded Image Reasoning
par: Guo, Yuxiang, et autres
Publié: (2025)
par: Guo, Yuxiang, et autres
Publié: (2025)
Surgical Text-to-Image Generation
par: Nwoye, Chinedu Innocent, et autres
Publié: (2024)
par: Nwoye, Chinedu Innocent, et autres
Publié: (2024)
Generating Multimodal Images with GAN: Integrating Text, Image, and Style
par: Tan, Chaoyi, et autres
Publié: (2025)
par: Tan, Chaoyi, et autres
Publié: (2025)
Image2Text2Image: A Novel Framework for Label-Free Evaluation of Image-to-Text Generation with Text-to-Image Diffusion Models
par: Huang, Jia-Hong, et autres
Publié: (2024)
par: Huang, Jia-Hong, et autres
Publié: (2024)
ScImage: How Good Are Multimodal Large Language Models at Scientific Text-to-Image Generation?
par: Zhang, Leixin, et autres
Publié: (2024)
par: Zhang, Leixin, et autres
Publié: (2024)
Reusing Computation in Text-to-Image Diffusion for Efficient Generation of Image Sets
par: Decatur, Dale, et autres
Publié: (2025)
par: Decatur, Dale, et autres
Publié: (2025)
Evaluating Image Caption via Cycle-consistent Text-to-Image Generation
par: Cui, Tianyu, et autres
Publié: (2025)
par: Cui, Tianyu, et autres
Publié: (2025)
Visual Concept-driven Image Generation with Text-to-Image Diffusion Model
par: Rahman, Tanzila, et autres
Publié: (2024)
par: Rahman, Tanzila, et autres
Publié: (2024)
Qwen-Image-Bench: From Generation to Creation in Text-to-Image Evaluation
par: Li, Niantong, et autres
Publié: (2026)
par: Li, Niantong, et autres
Publié: (2026)
AGFSync: Leveraging AI-Generated Feedback for Preference Optimization in Text-to-Image Generation
par: An, Jingkun, et autres
Publié: (2024)
par: An, Jingkun, et autres
Publié: (2024)
Text to Image Generation and Editing: A Survey
par: Yang, Pengfei, et autres
Publié: (2025)
par: Yang, Pengfei, et autres
Publié: (2025)
Generating Intermediate Representations for Compositional Text-To-Image Generation
par: Galun, Ran, et autres
Publié: (2024)
par: Galun, Ran, et autres
Publié: (2024)
Beautiful Images, Toxic Words: Understanding and Addressing Offensive Text in Generated Images
par: Kumar, Aditya, et autres
Publié: (2025)
par: Kumar, Aditya, et autres
Publié: (2025)
ViewDiff: 3D-Consistent Image Generation with Text-to-Image Models
par: Höllein, Lukas, et autres
Publié: (2024)
par: Höllein, Lukas, et autres
Publié: (2024)
EmoGen: Emotional Image Content Generation with Text-to-Image Diffusion Models
par: Yang, Jingyuan, et autres
Publié: (2024)
par: Yang, Jingyuan, et autres
Publié: (2024)
Synergistic Dual Spatial-aware Generation of Image-to-Text and Text-to-Image
par: Zhao, Yu, et autres
Publié: (2024)
par: Zhao, Yu, et autres
Publié: (2024)
Addressing Image Hallucination in Text-to-Image Generation through Factual Image Retrieval
par: Lim, Youngsun, et autres
Publié: (2024)
par: Lim, Youngsun, et autres
Publié: (2024)
Image Regeneration: Evaluating Text-to-Image Model via Generating Identical Image with Multimodal Large Language Models
par: Meng, Chutian, et autres
Publié: (2024)
par: Meng, Chutian, et autres
Publié: (2024)
Optimizing Prompts for Text-to-Image Generation
par: Hao, Yaru, et autres
Publié: (2022)
par: Hao, Yaru, et autres
Publié: (2022)
FOCUS: Optimal Control for Multi-Entity World Modeling in Text-to-Image Generation
par: Bill, Eric Tillmann, et autres
Publié: (2025)
par: Bill, Eric Tillmann, et autres
Publié: (2025)
Resolving the Identity Crisis in Text-to-Image Generation
par: Borse, Shubhankar, et autres
Publié: (2025)
par: Borse, Shubhankar, et autres
Publié: (2025)
Conditional Text-to-Image Generation with Reference Guidance
par: Kim, Taewook, et autres
Publié: (2024)
par: Kim, Taewook, et autres
Publié: (2024)
Text-Image Conditioned 3D Generation
par: Cen, Jiazhong, et autres
Publié: (2026)
par: Cen, Jiazhong, et autres
Publié: (2026)
Personalizing Text-to-Image Generation to Individual Taste
par: Maerten, Anne-Sofie, et autres
Publié: (2026)
par: Maerten, Anne-Sofie, et autres
Publié: (2026)
Rich Human Feedback for Text-to-Image Generation
par: Liang, Youwei, et autres
Publié: (2023)
par: Liang, Youwei, et autres
Publié: (2023)
Improving Text Generation on Images with Synthetic Captions
par: Koh, Jun Young, et autres
Publié: (2024)
par: Koh, Jun Young, et autres
Publié: (2024)
Exploring the Naturalness of AI-Generated Images
par: Chen, Zijian, et autres
Publié: (2023)
par: Chen, Zijian, et autres
Publié: (2023)
Enhancing Reward Models for High-quality Image Generation: Beyond Text-Image Alignment
par: Ba, Ying, et autres
Publié: (2025)
par: Ba, Ying, et autres
Publié: (2025)
Generating an Image From 1,000 Words: Enhancing Text-to-Image With Structured Captions
par: Gutflaish, Eyal, et autres
Publié: (2025)
par: Gutflaish, Eyal, et autres
Publié: (2025)
DreamVideo: High-Fidelity Image-to-Video Generation with Image Retention and Text Guidance
par: Wang, Cong, et autres
Publié: (2023)
par: Wang, Cong, et autres
Publié: (2023)
Textual Localization: Decomposing Multi-concept Images for Subject-Driven Text-to-Image Generation
par: Shentu, Junjie, et autres
Publié: (2024)
par: Shentu, Junjie, et autres
Publié: (2024)
Evaluating Image Hallucination in Text-to-Image Generation with Question-Answering
par: Lim, Youngsun, et autres
Publié: (2024)
par: Lim, Youngsun, et autres
Publié: (2024)
Evaluating the Generation of Spatial Relations in Text and Image Generative Models
par: Sim, Shang Hong, et autres
Publié: (2024)
par: Sim, Shang Hong, et autres
Publié: (2024)
Text-to-Image Cross-Modal Generation: A Systematic Review
par: Żelaszczyk, Maciej, et autres
Publié: (2024)
par: Żelaszczyk, Maciej, et autres
Publié: (2024)
Detecting AI-Generated Images via Distributional Deviations from Real Images
par: Niu, Yakun, et autres
Publié: (2026)
par: Niu, Yakun, et autres
Publié: (2026)
Text4Seg: Reimagining Image Segmentation as Text Generation
par: Lan, Mengcheng, et autres
Publié: (2024)
par: Lan, Mengcheng, et autres
Publié: (2024)
Precision or Recall? An Analysis of Image Captions for Training Text-to-Image Generation Model
par: Cheng, Sheng, et autres
Publié: (2024)
par: Cheng, Sheng, et autres
Publié: (2024)
Documents similaires
-
Foundation Models for Zero-Shot Segmentation of Scientific Images without AI-Ready Data
par: Mukherjee, Shubhabrata, et autres
Publié: (2025) -
PKU-AIGIQA-4K: A Perceptual Quality Assessment Database for Both Text-to-Image and Image-to-Image AI-Generated Images
par: Yuan, Jiquan, et autres
Publié: (2024) -
Prompt Refinement with Image Pivot for Text-to-Image Generation
par: Zhan, Jingtao, et autres
Publié: (2024) -
ImageDoctor: Diagnosing Text-to-Image Generation via Grounded Image Reasoning
par: Guo, Yuxiang, et autres
Publié: (2025) -
Surgical Text-to-Image Generation
par: Nwoye, Chinedu Innocent, et autres
Publié: (2024)