Text to Image Generation and Editing: A Survey
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Pengfei, Cheung, Ngai-Man, Ma, Xinda |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FairQueue: Rethinking Prompt Learning for Fair Text-to-Image Generation
di: Teo, Christopher T. H, et al.
Pubblicazione: (2024)
di: Teo, Christopher T. H, et al.
Pubblicazione: (2024)
Token Compression Meets Compact Vision Transformers: A Survey and Comparative Evaluation for Edge AI
di: Nguyen, Phat, et al.
Pubblicazione: (2025)
di: Nguyen, Phat, et al.
Pubblicazione: (2025)
On the Adversarial Robustness of 3D Large Vision-Language Models
di: Liu, Chao, et al.
Pubblicazione: (2026)
di: Liu, Chao, et al.
Pubblicazione: (2026)
AIR: Zero-shot Generative Model Adaptation with Iterative Refinement
di: Liu, Guimeng, et al.
Pubblicazione: (2025)
di: Liu, Guimeng, et al.
Pubblicazione: (2025)
A Survey of Multimodal-Guided Image Editing with Text-to-Image Diffusion Models
di: Shuai, Xincheng, et al.
Pubblicazione: (2024)
di: Shuai, Xincheng, et al.
Pubblicazione: (2024)
Frequency Masking for Universal Deepfake Detection
di: Doloriel, Chandler Timm, et al.
Pubblicazione: (2024)
di: Doloriel, Chandler Timm, et al.
Pubblicazione: (2024)
Synth-Align: Improving Trustworthiness in Vision-Language Model with Synthetic Preference Data Alignment
di: Wijaya, Robert, et al.
Pubblicazione: (2024)
di: Wijaya, Robert, et al.
Pubblicazione: (2024)
A Survey on Generative Modeling with Limited Data, Few Shots, and Zero Shot
di: Abdollahzadeh, Milad, et al.
Pubblicazione: (2023)
di: Abdollahzadeh, Milad, et al.
Pubblicazione: (2023)
Urban Air Temperature Prediction using Conditional Diffusion Models
di: Dai, Siyang, et al.
Pubblicazione: (2024)
di: Dai, Siyang, et al.
Pubblicazione: (2024)
Joint Architecture-Token-Bitwidth Multi-Axis Optimization of Vision Transformers for Semiconductor IC Packaging
di: Nguyen, Phat, et al.
Pubblicazione: (2026)
di: Nguyen, Phat, et al.
Pubblicazione: (2026)
Controllable Generation with Text-to-Image Diffusion Models: A Survey
di: Cao, Pu, et al.
Pubblicazione: (2024)
di: Cao, Pu, et al.
Pubblicazione: (2024)
Text2Traffic: A Text-to-Image Generation and Editing Method for Traffic Scenes
di: Lv, Feng, et al.
Pubblicazione: (2025)
di: Lv, Feng, et al.
Pubblicazione: (2025)
UM-Text: A Unified Multimodal Model for Image Understanding and Visual Text Editing
di: Ma, Lichen, et al.
Pubblicazione: (2026)
di: Ma, Lichen, et al.
Pubblicazione: (2026)
TIE: Revolutionizing Text-based Image Editing for Complex-Prompt Following and High-Fidelity Editing
di: Zhang, Xinyu, et al.
Pubblicazione: (2024)
di: Zhang, Xinyu, et al.
Pubblicazione: (2024)
AdapEdit: Spatio-Temporal Guided Adaptive Editing Algorithm for Text-Based Continuity-Sensitive Image Editing
di: Ma, Zhiyuan, et al.
Pubblicazione: (2023)
di: Ma, Zhiyuan, et al.
Pubblicazione: (2023)
How Control Information Influences Multilingual Text Image Generation and Editing?
di: Zhang, Boqiang, et al.
Pubblicazione: (2024)
di: Zhang, Boqiang, et al.
Pubblicazione: (2024)
ScribbleEdit: Synthetic Data for Image Editing with Scribbles and Text
di: Ji, Anya, et al.
Pubblicazione: (2026)
di: Ji, Anya, et al.
Pubblicazione: (2026)
Text-RSIR: A Text-Guided Framework for Efficient Remote Sensing Image Transmission and Reconstruction
di: Yang, Hao, et al.
Pubblicazione: (2026)
di: Yang, Hao, et al.
Pubblicazione: (2026)
How Do Medical MLLMs Fail? A Study on Visual Grounding in Medical Images
di: Liu, Guimeng, et al.
Pubblicazione: (2026)
di: Liu, Guimeng, et al.
Pubblicazione: (2026)
Talk2Image: A Multi-Agent System for Multi-Turn Image Generation and Editing
di: Ma, Shichao, et al.
Pubblicazione: (2025)
di: Ma, Shichao, et al.
Pubblicazione: (2025)
UTDesign: A Unified Framework for Stylized Text Editing and Generation in Graphic Design Images
di: Zhao, Yiming, et al.
Pubblicazione: (2025)
di: Zhao, Yiming, et al.
Pubblicazione: (2025)
Diffusion Model-Based Image Editing: A Survey
di: Huang, Yi, et al.
Pubblicazione: (2024)
di: Huang, Yi, et al.
Pubblicazione: (2024)
AnyText: Multilingual Visual Text Generation And Editing
di: Tuo, Yuxiang, et al.
Pubblicazione: (2023)
di: Tuo, Yuxiang, et al.
Pubblicazione: (2023)
Omni-3DEdit: Generalized Versatile 3D Editing in One-Pass
di: Liyi, Chen, et al.
Pubblicazione: (2026)
di: Liyi, Chen, et al.
Pubblicazione: (2026)
Prompt-Softbox-Prompt: A Free-Text Embedding Control for Image Editing
di: Yang, Yitong, et al.
Pubblicazione: (2024)
di: Yang, Yitong, et al.
Pubblicazione: (2024)
Move and Act: Enhanced Object Manipulation and Background Integrity for Image Editing
di: Jiang, Pengfei, et al.
Pubblicazione: (2024)
di: Jiang, Pengfei, et al.
Pubblicazione: (2024)
LocInv: Localization-aware Inversion for Text-Guided Image Editing
di: Tang, Chuanming, et al.
Pubblicazione: (2024)
di: Tang, Chuanming, et al.
Pubblicazione: (2024)
Towards Sustainable Universal Deepfake Detection with Frequency-Domain Masking
di: Doloriel, Chandler Timm C., et al.
Pubblicazione: (2025)
di: Doloriel, Chandler Timm C., et al.
Pubblicazione: (2025)
SGEdit: Bridging LLM with Text2Image Generative Model for Scene Graph-based Image Editing
di: Zhang, Zhiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Zhiyuan, et al.
Pubblicazione: (2024)
Neural-Driven Image Editing
di: Zhou, Pengfei, et al.
Pubblicazione: (2025)
di: Zhou, Pengfei, et al.
Pubblicazione: (2025)
RSEdit: Text-Guided Image Editing for Remote Sensing
di: Zhenyuan, Chen, et al.
Pubblicazione: (2026)
di: Zhenyuan, Chen, et al.
Pubblicazione: (2026)
TPIE: Topology-Preserved Image Editing With Text Instructions
di: Jayakumar, Nivetha, et al.
Pubblicazione: (2024)
di: Jayakumar, Nivetha, et al.
Pubblicazione: (2024)
GIE-Bench: Towards Grounded Evaluation for Text-Guided Image Editing
di: Qian, Yusu, et al.
Pubblicazione: (2025)
di: Qian, Yusu, et al.
Pubblicazione: (2025)
Lightning-Fast Image Inversion and Editing for Text-to-Image Diffusion Models
di: Samuel, Dvir, et al.
Pubblicazione: (2023)
di: Samuel, Dvir, et al.
Pubblicazione: (2023)
Exploring Text-Guided Single Image Editing for Remote Sensing Images
di: Han, Fangzhou, et al.
Pubblicazione: (2024)
di: Han, Fangzhou, et al.
Pubblicazione: (2024)
Generative Visual Chain-of-Thought for Image Editing
di: Yin, Zijin, et al.
Pubblicazione: (2026)
di: Yin, Zijin, et al.
Pubblicazione: (2026)
A Survey on 3D Gaussian Splatting Applications: Segmentation, Editing, and Generation
di: He, Shuting, et al.
Pubblicazione: (2025)
di: He, Shuting, et al.
Pubblicazione: (2025)
LongT2IBench: A Benchmark for Evaluating Long Text-to-Image Generation with Graph-structured Annotations
di: Yang, Zhichao, et al.
Pubblicazione: (2025)
di: Yang, Zhichao, et al.
Pubblicazione: (2025)
AnyText2: Visual Text Generation and Editing With Customizable Attributes
di: Tuo, Yuxiang, et al.
Pubblicazione: (2024)
di: Tuo, Yuxiang, et al.
Pubblicazione: (2024)
Both Semantics and Reconstruction Matter: Making Representation Encoders Ready for Text-to-Image Generation and Editing
di: Zhang, Shilong, et al.
Pubblicazione: (2025)
di: Zhang, Shilong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
FairQueue: Rethinking Prompt Learning for Fair Text-to-Image Generation
di: Teo, Christopher T. H, et al.
Pubblicazione: (2024) -
Token Compression Meets Compact Vision Transformers: A Survey and Comparative Evaluation for Edge AI
di: Nguyen, Phat, et al.
Pubblicazione: (2025) -
On the Adversarial Robustness of 3D Large Vision-Language Models
di: Liu, Chao, et al.
Pubblicazione: (2026) -
AIR: Zero-shot Generative Model Adaptation with Iterative Refinement
di: Liu, Guimeng, et al.
Pubblicazione: (2025) -
A Survey of Multimodal-Guided Image Editing with Text-to-Image Diffusion Models
di: Shuai, Xincheng, et al.
Pubblicazione: (2024)