Prompt-Driven Image Analysis with Multimodal Generative AI: Detection, Segmentation, Inpainting, and Interpretation
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Ahmad, Kaleem |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
COCO-Inpaint: A Benchmark for Detecting and Localizing Inpainting-Based Image Manipulations
par: Yan, Haozhen, et autres
Publié: (2025)
par: Yan, Haozhen, et autres
Publié: (2025)
Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation
par: Buburuzan, Alexandru
Publié: (2025)
par: Buburuzan, Alexandru
Publié: (2025)
Exploring Model Quantization in GenAI-based Image Inpainting and Detection of Arable Plants
par: Modak, Sourav, et autres
Publié: (2025)
par: Modak, Sourav, et autres
Publié: (2025)
AI-Generated Image Detectors Overrely on Global Artifacts: Evidence from Inpainting Exchange
par: Nebioglu, Elif, et autres
Publié: (2026)
par: Nebioglu, Elif, et autres
Publié: (2026)
Eyes on the Environment: AI-Driven Analysis for Fire and Smoke Classification, Segmentation, and Detection
par: Boroujeni, Sayed Pedram Haeri, et autres
Publié: (2025)
par: Boroujeni, Sayed Pedram Haeri, et autres
Publié: (2025)
MASTER: Multimodal Segmentation with Text Prompts
par: Liu, Fuyang, et autres
Publié: (2025)
par: Liu, Fuyang, et autres
Publié: (2025)
Assessing Image Inpainting via Re-Inpainting Self-Consistency Evaluation
par: Chen, Tianyi, et autres
Publié: (2024)
par: Chen, Tianyi, et autres
Publié: (2024)
Inpaint Biases: A Pathway to Accurate and Unbiased Image Generation
par: Myung, Jiyoon, et autres
Publié: (2024)
par: Myung, Jiyoon, et autres
Publié: (2024)
Quaternion Generative Adversarial Neural Networks and Applications to Color Image Inpainting
par: Wang, Duan, et autres
Publié: (2024)
par: Wang, Duan, et autres
Publié: (2024)
Zero-Shot Industrial Anomaly Segmentation with Image-Aware Prompt Generation
par: Park, SoYoung, et autres
Publié: (2025)
par: Park, SoYoung, et autres
Publié: (2025)
MiraGe: Multimodal Discriminative Representation Learning for Generalizable AI-Generated Image Detection
par: Shi, Kuo, et autres
Publié: (2025)
par: Shi, Kuo, et autres
Publié: (2025)
Medical SAM3: A Foundation Model for Universal Prompt-Driven Medical Image Segmentation
par: Jiang, Chongcong, et autres
Publié: (2026)
par: Jiang, Chongcong, et autres
Publié: (2026)
Face-MakeUp: Multimodal Facial Prompts for Text-to-Image Generation
par: Dai, Dawei, et autres
Publié: (2025)
par: Dai, Dawei, et autres
Publié: (2025)
ForgeryGPT: A Multimodal LLM for Interpretable Image Forgery Detection and Localization
par: Zhang, Fanrui, et autres
Publié: (2024)
par: Zhang, Fanrui, et autres
Publié: (2024)
Interpretable and Reliable Detection of AI-Generated Images via Grounded Reasoning in MLLMs
par: Ji, Yikun, et autres
Publié: (2025)
par: Ji, Yikun, et autres
Publié: (2025)
Hallucination Behavior in Multimodal LLMs Across Agricultural Image Interpretation and Generation Tasks
par: Ghose, Partho, et autres
Publié: (2026)
par: Ghose, Partho, et autres
Publié: (2026)
Deep Learning-Driven Multimodal Detection and Movement Analysis of Objects in Culinary
par: Ishat, Tahoshin Alam, et autres
Publié: (2025)
par: Ishat, Tahoshin Alam, et autres
Publié: (2025)
Fill in the ____ (a Diffusion-based Image Inpainting Pipeline)
par: Gebre, Eyoel, et autres
Publié: (2024)
par: Gebre, Eyoel, et autres
Publié: (2024)
3D-Consistent Image Inpainting with Diffusion Models
par: Antsfeld, Leonid, et autres
Publié: (2024)
par: Antsfeld, Leonid, et autres
Publié: (2024)
BrushEdit: All-In-One Image Inpainting and Editing
par: Li, Yaowei, et autres
Publié: (2024)
par: Li, Yaowei, et autres
Publié: (2024)
TV-SAM: Increasing Zero-Shot Segmentation Performance on Multimodal Medical Images Using GPT-4 Generated Descriptive Prompts Without Human Annotation
par: Jiang, Zekun, et autres
Publié: (2024)
par: Jiang, Zekun, et autres
Publié: (2024)
The SAM2-to-SAM3 Gap in the Segment Anything Model Family: Why Prompt-Based Expertise Fails in Concept-Driven Image Segmentation
par: Sapkota, Ranjan, et autres
Publié: (2025)
par: Sapkota, Ranjan, et autres
Publié: (2025)
Curriculum Prompting Foundation Models for Medical Image Segmentation
par: Zheng, Xiuqi, et autres
Publié: (2024)
par: Zheng, Xiuqi, et autres
Publié: (2024)
REVEAL: Reasoning-Enhanced Forensic Evidence Analysis for Explainable AI-Generated Image Detection
par: Cao, Huangsen, et autres
Publié: (2025)
par: Cao, Huangsen, et autres
Publié: (2025)
DreamPainter: Image Background Inpainting for E-commerce Scenarios
par: Zhao, Sijie, et autres
Publié: (2025)
par: Zhao, Sijie, et autres
Publié: (2025)
2D Gaussian Splatting with Semantic Alignment for Image Inpainting
par: Li, Hongyu, et autres
Publié: (2025)
par: Li, Hongyu, et autres
Publié: (2025)
Text-Guided Variational Image Generation for Industrial Anomaly Detection and Segmentation
par: Lee, Mingyu, et autres
Publié: (2024)
par: Lee, Mingyu, et autres
Publié: (2024)
Token-Efficient Multimodal Reasoning via Image Prompt Packaging
par: Choi, Joong Ho, et autres
Publié: (2026)
par: Choi, Joong Ho, et autres
Publié: (2026)
Prompt-CAM: Making Vision Transformers Interpretable for Fine-Grained Analysis
par: Chowdhury, Arpita, et autres
Publié: (2025)
par: Chowdhury, Arpita, et autres
Publié: (2025)
MIRAGE: Towards AI-Generated Image Detection in the Wild
par: Xia, Cheng, et autres
Publié: (2025)
par: Xia, Cheng, et autres
Publié: (2025)
Time-variant Image Inpainting via Interactive Distribution Transition Estimation
par: Xing, Yun, et autres
Publié: (2025)
par: Xing, Yun, et autres
Publié: (2025)
InpDiffusion: Image Inpainting Localization via Conditional Diffusion Models
par: Wang, Kai, et autres
Publié: (2025)
par: Wang, Kai, et autres
Publié: (2025)
Efficient Zero-Shot AI-Generated Image Detection
par: Sonoda, Ryosuke, et autres
Publié: (2026)
par: Sonoda, Ryosuke, et autres
Publié: (2026)
Paint by Inpaint: Learning to Add Image Objects by Removing Them First
par: Wasserman, Navve, et autres
Publié: (2024)
par: Wasserman, Navve, et autres
Publié: (2024)
DinoLizer: Learning from the Best for Generative Inpainting Localization
par: Doi, Minh Thong, et autres
Publié: (2025)
par: Doi, Minh Thong, et autres
Publié: (2025)
Evaluating the Clinical Impact of Generative Inpainting on Bone Age Estimation
par: Matsuoka, Felipe Akio, et autres
Publié: (2025)
par: Matsuoka, Felipe Akio, et autres
Publié: (2025)
The Fabrication of Reality and Fantasy: Scene Generation with LLM-Assisted Prompt Interpretation
par: Yao, Yi, et autres
Publié: (2024)
par: Yao, Yi, et autres
Publié: (2024)
TP-UNet: Temporal Prompt Guided UNet for Medical Image Segmentation
par: Wang, Ranmin, et autres
Publié: (2024)
par: Wang, Ranmin, et autres
Publié: (2024)
RU-AI: A Large Multimodal Dataset for Machine-Generated Content Detection
par: Huang, Liting, et autres
Publié: (2024)
par: Huang, Liting, et autres
Publié: (2024)
MAGIC: Few-Shot Mask-Guided Anomaly Inpainting with Prompt Perturbation, Spatially Adaptive Guidance, and Context Awareness
par: Choi, JaeHyuck, et autres
Publié: (2025)
par: Choi, JaeHyuck, et autres
Publié: (2025)
Documents similaires
-
COCO-Inpaint: A Benchmark for Detecting and Localizing Inpainting-Based Image Manipulations
par: Yan, Haozhen, et autres
Publié: (2025) -
Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation
par: Buburuzan, Alexandru
Publié: (2025) -
Exploring Model Quantization in GenAI-based Image Inpainting and Detection of Arable Plants
par: Modak, Sourav, et autres
Publié: (2025) -
AI-Generated Image Detectors Overrely on Global Artifacts: Evidence from Inpainting Exchange
par: Nebioglu, Elif, et autres
Publié: (2026) -
Eyes on the Environment: AI-Driven Analysis for Fire and Smoke Classification, Segmentation, and Detection
par: Boroujeni, Sayed Pedram Haeri, et autres
Publié: (2025)