TalkPhoto: A Versatile Training-Free Conversational Assistant for Intelligent Image Editing
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Hu, Yujie, Tang, Zecheng, Jiang, Xu, Li, Weiqi, Zhang, Jian |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model
von: Hu, Yujie, et al.
Veröffentlicht: (2025)
von: Hu, Yujie, et al.
Veröffentlicht: (2025)
OmniGuard: Hybrid Manipulation Localization via Augmented Versatile Deep Image Watermarking
von: Zhang, Xuanyu, et al.
Veröffentlicht: (2024)
von: Zhang, Xuanyu, et al.
Veröffentlicht: (2024)
Differential Coding for Training-Free ANN-to-SNN Conversion
von: Huang, Zihan, et al.
Veröffentlicht: (2025)
von: Huang, Zihan, et al.
Veröffentlicht: (2025)
KV-Edit: Training-Free Image Editing for Precise Background Preservation
von: Zhu, Tianrui, et al.
Veröffentlicht: (2025)
von: Zhu, Tianrui, et al.
Veröffentlicht: (2025)
VeloEdit: Training-Free Consistent and Continuous Instruction-Based Image Editing via Velocity Field Decomposition
von: Li, Zongqing, et al.
Veröffentlicht: (2026)
von: Li, Zongqing, et al.
Veröffentlicht: (2026)
V2A-Mark: Versatile Deep Visual-Audio Watermarking for Manipulation Localization and Copyright Protection
von: Zhang, Xuanyu, et al.
Veröffentlicht: (2024)
von: Zhang, Xuanyu, et al.
Veröffentlicht: (2024)
Unveil Inversion and Invariance in Flow Transformer for Versatile Image Editing
von: Xu, Pengcheng, et al.
Veröffentlicht: (2024)
von: Xu, Pengcheng, et al.
Veröffentlicht: (2024)
SmartPhotoCrafter: Unified Reasoning, Generation and Optimization for Automatic Photographic Image Editing
von: Zeng, Ying, et al.
Veröffentlicht: (2026)
von: Zeng, Ying, et al.
Veröffentlicht: (2026)
PixWizard: Versatile Image-to-Image Visual Assistant with Open-Language Instructions
von: Lin, Weifeng, et al.
Veröffentlicht: (2024)
von: Lin, Weifeng, et al.
Veröffentlicht: (2024)
Reversible Inversion for Training-Free Exemplar-guided Image Editing
von: Li, Yuke, et al.
Veröffentlicht: (2025)
von: Li, Yuke, et al.
Veröffentlicht: (2025)
Training-Free Multi-Concept Image Editing
von: Foteinopoulou, Niki, et al.
Veröffentlicht: (2026)
von: Foteinopoulou, Niki, et al.
Veröffentlicht: (2026)
Training-Free Image Editing with Visual Context Integration and Concept Alignment
von: Song, Rui, et al.
Veröffentlicht: (2026)
von: Song, Rui, et al.
Veröffentlicht: (2026)
VS-Assistant: Versatile Surgery Assistant on the Demand of Surgeons
von: Chen, Zhen, et al.
Veröffentlicht: (2024)
von: Chen, Zhen, et al.
Veröffentlicht: (2024)
AnyDesign: Versatile Area Fashion Editing via Mask-Free Diffusion
von: Niu, Yunfang, et al.
Veröffentlicht: (2024)
von: Niu, Yunfang, et al.
Veröffentlicht: (2024)
AgriDoctor: A Multimodal Intelligent Assistant for Agriculture
von: Zhang, Mingqing, et al.
Veröffentlicht: (2025)
von: Zhang, Mingqing, et al.
Veröffentlicht: (2025)
Towards Training-Free Scene Text Editing
von: Li, Yubo, et al.
Veröffentlicht: (2026)
von: Li, Yubo, et al.
Veröffentlicht: (2026)
MIND-Edit: MLLM Insight-Driven Editing via Language-Vision Projection
von: Wang, Shuyu, et al.
Veröffentlicht: (2025)
von: Wang, Shuyu, et al.
Veröffentlicht: (2025)
Versatile Editing of Video Content, Actions, and Dynamics without Training
von: Kulikov, Vladimir, et al.
Veröffentlicht: (2026)
von: Kulikov, Vladimir, et al.
Veröffentlicht: (2026)
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
von: Wang, Yufei, et al.
Veröffentlicht: (2025)
von: Wang, Yufei, et al.
Veröffentlicht: (2025)
Exploiting Unlabeled Structures through Task Consistency Training for Versatile Medical Image Segmentation
von: Zhu, Shengqian, et al.
Veröffentlicht: (2025)
von: Zhu, Shengqian, et al.
Veröffentlicht: (2025)
SimuFreeMark: A Noise-Simulation-Free Robust Watermarking Against Image Editing
von: Tang, Yichao, et al.
Veröffentlicht: (2025)
von: Tang, Yichao, et al.
Veröffentlicht: (2025)
Dynamic Motion Blending for Versatile Motion Editing
von: Jiang, Nan, et al.
Veröffentlicht: (2025)
von: Jiang, Nan, et al.
Veröffentlicht: (2025)
From Competition to Coopetition: Coopetitive Training-Free Image Editing Based on Text Guidance
von: Shen, Jinhao, et al.
Veröffentlicht: (2026)
von: Shen, Jinhao, et al.
Veröffentlicht: (2026)
Composed Image Retrieval for Training-Free Domain Conversion
von: Efthymiadis, Nikos, et al.
Veröffentlicht: (2024)
von: Efthymiadis, Nikos, et al.
Veröffentlicht: (2024)
Anchor Token Matching: Implicit Structure Locking for Training-free AR Image Editing
von: Hu, Taihang, et al.
Veröffentlicht: (2025)
von: Hu, Taihang, et al.
Veröffentlicht: (2025)
FakeShield: Explainable Image Forgery Detection and Localization via Multi-modal Large Language Models
von: Xu, Zhipei, et al.
Veröffentlicht: (2024)
von: Xu, Zhipei, et al.
Veröffentlicht: (2024)
An Item is Worth a Prompt: Versatile Image Editing with Disentangled Control
von: Feng, Aosong, et al.
Veröffentlicht: (2024)
von: Feng, Aosong, et al.
Veröffentlicht: (2024)
AttnRouter: Per-Category Attention Routing for Training-Free Image Editing on MMDiT
von: Li, Guandong, et al.
Veröffentlicht: (2026)
von: Li, Guandong, et al.
Veröffentlicht: (2026)
FastEdit: Fast Text-Guided Single-Image Editing via Semantic-Aware Diffusion Fine-Tuning
von: Chen, Zhi, et al.
Veröffentlicht: (2024)
von: Chen, Zhi, et al.
Veröffentlicht: (2024)
FreeFlux: Understanding and Exploiting Layer-Specific Roles in RoPE-Based MMDiT for Versatile Image Editing
von: Wei, Tianyi, et al.
Veröffentlicht: (2025)
von: Wei, Tianyi, et al.
Veröffentlicht: (2025)
GIDE: Unlocking Diffusion LLMs for Precise Training-Free Image Editing
von: Zhu, Zifeng, et al.
Veröffentlicht: (2026)
von: Zhu, Zifeng, et al.
Veröffentlicht: (2026)
TAMEing Long Contexts in Personalization: Towards Training-Free and State-Aware MLLM Personalized Assistant
von: Hong, Rongpei, et al.
Veröffentlicht: (2025)
von: Hong, Rongpei, et al.
Veröffentlicht: (2025)
DynaDrag: Dynamic Drag-Style Image Editing by Motion Prediction
von: Sui, Jiacheng, et al.
Veröffentlicht: (2026)
von: Sui, Jiacheng, et al.
Veröffentlicht: (2026)
KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models
von: Wu, Yongliang, et al.
Veröffentlicht: (2025)
von: Wu, Yongliang, et al.
Veröffentlicht: (2025)
FusionEdit: Semantic Fusion and Attention Modulation for Training-Free Image Editing
von: Lai, Yongwen, et al.
Veröffentlicht: (2026)
von: Lai, Yongwen, et al.
Veröffentlicht: (2026)
Dual-Schedule Inversion: Training- and Tuning-Free Inversion for Real Image Editing
von: Huang, Jiancheng, et al.
Veröffentlicht: (2024)
von: Huang, Jiancheng, et al.
Veröffentlicht: (2024)
FlowBypass: Rectified Flow Trajectory Bypass for Training-Free Image Editing
von: Han, Menglin, et al.
Veröffentlicht: (2026)
von: Han, Menglin, et al.
Veröffentlicht: (2026)
SpecEdit: Training-Free Acceleration for Diffusion based Image Editing via Semantic Locking
von: Yan, Zhengan, et al.
Veröffentlicht: (2026)
von: Yan, Zhengan, et al.
Veröffentlicht: (2026)
PhotoDoodle: Learning Artistic Image Editing from Few-Shot Pairwise Data
von: Huang, Shijie, et al.
Veröffentlicht: (2025)
von: Huang, Shijie, et al.
Veröffentlicht: (2025)
ComfyUI-Copilot: An Intelligent Assistant for Automated Workflow Development
von: Xu, Zhenran, et al.
Veröffentlicht: (2025)
von: Xu, Zhenran, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
TalkFashion: Intelligent Virtual Try-On Assistant Based on Multimodal Large Language Model
von: Hu, Yujie, et al.
Veröffentlicht: (2025) -
OmniGuard: Hybrid Manipulation Localization via Augmented Versatile Deep Image Watermarking
von: Zhang, Xuanyu, et al.
Veröffentlicht: (2024) -
Differential Coding for Training-Free ANN-to-SNN Conversion
von: Huang, Zihan, et al.
Veröffentlicht: (2025) -
KV-Edit: Training-Free Image Editing for Precise Background Preservation
von: Zhu, Tianrui, et al.
Veröffentlicht: (2025) -
VeloEdit: Training-Free Consistent and Continuous Instruction-Based Image Editing via Velocity Field Decomposition
von: Li, Zongqing, et al.
Veröffentlicht: (2026)