Hyper-parameter tuning for text guided image editing
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Zhang, Shiwen |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FLATTEN: optical FLow-guided ATTENtion for consistent text-to-video editing
par: Cong, Yuren, et autres
Publié: (2023)
par: Cong, Yuren, et autres
Publié: (2023)
TurboEdit: Instant text-based image editing
par: Wu, Zongze, et autres
Publié: (2024)
par: Wu, Zongze, et autres
Publié: (2024)
Action-based image editing guided by human instructions
par: Trusca, Maria Mihaela, et autres
Publié: (2024)
par: Trusca, Maria Mihaela, et autres
Publié: (2024)
Can language-guided unsupervised adaptation improve medical image classification using unpaired images and texts?
par: Rahman, Umaima, et autres
Publié: (2024)
par: Rahman, Umaima, et autres
Publié: (2024)
Semantic-guided Fine-tuning of Foundation Model for Long-tailed Visual Recognition
par: Peng, Yufei, et autres
Publié: (2025)
par: Peng, Yufei, et autres
Publié: (2025)
Borrowing from anything: A generalizable framework for reference-guided instance editing
par: Zhou, Shengxiao, et autres
Publié: (2025)
par: Zhou, Shengxiao, et autres
Publié: (2025)
Exploring text-to-image generation for historical document image retrieval
par: Cote, Melissa, et autres
Publié: (2025)
par: Cote, Melissa, et autres
Publié: (2025)
Consistent text-to-image generation via scene de-contextualization
par: Tang, Song, et autres
Publié: (2025)
par: Tang, Song, et autres
Publié: (2025)
Attention-guided Fine-tuning of Multimodal Large Language Models Improves Chain-of-Thought Reasoning
par: Sinha, Sanchit, et autres
Publié: (2026)
par: Sinha, Sanchit, et autres
Publié: (2026)
Learning text-to-video retrieval from image captioning
par: Ventura, Lucas, et autres
Publié: (2024)
par: Ventura, Lucas, et autres
Publié: (2024)
LEAST: "Local" text-conditioned image style transfer
par: Singh, Silky, et autres
Publié: (2024)
par: Singh, Silky, et autres
Publié: (2024)
Exploring scalable medical image encoders beyond text supervision
par: Pérez-García, Fernando, et autres
Publié: (2024)
par: Pérez-García, Fernando, et autres
Publié: (2024)
Efficient scene text image super-resolution with semantic guidance
par: TomyEnrique, LeoWu, et autres
Publié: (2024)
par: TomyEnrique, LeoWu, et autres
Publié: (2024)
Ranking-aware adapter for text-driven image ordering with CLIP
par: Yu, Wei-Hsiang, et autres
Publié: (2024)
par: Yu, Wei-Hsiang, et autres
Publié: (2024)
IMMA: Immunizing text-to-image Models against Malicious Adaptation
par: Zheng, Amber Yijia, et autres
Publié: (2023)
par: Zheng, Amber Yijia, et autres
Publié: (2023)
HyperGCT: A Dynamic Hyper-GNN-Learned Geometric Constraint for 3D Registration
par: Zhang, Xiyu, et autres
Publié: (2025)
par: Zhang, Xiyu, et autres
Publié: (2025)
Forgedit: Text Guided Image Editing via Learning and Forgetting
par: Zhang, Shiwen, et autres
Publié: (2023)
par: Zhang, Shiwen, et autres
Publié: (2023)
EvRainDrop: HyperGraph-guided Completion for Effective Frame and Event Stream Aggregation
par: Wang, Futian, et autres
Publié: (2025)
par: Wang, Futian, et autres
Publié: (2025)
Visual question answering based evaluation metrics for text-to-image generation
par: Miyamoto, Mizuki, et autres
Publié: (2024)
par: Miyamoto, Mizuki, et autres
Publié: (2024)
Concept Corrector: Erase concepts on the fly for text-to-image diffusion models
par: Meng, Zheling, et autres
Publié: (2025)
par: Meng, Zheling, et autres
Publié: (2025)
IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation
par: Tiwari, Amritanshu, et autres
Publié: (2025)
par: Tiwari, Amritanshu, et autres
Publié: (2025)
HyperDet: Generalizable Detection of Synthesized Images by Generating and Merging A Mixture of Hyper LoRAs
par: Cao, Huangsen, et autres
Publié: (2024)
par: Cao, Huangsen, et autres
Publié: (2024)
Rethink Sparse Signals for Pose-guided Text-to-image Generation
par: Xuan, Wenjie, et autres
Publié: (2025)
par: Xuan, Wenjie, et autres
Publié: (2025)
Trinity Detector:text-assisted and attention mechanisms based spectral fusion for diffusion generation image detection
par: Song, Jiawei, et autres
Publié: (2024)
par: Song, Jiawei, et autres
Publié: (2024)
Enriched text-guided variational multimodal knowledge distillation network (VMD) for automated diagnosis of plaque vulnerability in 3D carotid artery MRI
par: Cao, Bo, et autres
Publié: (2025)
par: Cao, Bo, et autres
Publié: (2025)
HyperGLM: HyperGraph for Video Scene Graph Generation and Anticipation
par: Nguyen, Trong-Thuan, et autres
Publié: (2024)
par: Nguyen, Trong-Thuan, et autres
Publié: (2024)
HyperSpaceX: Radial and Angular Exploration of HyperSpherical Dimensions
par: Chiranjeev, Chiranjeev, et autres
Publié: (2024)
par: Chiranjeev, Chiranjeev, et autres
Publié: (2024)
HyperHuman: Hyper-Realistic Human Generation with Latent Structural Diffusion
par: Liu, Xian, et autres
Publié: (2023)
par: Liu, Xian, et autres
Publié: (2023)
Dark Miner: Defend against undesirable generation for text-to-image diffusion models
par: Meng, Zheling, et autres
Publié: (2024)
par: Meng, Zheling, et autres
Publié: (2024)
PointT2I: LLM-based text-to-image generation via keypoints
par: Lee, Taekyung, et autres
Publié: (2025)
par: Lee, Taekyung, et autres
Publié: (2025)
HyperDiT: Hyper-Connected Transformers for High-Fidelity Pixel-Space Diffusion
par: He, Yu, et autres
Publié: (2026)
par: He, Yu, et autres
Publié: (2026)
Bio-inspired fine-tuning for selective transfer learning in image classification
par: Davila, Ana, et autres
Publié: (2026)
par: Davila, Ana, et autres
Publié: (2026)
QwenStyle: Content-Preserving Style Transfer with Qwen-Image-Edit
par: Zhang, Shiwen, et autres
Publié: (2026)
par: Zhang, Shiwen, et autres
Publié: (2026)
Exploring parameter-efficient fine-tuning (PEFT) of billion-parameter vision models with QLoRA and DoRA: insights into generalization for limited-data image classification under a 98:1 test-to-train regime
par: Yang, Haiyu, et autres
Publié: (2026)
par: Yang, Haiyu, et autres
Publié: (2026)
HyperDefect-YOLO: Enhance YOLO with HyperGraph Computation for Industrial Defect Detection
par: Zuo, Zuo, et autres
Publié: (2024)
par: Zuo, Zuo, et autres
Publié: (2024)
HyperSLICE: HyperBand optimized Spiral for Low-latency Interactive Cardiac Examination
par: Jaubert, Olivier, et autres
Publié: (2023)
par: Jaubert, Olivier, et autres
Publié: (2023)
Gaussian highpass guided image filtering
par: Zhao, Lei, et autres
Publié: (2025)
par: Zhao, Lei, et autres
Publié: (2025)
A large-scale image-text dataset benchmark for farmland segmentation
par: Tao, Chao, et autres
Publié: (2025)
par: Tao, Chao, et autres
Publié: (2025)
Hyper-Transformer for Amodal Completion
par: Gao, Jianxiong, et autres
Publié: (2024)
par: Gao, Jianxiong, et autres
Publié: (2024)
CDST: Color Disentangled Style Transfer for Universal Style Reference Customization
par: Zhang, Shiwen, et autres
Publié: (2025)
par: Zhang, Shiwen, et autres
Publié: (2025)
Documents similaires
-
FLATTEN: optical FLow-guided ATTENtion for consistent text-to-video editing
par: Cong, Yuren, et autres
Publié: (2023) -
TurboEdit: Instant text-based image editing
par: Wu, Zongze, et autres
Publié: (2024) -
Action-based image editing guided by human instructions
par: Trusca, Maria Mihaela, et autres
Publié: (2024) -
Can language-guided unsupervised adaptation improve medical image classification using unpaired images and texts?
par: Rahman, Umaima, et autres
Publié: (2024) -
Semantic-guided Fine-tuning of Foundation Model for Long-tailed Visual Recognition
par: Peng, Yufei, et autres
Publié: (2025)