LEAST: "Local" text-conditioned image style transfer
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Singh, Silky, Jandial, Surgan, Shahid, Simra, Java, Abhinav |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ReEdit: Multimodal Exemplar-Based Image Editing with Diffusion Models
par: Srivastava, Ashutosh, et autres
Publié: (2024)
par: Srivastava, Ashutosh, et autres
Publié: (2024)
Towards Efficient Exemplar Based Image Editing with Multimodal VLMs
par: Jadhav, Avadhoot, et autres
Publié: (2025)
par: Jadhav, Avadhoot, et autres
Publié: (2025)
S2H-DPO: Hardness-Aware Preference Optimization for Vision-Language Models
par: Shukla, Nitish, et autres
Publié: (2026)
par: Shukla, Nitish, et autres
Publié: (2026)
Thinking Fair and Slow: On the Efficacy of Structured Prompts for Debiasing Language Models
par: Furniturewala, Shaz, et autres
Publié: (2024)
par: Furniturewala, Shaz, et autres
Publié: (2024)
Towards Operationalizing Right to Data Protection
par: Java, Abhinav, et autres
Publié: (2024)
par: Java, Abhinav, et autres
Publié: (2024)
Understanding Task Transfer in Vision-Language Models
par: Sachdeva, Bhuvan, et autres
Publié: (2025)
par: Sachdeva, Bhuvan, et autres
Publié: (2025)
Artistic-style text detector and a new Movie-Poster dataset
par: Ning, Aoxiang, et autres
Publié: (2024)
par: Ning, Aoxiang, et autres
Publié: (2024)
Procedural terrain generation with style transfer
par: Merizzi, Fabio
Publié: (2024)
par: Merizzi, Fabio
Publié: (2024)
Multiscale style transfer based on a Laplacian pyramid for traditional Chinese painting
par: Liu, Kunxiao, et autres
Publié: (2025)
par: Liu, Kunxiao, et autres
Publié: (2025)
On dataset transferability in medical image classification
par: Juodelyte, Dovile, et autres
Publié: (2024)
par: Juodelyte, Dovile, et autres
Publié: (2024)
Stylized Meta-Album: Group-bias injection with style transfer to study robustness against distribution shifts
par: Mussard, Romain, et autres
Publié: (2025)
par: Mussard, Romain, et autres
Publié: (2025)
Exploring text-to-image generation for historical document image retrieval
par: Cote, Melissa, et autres
Publié: (2025)
par: Cote, Melissa, et autres
Publié: (2025)
Does resistance to style-transfer equal Global Shape Bias? Measuring network sensitivity to global shape configuration
par: Wen, Ziqi, et autres
Publié: (2023)
par: Wen, Ziqi, et autres
Publié: (2023)
Learning text-to-video retrieval from image captioning
par: Ventura, Lucas, et autres
Publié: (2024)
par: Ventura, Lucas, et autres
Publié: (2024)
Hyper-parameter tuning for text guided image editing
par: Zhang, Shiwen
Publié: (2024)
par: Zhang, Shiwen
Publié: (2024)
The persistence of painting styles
par: Munnangi, Reetikaa Reddy, et autres
Publié: (2025)
par: Munnangi, Reetikaa Reddy, et autres
Publié: (2025)
Do text-free diffusion models learn discriminative visual representations?
par: Mukhopadhyay, Soumik, et autres
Publié: (2023)
par: Mukhopadhyay, Soumik, et autres
Publié: (2023)
Exploring scalable medical image encoders beyond text supervision
par: Pérez-García, Fernando, et autres
Publié: (2024)
par: Pérez-García, Fernando, et autres
Publié: (2024)
Efficient scene text image super-resolution with semantic guidance
par: TomyEnrique, LeoWu, et autres
Publié: (2024)
par: TomyEnrique, LeoWu, et autres
Publié: (2024)
Ranking-aware adapter for text-driven image ordering with CLIP
par: Yu, Wei-Hsiang, et autres
Publié: (2024)
par: Yu, Wei-Hsiang, et autres
Publié: (2024)
Consistent text-to-image generation via scene de-contextualization
par: Tang, Song, et autres
Publié: (2025)
par: Tang, Song, et autres
Publié: (2025)
IMMA: Immunizing text-to-image Models against Malicious Adaptation
par: Zheng, Amber Yijia, et autres
Publié: (2023)
par: Zheng, Amber Yijia, et autres
Publié: (2023)
CMRNext: Camera to LiDAR Matching in the Wild for Localization and Extrinsic Calibration
par: Cattaneo, Daniele, et autres
Publié: (2024)
par: Cattaneo, Daniele, et autres
Publié: (2024)
Visual question answering based evaluation metrics for text-to-image generation
par: Miyamoto, Mizuki, et autres
Publié: (2024)
par: Miyamoto, Mizuki, et autres
Publié: (2024)
Concept Corrector: Erase concepts on the fly for text-to-image diffusion models
par: Meng, Zheling, et autres
Publié: (2025)
par: Meng, Zheling, et autres
Publié: (2025)
IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation
par: Tiwari, Amritanshu, et autres
Publié: (2025)
par: Tiwari, Amritanshu, et autres
Publié: (2025)
Can language-guided unsupervised adaptation improve medical image classification using unpaired images and texts?
par: Rahman, Umaima, et autres
Publié: (2024)
par: Rahman, Umaima, et autres
Publié: (2024)
Architecture inside the mirage: evaluating generative image models on architectural style, elements, and typologies
par: Magrill, Jamie, et autres
Publié: (2026)
par: Magrill, Jamie, et autres
Publié: (2026)
Dark Miner: Defend against undesirable generation for text-to-image diffusion models
par: Meng, Zheling, et autres
Publié: (2024)
par: Meng, Zheling, et autres
Publié: (2024)
PointT2I: LLM-based text-to-image generation via keypoints
par: Lee, Taekyung, et autres
Publié: (2025)
par: Lee, Taekyung, et autres
Publié: (2025)
UPLiFT: Efficient Pixel-Dense Feature Upsampling with Local Attenders
par: Walmer, Matthew, et autres
Publié: (2026)
par: Walmer, Matthew, et autres
Publié: (2026)
Exploring connections of spectral analysis and transfer learning in medical imaging
par: Lu, Yucheng, et autres
Publié: (2024)
par: Lu, Yucheng, et autres
Publié: (2024)
Multi-style conversion for semantic segmentation of lesions in fundus images by adversarial attacks
par: Playout, Clément, et autres
Publié: (2024)
par: Playout, Clément, et autres
Publié: (2024)
A large-scale image-text dataset benchmark for farmland segmentation
par: Tao, Chao, et autres
Publié: (2025)
par: Tao, Chao, et autres
Publié: (2025)
Generalizing Monocular 3D Object Detection
par: Kumar, Abhinav
Publié: (2025)
par: Kumar, Abhinav
Publié: (2025)
RaLF: Flow-based Global and Metric Radar Localization in LiDAR Maps
par: Nayak, Abhijeet, et autres
Publié: (2023)
par: Nayak, Abhijeet, et autres
Publié: (2023)
Bio-inspired fine-tuning for selective transfer learning in image classification
par: Davila, Ana, et autres
Publié: (2026)
par: Davila, Ana, et autres
Publié: (2026)
TurboEdit: Instant text-based image editing
par: Wu, Zongze, et autres
Publié: (2024)
par: Wu, Zongze, et autres
Publié: (2024)
Trinity Detector:text-assisted and attention mechanisms based spectral fusion for diffusion generation image detection
par: Song, Jiawei, et autres
Publié: (2024)
par: Song, Jiawei, et autres
Publié: (2024)
MatSwap: Light-aware material transfers in images
par: Lopes, Ivan, et autres
Publié: (2025)
par: Lopes, Ivan, et autres
Publié: (2025)
Documents similaires
-
ReEdit: Multimodal Exemplar-Based Image Editing with Diffusion Models
par: Srivastava, Ashutosh, et autres
Publié: (2024) -
Towards Efficient Exemplar Based Image Editing with Multimodal VLMs
par: Jadhav, Avadhoot, et autres
Publié: (2025) -
S2H-DPO: Hardness-Aware Preference Optimization for Vision-Language Models
par: Shukla, Nitish, et autres
Publié: (2026) -
Thinking Fair and Slow: On the Efficacy of Structured Prompts for Debiasing Language Models
par: Furniturewala, Shaz, et autres
Publié: (2024) -
Towards Operationalizing Right to Data Protection
par: Java, Abhinav, et autres
Publié: (2024)