StarFT: Robust Fine-tuning of Zero-shot Models via Spuriosity Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Younghyun, Jeong, Jongheon, Kwak, Sangkyung, Lee, Kyungmin, Lee, Juho, Shin, Jinwoo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Direct Consistency Optimization for Robust Customization of Text-to-Image Diffusion Models
par: Lee, Kyungmin, et autres
Publié: (2024)
par: Lee, Kyungmin, et autres
Publié: (2024)
Improving Diffusion Models for Authentic Virtual Try-on in the Wild
par: Choi, Yisol, et autres
Publié: (2024)
par: Choi, Yisol, et autres
Publié: (2024)
Confidence-aware Denoised Fine-tuning of Off-the-shelf Models for Certified Robustness
par: Jang, Suhyeok, et autres
Publié: (2024)
par: Jang, Suhyeok, et autres
Publié: (2024)
Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think
par: Yu, Sihyun, et autres
Publié: (2024)
par: Yu, Sihyun, et autres
Publié: (2024)
Safety Alignment Backfires: Preventing the Re-emergence of Suppressed Concepts in Fine-tuned Text-to-Image Diffusion Models
par: Kim, Sanghyun, et autres
Publié: (2024)
par: Kim, Sanghyun, et autres
Publié: (2024)
DiffusionGuard: A Robust Defense Against Malicious Diffusion-based Image Editing
par: Choi, June Suk, et autres
Publié: (2024)
par: Choi, June Suk, et autres
Publié: (2024)
Efficient and Versatile Robust Fine-Tuning of Zero-shot Models
par: Kim, Sungyeon, et autres
Publié: (2024)
par: Kim, Sungyeon, et autres
Publié: (2024)
Discovering and Mitigating Visual Biases through Keyword Explanation
par: Kim, Younghyun, et autres
Publié: (2023)
par: Kim, Younghyun, et autres
Publié: (2023)
Lipsum-FT: Robust Fine-Tuning of Zero-Shot Models Using Random Text Guidance
par: Nam, Giung, et autres
Publié: (2024)
par: Nam, Giung, et autres
Publié: (2024)
Adversarial Robustification via Text-to-Image Diffusion Models
par: Choi, Daewon, et autres
Publié: (2024)
par: Choi, Daewon, et autres
Publié: (2024)
Decoupled MeanFlow: Turning Flow Models into Flow Maps for Accelerated Sampling
par: Lee, Kyungmin, et autres
Publié: (2025)
par: Lee, Kyungmin, et autres
Publié: (2025)
FontAdapter: Instant Font Adaptation in Visual Text Generation
par: Koo, Myungkyu, et autres
Publié: (2025)
par: Koo, Myungkyu, et autres
Publié: (2025)
Controllable Human Image Generation with Personalized Multi-Garments
par: Choi, Yisol, et autres
Publié: (2024)
par: Choi, Yisol, et autres
Publié: (2024)
DreamFlow: High-Quality Text-to-3D Generation by Approximating Probability Flow
par: Lee, Kyungmin, et autres
Publié: (2024)
par: Lee, Kyungmin, et autres
Publié: (2024)
Robust Fine-tuning of Zero-shot Models via Variance Reduction
par: Zhu, Beier, et autres
Publié: (2024)
par: Zhu, Beier, et autres
Publié: (2024)
Dual-Stream Diffusion for World-Model Augmented Vision-Language-Action Model
par: Won, John, et autres
Publié: (2025)
par: Won, John, et autres
Publié: (2025)
Improving Motion in Image-to-Video Models via Adaptive Low-Pass Guidance
par: Choi, June Suk, et autres
Publié: (2025)
par: Choi, June Suk, et autres
Publié: (2025)
Accelerating Image Super-Resolution Networks with Pixel-Level Classification
par: Jeong, Jinho, et autres
Publié: (2024)
par: Jeong, Jinho, et autres
Publié: (2024)
SynQ: Accurate Zero-shot Quantization by Synthesis-aware Fine-tuning
par: Kim, Minjun, et autres
Publié: (2026)
par: Kim, Minjun, et autres
Publié: (2026)
Confidence-aware Reward Optimization for Fine-tuning Text-to-Image Models
par: Kim, Kyuyoung, et autres
Publié: (2024)
par: Kim, Kyuyoung, et autres
Publié: (2024)
HAMLET: Switch your Vision-Language-Action Model into a History-Aware Policy
par: Koo, Myungkyu, et autres
Publié: (2025)
par: Koo, Myungkyu, et autres
Publié: (2025)
Safeguard Text-to-Image Diffusion Models with Human Feedback Inversion
par: Kim, Sanghyun, et autres
Publié: (2024)
par: Kim, Sanghyun, et autres
Publié: (2024)
LVMark: Robust Watermark for Latent Video Diffusion Models
par: Jang, MinHyuk, et autres
Publié: (2024)
par: Jang, MinHyuk, et autres
Publié: (2024)
WaTeRFlow: Watermark Temporal Robustness via Flow Consistency
par: Jeong, Utae, et autres
Publié: (2025)
par: Jeong, Utae, et autres
Publié: (2025)
Zero-shot Depth Completion via Test-time Alignment with Affine-invariant Depth Prior
par: Hyoseok, Lee, et autres
Publié: (2025)
par: Hyoseok, Lee, et autres
Publié: (2025)
Fine-tuning Multimodal LLMs to Follow Zero-shot Demonstrative Instructions
par: Li, Juncheng, et autres
Publié: (2023)
par: Li, Juncheng, et autres
Publié: (2023)
PoseBridge: Bridging the Skeletonization Gap for Zero-Shot Skeleton-Based Action Recognition
par: Lee, Sanghyeon, et autres
Publié: (2026)
par: Lee, Sanghyeon, et autres
Publié: (2026)
AutoFT: Learning an Objective for Robust Fine-Tuning
par: Choi, Caroline, et autres
Publié: (2024)
par: Choi, Caroline, et autres
Publié: (2024)
ShortFT: Diffusion Model Alignment via Shortcut-based Fine-Tuning
par: Guo, Xiefan, et autres
Publié: (2025)
par: Guo, Xiefan, et autres
Publié: (2025)
GroupCoOp: Group-robust Fine-tuning via Group Prompt Learning
par: Kim, Nayeong, et autres
Publié: (2025)
par: Kim, Nayeong, et autres
Publié: (2025)
Vision-aligned Latent Reasoning for Multi-modal Large Language Model
par: Jeon, Byungwoo, et autres
Publié: (2026)
par: Jeon, Byungwoo, et autres
Publié: (2026)
Restoration-Aligned Generative Flow Models for Blind Motion Deblurring
par: Kim, Insoo, et autres
Publié: (2026)
par: Kim, Insoo, et autres
Publié: (2026)
Margin-aware Preference Optimization for Aligning Diffusion Models without Reference
par: Hong, Jiwoo, et autres
Publié: (2024)
par: Hong, Jiwoo, et autres
Publié: (2024)
Visual Question Answering Instruction: Unlocking Multimodal Large Language Model To Domain-Specific Visual Multitasks
par: Lee, Jusung, et autres
Publié: (2024)
par: Lee, Jusung, et autres
Publié: (2024)
Curriculum Fine-tuning of Vision Foundation Model for Medical Image Classification Under Label Noise
par: Yu, Yeonguk, et autres
Publié: (2024)
par: Yu, Yeonguk, et autres
Publié: (2024)
Modality-Aware Representation Learning for Zero-shot Sketch-based Image Retrieval
par: Lyou, Eunyi, et autres
Publié: (2024)
par: Lyou, Eunyi, et autres
Publié: (2024)
BlurGuard: A Simple Approach for Robustifying Image Protection Against AI-Powered Editing
par: Kim, Jinsu, et autres
Publié: (2025)
par: Kim, Jinsu, et autres
Publié: (2025)
SWiFT: Soft-Mask Weight Fine-tuning for Bias Mitigation
par: Yan, Junyu, et autres
Publié: (2025)
par: Yan, Junyu, et autres
Publié: (2025)
FaceShield: Defending Facial Image against Deepfake Threats
par: Jeong, Jaehwan, et autres
Publié: (2024)
par: Jeong, Jaehwan, et autres
Publié: (2024)
NVS-Adapter: Plug-and-Play Novel View Synthesis from a Single Image
par: Jeong, Yoonwoo, et autres
Publié: (2023)
par: Jeong, Yoonwoo, et autres
Publié: (2023)
Documents similaires
-
Direct Consistency Optimization for Robust Customization of Text-to-Image Diffusion Models
par: Lee, Kyungmin, et autres
Publié: (2024) -
Improving Diffusion Models for Authentic Virtual Try-on in the Wild
par: Choi, Yisol, et autres
Publié: (2024) -
Confidence-aware Denoised Fine-tuning of Off-the-shelf Models for Certified Robustness
par: Jang, Suhyeok, et autres
Publié: (2024) -
Representation Alignment for Generation: Training Diffusion Transformers Is Easier Than You Think
par: Yu, Sihyun, et autres
Publié: (2024) -
Safety Alignment Backfires: Preventing the Re-emergence of Suppressed Concepts in Fine-tuned Text-to-Image Diffusion Models
par: Kim, Sanghyun, et autres
Publié: (2024)