CLIP-VQDiffusion : Langauge Free Training of Text To Image generation using CLIP and vector quantized diffusion model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Han, Seungdae, Kim, Joohee |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ComCLIP: Training-Free Compositional Image and Text Matching
par: Jiang, Kenan, et autres
Publié: (2022)
par: Jiang, Kenan, et autres
Publié: (2022)
Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP
par: Li, Yayuan, et autres
Publié: (2024)
par: Li, Yayuan, et autres
Publié: (2024)
Extending CLIP's Image-Text Alignment to Referring Image Segmentation
par: Kim, Seoyeon, et autres
Publié: (2023)
par: Kim, Seoyeon, et autres
Publié: (2023)
Long-CLIP: Unlocking the Long-Text Capability of CLIP
par: Zhang, Beichen, et autres
Publié: (2024)
par: Zhang, Beichen, et autres
Publié: (2024)
Self-Calibrated CLIP for Training-Free Open-Vocabulary Segmentation
par: Bai, Sule, et autres
Publié: (2024)
par: Bai, Sule, et autres
Publié: (2024)
ABE-CLIP: Training-Free Attribute Binding Enhancement for Compositional Image-Text Matching
par: Zhang, Qi, et autres
Publié: (2025)
par: Zhang, Qi, et autres
Publié: (2025)
VTD-CLIP: Video-to-Text Discretization via Prompting CLIP
par: Zhu, Wencheng, et autres
Publié: (2025)
par: Zhu, Wencheng, et autres
Publié: (2025)
Raising the Bar of AI-generated Image Detection with CLIP
par: Cozzolino, Davide, et autres
Publié: (2023)
par: Cozzolino, Davide, et autres
Publié: (2023)
CLIP-IT: CLIP-based Pairing for Histology Images Classification
par: Karimian, Banafsheh, et autres
Publié: (2025)
par: Karimian, Banafsheh, et autres
Publié: (2025)
Text-to-Image Generation Via Energy-Based CLIP
par: Ganz, Roy, et autres
Publié: (2024)
par: Ganz, Roy, et autres
Publié: (2024)
DetailCLIP: Injecting Image Details into CLIP's Feature Space
par: Zhang, Zilun, et autres
Publié: (2022)
par: Zhang, Zilun, et autres
Publié: (2022)
Exploring the Adversarial Robustness of CLIP for AI-generated Image Detection
par: De Rosa, Vincenzo, et autres
Publié: (2024)
par: De Rosa, Vincenzo, et autres
Publié: (2024)
CLIP-KD: An Empirical Study of CLIP Model Distillation
par: Yang, Chuanguang, et autres
Publié: (2023)
par: Yang, Chuanguang, et autres
Publié: (2023)
HQ-CLIP: Leveraging Large Vision-Language Models to Create High-Quality Image-Text Datasets and CLIP Models
par: Wei, Zhixiang, et autres
Publié: (2025)
par: Wei, Zhixiang, et autres
Publié: (2025)
IPAD-CLIP: Teaching CLIP to Detect Image Local Perceptual Artifacts
par: Wang, Juan, et autres
Publié: (2026)
par: Wang, Juan, et autres
Publié: (2026)
TTD: Text-Tag Self-Distillation Enhancing Image-Text Alignment in CLIP to Alleviate Single Tag Bias
par: Jo, Sanghyun, et autres
Publié: (2024)
par: Jo, Sanghyun, et autres
Publié: (2024)
A Training-Free Framework for Open-Vocabulary Image Segmentation and Recognition with EfficientNet and CLIP
par: Dai, Ying, et autres
Publié: (2025)
par: Dai, Ying, et autres
Publié: (2025)
Explore the Potential of CLIP for Training-Free Open Vocabulary Semantic Segmentation
par: Shao, Tong, et autres
Publié: (2024)
par: Shao, Tong, et autres
Publié: (2024)
CLIP-Guided Source-Free Object Detection in Aerial Images
par: Liu, Nanqing, et autres
Publié: (2024)
par: Liu, Nanqing, et autres
Publié: (2024)
CLIP in Medical Imaging: A Survey
par: Zhao, Zihao, et autres
Publié: (2023)
par: Zhao, Zihao, et autres
Publié: (2023)
TiC-CLIP: Continual Training of CLIP Models
par: Garg, Saurabh, et autres
Publié: (2023)
par: Garg, Saurabh, et autres
Publié: (2023)
PureCLIP-Depth: Prompt-Free and Decoder-Free Monocular Depth Estimation within CLIP Embedding Space
par: Miya, Ryutaro, et autres
Publié: (2026)
par: Miya, Ryutaro, et autres
Publié: (2026)
MediCLIP: Adapting CLIP for Few-shot Medical Image Anomaly Detection
par: Zhang, Ximiao, et autres
Publié: (2024)
par: Zhang, Ximiao, et autres
Publié: (2024)
CLIP-AGIQA: Boosting the Performance of AI-Generated Image Quality Assessment with CLIP
par: Tang, Zhenchen, et autres
Publié: (2024)
par: Tang, Zhenchen, et autres
Publié: (2024)
VAR-CLIP: Text-to-Image Generator with Visual Auto-Regressive Modeling
par: Zhang, Qian, et autres
Publié: (2024)
par: Zhang, Qian, et autres
Publié: (2024)
GenCLIP: Generalizing CLIP Prompts for Zero-shot Anomaly Detection
par: Kim, Donghyeong, et autres
Publié: (2025)
par: Kim, Donghyeong, et autres
Publié: (2025)
DouC: Dual-Branch CLIP for Training-Free Open-Vocabulary Segmentation
par: Zamini, Mohamad, et autres
Publié: (2026)
par: Zamini, Mohamad, et autres
Publié: (2026)
Improving Visual Discriminability of CLIP for Training-Free Open-Vocabulary Semantic Segmentation
par: Zhou, Jinxin, et autres
Publié: (2025)
par: Zhou, Jinxin, et autres
Publié: (2025)
SuperCLIP: CLIP with Simple Classification Supervision
par: Zhao, Weiheng, et autres
Publié: (2025)
par: Zhao, Weiheng, et autres
Publié: (2025)
Extract Free Dense Misalignment from CLIP
par: Nam, JeongYeon, et autres
Publié: (2024)
par: Nam, JeongYeon, et autres
Publié: (2024)
SPACE-CLIP: Spatial Perception via Adaptive CLIP Embeddings for Monocular Depth Estimation
par: Cho, Taewan, et autres
Publié: (2026)
par: Cho, Taewan, et autres
Publié: (2026)
Erasing CLIP Memories: Non-Destructive, Data-Free Zero-Shot class Unlearning in CLIP Models
par: Mishra, Ashish, et autres
Publié: (2025)
par: Mishra, Ashish, et autres
Publié: (2025)
CLIP-Decoder : ZeroShot Multilabel Classification using Multimodal CLIP Aligned Representation
par: Ali, Muhammad, et autres
Publié: (2024)
par: Ali, Muhammad, et autres
Publié: (2024)
NeuroCLIP: Neuromorphic Data Understanding by CLIP and SNN
par: Guo, Yufei, et autres
Publié: (2023)
par: Guo, Yufei, et autres
Publié: (2023)
CalibCLIP: Contextual Calibration of Dominant Semantics for Text-Driven Image Retrieval
par: Kang, Bin, et autres
Publié: (2025)
par: Kang, Bin, et autres
Publié: (2025)
Detecting Deepfakes with Multivariate Soft Blending and CLIP-based Image-Text Alignment
par: Li, Jingwei, et autres
Publié: (2026)
par: Li, Jingwei, et autres
Publié: (2026)
Exploring Open-Vocabulary Object Recognition in Images using CLIP
par: Chen, Wei Yu, et autres
Publié: (2026)
par: Chen, Wei Yu, et autres
Publié: (2026)
MobileCLIP: Fast Image-Text Models through Multi-Modal Reinforced Training
par: Vasu, Pavan Kumar Anasosalu, et autres
Publié: (2023)
par: Vasu, Pavan Kumar Anasosalu, et autres
Publié: (2023)
CLIP-Free, Label Free, Unsupervised Concept Bottleneck Models
par: Sammani, Fawaz, et autres
Publié: (2025)
par: Sammani, Fawaz, et autres
Publié: (2025)
TNG-CLIP:Training-Time Negation Data Generation for Negation Awareness of CLIP
par: Cai, Yuliang, et autres
Publié: (2025)
par: Cai, Yuliang, et autres
Publié: (2025)
Documents similaires
-
ComCLIP: Training-Free Compositional Image and Text Matching
par: Jiang, Kenan, et autres
Publié: (2022) -
Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP
par: Li, Yayuan, et autres
Publié: (2024) -
Extending CLIP's Image-Text Alignment to Referring Image Segmentation
par: Kim, Seoyeon, et autres
Publié: (2023) -
Long-CLIP: Unlocking the Long-Text Capability of CLIP
par: Zhang, Beichen, et autres
Publié: (2024) -
Self-Calibrated CLIP for Training-Free Open-Vocabulary Segmentation
par: Bai, Sule, et autres
Publié: (2024)