Exploiting Text-Image Latent Spaces for the Description of Visual Concepts
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Schmalwasser, Laines, Gawlikowski, Jakob, Denzler, Joachim, Niebling, Julia |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FastCAV: Efficient Computation of Concept Activation Vectors for Explaining Deep Neural Networks
par: Schmalwasser, Laines, et autres
Publié: (2025)
par: Schmalwasser, Laines, et autres
Publié: (2025)
Unraveling Anomalies in Time: Unsupervised Discovery and Isolation of Anomalous Behavior in Bio-regenerative Life Support System Telemetry
par: Rewicki, Ferdinand, et autres
Publié: (2024)
par: Rewicki, Ferdinand, et autres
Publié: (2024)
Probabilistic Embeddings for Frozen Vision-Language Models: Uncertainty Quantification with Gaussian Process Latent Variable Models
par: Venkataramanan, Aishwarya, et autres
Publié: (2025)
par: Venkataramanan, Aishwarya, et autres
Publié: (2025)
When Medical Imaging Met Self-Attention: A Love Story That Didn't Quite Work Out
par: Piater, Tristan, et autres
Publié: (2024)
par: Piater, Tristan, et autres
Publié: (2024)
Locally Explaining Prediction Behavior via Gradual Interventions and Measuring Property Gradients
par: Penzel, Niklas, et autres
Publié: (2025)
par: Penzel, Niklas, et autres
Publié: (2025)
Saccadic Vision for Fine-Grained Visual Classification
par: Schmidt, Johann, et autres
Publié: (2025)
par: Schmidt, Johann, et autres
Publié: (2025)
Privacy-Preserving Face Recognition in Hybrid Frequency-Color Domain
par: Han, Dong, et autres
Publié: (2024)
par: Han, Dong, et autres
Publié: (2024)
Reducing Bias in Pre-trained Models by Tuning while Penalizing Change
par: Penzel, Niklas, et autres
Publié: (2024)
par: Penzel, Niklas, et autres
Publié: (2024)
KAN See Your Face
par: Han, Dong, et autres
Publié: (2024)
par: Han, Dong, et autres
Publié: (2024)
$λ$-ECLIPSE: Multi-Concept Personalized Text-to-Image Diffusion Models by Leveraging CLIP Latent Space
par: Patel, Maitreya, et autres
Publié: (2024)
par: Patel, Maitreya, et autres
Publié: (2024)
Visual Concept-driven Image Generation with Text-to-Image Diffusion Model
par: Rahman, Tanzila, et autres
Publié: (2024)
par: Rahman, Tanzila, et autres
Publié: (2024)
Realistic Face Reconstruction from Facial Embeddings via Diffusion Models
par: Han, Dong, et autres
Publié: (2026)
par: Han, Dong, et autres
Publié: (2026)
Gradient Extrapolation for Debiased Representation Learning
par: Asaad, Ihab, et autres
Publié: (2025)
par: Asaad, Ihab, et autres
Publié: (2025)
Visual Semantic Description Generation with MLLMs for Image-Text Matching
par: Chen, Junyu, et autres
Publié: (2025)
par: Chen, Junyu, et autres
Publié: (2025)
Facing Asymmetry -- Uncovering the Causal Link between Facial Symmetry and Expression Classifiers using Synthetic Interventions
par: Büchner, Tim, et autres
Publié: (2024)
par: Büchner, Tim, et autres
Publié: (2024)
JeFaPaTo -- A joint toolbox for blinking analysis and facial features extraction
par: Büchner, Tim, et autres
Publié: (2024)
par: Büchner, Tim, et autres
Publié: (2024)
The Power of Properties: Uncovering the Influential Factors in Emotion Classification
par: Büchner, Tim, et autres
Publié: (2024)
par: Büchner, Tim, et autres
Publié: (2024)
Electromyography-Informed Facial Expression Reconstruction for Physiological-Based Synthesis and Analysis
par: Büchner, Tim, et autres
Publié: (2025)
par: Büchner, Tim, et autres
Publié: (2025)
EmoLat: Text-driven Image Sentiment Transfer via Emotion Latent Space
par: Zhang, Jing, et autres
Publié: (2026)
par: Zhang, Jing, et autres
Publié: (2026)
Robust Skin Color Driven Privacy Preserving Face Recognition via Function Secret Sharing
par: Han, Dong, et autres
Publié: (2024)
par: Han, Dong, et autres
Publié: (2024)
Monet: Reasoning in Latent Visual Space Beyond Images and Language
par: Wang, Qixun, et autres
Publié: (2025)
par: Wang, Qixun, et autres
Publié: (2025)
Vibe Spaces for Creatively Connecting and Expressing Visual Concepts
par: Yang, Huzheng, et autres
Publié: (2025)
par: Yang, Huzheng, et autres
Publié: (2025)
Blending Concepts with Text-to-Image Diffusion Models
par: Olearo, Lorenzo, et autres
Publié: (2025)
par: Olearo, Lorenzo, et autres
Publié: (2025)
Zero-Shot Visual Concept Blending Without Text Guidance
par: Makino, Hiroya, et autres
Publié: (2025)
par: Makino, Hiroya, et autres
Publié: (2025)
AttentionDrag: Exploiting Latent Correlation Knowledge in Pre-trained Diffusion Models for Image Editing
par: Yang, Biao, et autres
Publié: (2025)
par: Yang, Biao, et autres
Publié: (2025)
GrOCE:Graph-Guided Online Concept Erasure for Text-to-Image Diffusion Models
par: Han, Ning, et autres
Publié: (2025)
par: Han, Ning, et autres
Publié: (2025)
Shared Latent Representation for Joint Text-to-Audio-Visual Synthesis
par: Yaman, Dogucan, et autres
Publié: (2025)
par: Yaman, Dogucan, et autres
Publié: (2025)
Descriptive Image-Text Matching with Graded Contextual Similarity
par: Jang, Jinhyun, et autres
Publié: (2025)
par: Jang, Jinhyun, et autres
Publié: (2025)
Personalized Residuals for Concept-Driven Text-to-Image Generation
par: Ham, Cusuh, et autres
Publié: (2024)
par: Ham, Cusuh, et autres
Publié: (2024)
Progressive Text-to-Image Diffusion with Soft Latent Direction
par: Ye, YuTeng, et autres
Publié: (2023)
par: Ye, YuTeng, et autres
Publié: (2023)
Synthetic Perception: Can Generated Images Unlock Latent Visual Prior for Text-Centric Reasoning?
par: Huang, Yuesheng, et autres
Publié: (2025)
par: Huang, Yuesheng, et autres
Publié: (2025)
Data-Centric Benchmark for Label Noise Estimation and Ranking in Remote Sensing Image Segmentation
par: Nogueira, Keiller, et autres
Publié: (2026)
par: Nogueira, Keiller, et autres
Publié: (2026)
Probability Density Geodesics in Image Diffusion Latent Space
par: Yu, Qingtao, et autres
Publié: (2025)
par: Yu, Qingtao, et autres
Publié: (2025)
Beyond Text-Visual Attention: Exploiting Visual Cues for Effective Token Pruning in VLMs
par: Zhang, Qizhe, et autres
Publié: (2024)
par: Zhang, Qizhe, et autres
Publié: (2024)
Reliable and Efficient Concept Erasure of Text-to-Image Diffusion Models
par: Gong, Chao, et autres
Publié: (2024)
par: Gong, Chao, et autres
Publié: (2024)
ACE: Anti-Editing Concept Erasure in Text-to-Image Models
par: Wang, Zihao, et autres
Publié: (2025)
par: Wang, Zihao, et autres
Publié: (2025)
Lightning UQ Box: A Comprehensive Framework for Uncertainty Quantification in Deep Learning
par: Lehmann, Nils, et autres
Publié: (2024)
par: Lehmann, Nils, et autres
Publié: (2024)
LSSGen: Leveraging Latent Space Scaling in Flow and Diffusion for Efficient Text to Image Generation
par: Tang, Jyun-Ze, et autres
Publié: (2025)
par: Tang, Jyun-Ze, et autres
Publié: (2025)
Escaping Plato's Cave: Towards the Alignment of 3D and Text Latent Spaces
par: Hadgi, Souhail, et autres
Publié: (2025)
par: Hadgi, Souhail, et autres
Publié: (2025)
Revealing the Impact of Visual Text Style on Attribute-based Descriptions Produced by Large Visual Language Models
par: Wang, Xiaomeng, et autres
Publié: (2026)
par: Wang, Xiaomeng, et autres
Publié: (2026)
Documents similaires
-
FastCAV: Efficient Computation of Concept Activation Vectors for Explaining Deep Neural Networks
par: Schmalwasser, Laines, et autres
Publié: (2025) -
Unraveling Anomalies in Time: Unsupervised Discovery and Isolation of Anomalous Behavior in Bio-regenerative Life Support System Telemetry
par: Rewicki, Ferdinand, et autres
Publié: (2024) -
Probabilistic Embeddings for Frozen Vision-Language Models: Uncertainty Quantification with Gaussian Process Latent Variable Models
par: Venkataramanan, Aishwarya, et autres
Publié: (2025) -
When Medical Imaging Met Self-Attention: A Love Story That Didn't Quite Work Out
par: Piater, Tristan, et autres
Publié: (2024) -
Locally Explaining Prediction Behavior via Gradual Interventions and Measuring Property Gradients
par: Penzel, Niklas, et autres
Publié: (2025)