Enhancing Conditional Image Generation with Explainable Latent Space Manipulation
Fuente:
arXiv
Salvato in:
| Autore principale: | Pathania, Kshitij |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Lost in Latent Space: Disentangled Models and the Challenge of Combinatorial Generalisation
di: Montero, Milton L., et al.
Pubblicazione: (2022)
di: Montero, Milton L., et al.
Pubblicazione: (2022)
Analyzing Quality, Bias, and Performance in Text-to-Image Generative Models
di: Masrourisaadat, Nila, et al.
Pubblicazione: (2024)
di: Masrourisaadat, Nila, et al.
Pubblicazione: (2024)
Supervised Contrastive Learning for Few-Shot AI-Generated Image Detection and Attribution
di: Urueña, Jaime Álvarez, et al.
Pubblicazione: (2025)
di: Urueña, Jaime Álvarez, et al.
Pubblicazione: (2025)
Pointing-Based Object Recognition
di: Hajdúch, Lukáš, et al.
Pubblicazione: (2026)
di: Hajdúch, Lukáš, et al.
Pubblicazione: (2026)
Sparse Concept Bottleneck Models: Gumbel Tricks in Contrastive Learning
di: Semenov, Andrei, et al.
Pubblicazione: (2024)
di: Semenov, Andrei, et al.
Pubblicazione: (2024)
Scalable Face Security Vision Foundation Model for Deepfake, Diffusion, and Spoofing Detection
di: Wang, Gaojian, et al.
Pubblicazione: (2025)
di: Wang, Gaojian, et al.
Pubblicazione: (2025)
Learning 3D object-centric representation through prediction
di: Day, John, et al.
Pubblicazione: (2024)
di: Day, John, et al.
Pubblicazione: (2024)
S-HR-VQVAE: Sequential Hierarchical Residual Learning Vector Quantized Variational Autoencoder for Video Prediction
di: Adiban, Mohammad, et al.
Pubblicazione: (2023)
di: Adiban, Mohammad, et al.
Pubblicazione: (2023)
GeoPos: A Minimal Positional Encoding for Enhanced Fine-Grained Details in Image Synthesis Using Convolutional Neural Networks
di: Hosseini, Mehran, et al.
Pubblicazione: (2024)
di: Hosseini, Mehran, et al.
Pubblicazione: (2024)
Quantized Vision-Language Models for Damage Assessment: A Comparative Study of LLaVA-1.5-7B Quantization Levels
di: Yasuno, Takato
Pubblicazione: (2026)
di: Yasuno, Takato
Pubblicazione: (2026)
Feature-Augmented Deep Networks for Multiscale Building Segmentation in High-Resolution UAV and Satellite Imagery
di: Maniyar, Chintan B., et al.
Pubblicazione: (2025)
di: Maniyar, Chintan B., et al.
Pubblicazione: (2025)
DUDF: Differentiable Unsigned Distance Fields with Hyperbolic Scaling
di: Fainstein, Miguel, et al.
Pubblicazione: (2024)
di: Fainstein, Miguel, et al.
Pubblicazione: (2024)
A Spitting Image: Modular Superpixel Tokenization in Vision Transformers
di: Aasan, Marius, et al.
Pubblicazione: (2024)
di: Aasan, Marius, et al.
Pubblicazione: (2024)
Cora: Correspondence-aware image editing using few step diffusion
di: Alimohammadi, Amirhossein, et al.
Pubblicazione: (2025)
di: Alimohammadi, Amirhossein, et al.
Pubblicazione: (2025)
ADAT: Time-Series-Aware Adaptive Transformer Architecture for Sign Language Translation
di: Shahin, Nada, et al.
Pubblicazione: (2025)
di: Shahin, Nada, et al.
Pubblicazione: (2025)
FAME: Feature Activation Map Explanation on Image Classification and Face Recognition
di: Zhang, Xinyi, et al.
Pubblicazione: (2026)
di: Zhang, Xinyi, et al.
Pubblicazione: (2026)
Taming the Tail: Leveraging Asymmetric Loss and Pade Approximation to Overcome Medical Image Long-Tailed Class Imbalance
di: Kashyap, Pankhi, et al.
Pubblicazione: (2024)
di: Kashyap, Pankhi, et al.
Pubblicazione: (2024)
EDSNet: Efficient-DSNet for Video Summarization
di: Prasad, Ashish, et al.
Pubblicazione: (2024)
di: Prasad, Ashish, et al.
Pubblicazione: (2024)
Symmetry Awareness Encoded Deep Learning Framework for Brain Imaging Analysis
di: Ma, Yang, et al.
Pubblicazione: (2024)
di: Ma, Yang, et al.
Pubblicazione: (2024)
Generative Model-Driven Synthetic Training Image Generation: An Approach to Cognition in Rail Defect Detection
di: Ferdousi, Rahatara, et al.
Pubblicazione: (2023)
di: Ferdousi, Rahatara, et al.
Pubblicazione: (2023)
STimage-1K4M: A histopathology image-gene expression dataset for spatial transcriptomics
di: Chen, Jiawen, et al.
Pubblicazione: (2024)
di: Chen, Jiawen, et al.
Pubblicazione: (2024)
Graph-PiT: Enhancing Structural Coherence in Part-Based Image Synthesis via Graph Priors
di: Zhang, Junbin, et al.
Pubblicazione: (2026)
di: Zhang, Junbin, et al.
Pubblicazione: (2026)
GLEaN: A Text-to-image Bias Detection Approach for Public Comprehension
di: Ding, Bochu, et al.
Pubblicazione: (2026)
di: Ding, Bochu, et al.
Pubblicazione: (2026)
NV3D: Leveraging Spatial Shape Through Normal Vector-based 3D Object Detection
di: Chaowakarn, Krittin, et al.
Pubblicazione: (2025)
di: Chaowakarn, Krittin, et al.
Pubblicazione: (2025)
Sat-JEPA-Diff: Bridging Self-Supervised Learning and Generative Diffusion for Remote Sensing
di: Komurcu, Kursat, et al.
Pubblicazione: (2026)
di: Komurcu, Kursat, et al.
Pubblicazione: (2026)
GLoT: A Novel Gated-Logarithmic Transformer for Efficient Sign Language Translation
di: Shahin, Nada, et al.
Pubblicazione: (2025)
di: Shahin, Nada, et al.
Pubblicazione: (2025)
Shaping History: Advanced Machine Learning Techniques for the Analysis and Dating of Cuneiform Tablets over Three Millennia
di: Kapon, Danielle, et al.
Pubblicazione: (2024)
di: Kapon, Danielle, et al.
Pubblicazione: (2024)
InterChart: Benchmarking Visual Reasoning Across Decomposed and Distributed Chart Information
di: Iyengar, Anirudh Iyengar Kaniyar Narayana, et al.
Pubblicazione: (2025)
di: Iyengar, Anirudh Iyengar Kaniyar Narayana, et al.
Pubblicazione: (2025)
From Latent to Engine Manifolds: Analyzing ImageBind's Multimodal Embedding Space
di: Hamara, Andrew, et al.
Pubblicazione: (2024)
di: Hamara, Andrew, et al.
Pubblicazione: (2024)
CCVA-FL: Cross-Client Variations Adaptive Federated Learning for Medical Imaging
di: Gupta, Sunny, et al.
Pubblicazione: (2024)
di: Gupta, Sunny, et al.
Pubblicazione: (2024)
U-Net-Like Spiking Neural Networks for Single Image Dehazing
di: Li, Huibin, et al.
Pubblicazione: (2025)
di: Li, Huibin, et al.
Pubblicazione: (2025)
Graph Neural Networks in Histopathology: Emerging Trends and Future Directions
di: Brussee, Siemen, et al.
Pubblicazione: (2024)
di: Brussee, Siemen, et al.
Pubblicazione: (2024)
Fusing Structure from Motion and Simulation-Augmented Pose Regression from Optical Flow for Challenging Indoor Environments
di: Ott, Felix, et al.
Pubblicazione: (2023)
di: Ott, Felix, et al.
Pubblicazione: (2023)
Differentiable Hierarchical Visual Tokenization
di: Aasan, Marius, et al.
Pubblicazione: (2025)
di: Aasan, Marius, et al.
Pubblicazione: (2025)
Visual-Text Cross Alignment: Refining the Similarity Score in Vision-Language Models
di: Li, Jinhao, et al.
Pubblicazione: (2024)
di: Li, Jinhao, et al.
Pubblicazione: (2024)
HATL: Hierarchical Adaptive-Transfer Learning Framework for Sign Language Machine Translation
di: Shahin, Nada, et al.
Pubblicazione: (2026)
di: Shahin, Nada, et al.
Pubblicazione: (2026)
Towards Onboard Continuous Change Detection for Floods
di: Kyselica, Daniel, et al.
Pubblicazione: (2026)
di: Kyselica, Daniel, et al.
Pubblicazione: (2026)
Non-Robust Features are Not Always Useful in One-Class Classification
di: Lau, Matthew, et al.
Pubblicazione: (2024)
di: Lau, Matthew, et al.
Pubblicazione: (2024)
Learning Hierarchical Image Segmentation For Recognition and By Recognition
di: Ke, Tsung-Wei, et al.
Pubblicazione: (2022)
di: Ke, Tsung-Wei, et al.
Pubblicazione: (2022)
Evolving Medical Imaging Agents via Experience-driven Self-skill Discovery
di: Fan, Lin, et al.
Pubblicazione: (2026)
di: Fan, Lin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Lost in Latent Space: Disentangled Models and the Challenge of Combinatorial Generalisation
di: Montero, Milton L., et al.
Pubblicazione: (2022) -
Analyzing Quality, Bias, and Performance in Text-to-Image Generative Models
di: Masrourisaadat, Nila, et al.
Pubblicazione: (2024) -
Supervised Contrastive Learning for Few-Shot AI-Generated Image Detection and Attribution
di: Urueña, Jaime Álvarez, et al.
Pubblicazione: (2025) -
Pointing-Based Object Recognition
di: Hajdúch, Lukáš, et al.
Pubblicazione: (2026) -
Sparse Concept Bottleneck Models: Gumbel Tricks in Contrastive Learning
di: Semenov, Andrei, et al.
Pubblicazione: (2024)