Conceptualizing Embeddings: Sparse Disentanglement for Vision-Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Kubaty, Piotr, Marszałek, Patryk, Struski, Łukasz, Wróbel, Adam, Tabor, Jacek, Śmieja, Marek |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Stop Marginalizing My Dreams: Model Inversion via Laplace Kernel for Continual Learning
di: Krukowski, Patryk, et al.
Pubblicazione: (2026)
di: Krukowski, Patryk, et al.
Pubblicazione: (2026)
SIDE: Sparse Information Disentanglement for Explainable Artificial Intelligence
di: Dubovik, Viktar, et al.
Pubblicazione: (2025)
di: Dubovik, Viktar, et al.
Pubblicazione: (2025)
InfoDisent: Explainability of Image Classification Models by Information Disentanglement
di: Struski, Łukasz, et al.
Pubblicazione: (2024)
di: Struski, Łukasz, et al.
Pubblicazione: (2024)
VisTabNet: Adapting Vision Transformers for Tabular Data
di: Wydmański, Witold, et al.
Pubblicazione: (2024)
di: Wydmański, Witold, et al.
Pubblicazione: (2024)
LAPLEX: The FFT of Learnable Laplace Kernels
di: Struski, Łukasz, et al.
Pubblicazione: (2026)
di: Struski, Łukasz, et al.
Pubblicazione: (2026)
PrAViC: Probabilistic Adaptation Framework for Real-Time Video Classification
di: Trędowicz, Magdalena, et al.
Pubblicazione: (2024)
di: Trędowicz, Magdalena, et al.
Pubblicazione: (2024)
Augmentation-aware Self-supervised Learning with Conditioned Projector
di: Przewięźlikowski, Marcin, et al.
Pubblicazione: (2023)
di: Przewięźlikowski, Marcin, et al.
Pubblicazione: (2023)
ZEUS: Zero-shot Embeddings for Unsupervised Separation of Tabular Data
di: Marszałek, Patryk, et al.
Pubblicazione: (2025)
di: Marszałek, Patryk, et al.
Pubblicazione: (2025)
StyleAutoEncoder for manipulating image attributes using pre-trained StyleGAN
di: Bedychaj, Andrzej, et al.
Pubblicazione: (2024)
di: Bedychaj, Andrzej, et al.
Pubblicazione: (2024)
ProDG: Prototypes for Data-Free Generative Post-Hoc Explainability
di: Borycki, Piotr, et al.
Pubblicazione: (2026)
di: Borycki, Piotr, et al.
Pubblicazione: (2026)
ProMIL: Probabilistic Multiple Instance Learning for Medical Imaging
di: Struski, Łukasz, et al.
Pubblicazione: (2023)
di: Struski, Łukasz, et al.
Pubblicazione: (2023)
SONG: Self-Organizing Neural Graphs
di: Struski, Łukasz, et al.
Pubblicazione: (2021)
di: Struski, Łukasz, et al.
Pubblicazione: (2021)
ProtoSeg: Interpretable Semantic Segmentation with Prototypical Parts
di: Sacha, Mikołaj, et al.
Pubblicazione: (2023)
di: Sacha, Mikołaj, et al.
Pubblicazione: (2023)
SoftSAE: Dynamic Top-K Selection for Adaptive Sparse Autoencoders
di: Stępień, Jakub, et al.
Pubblicazione: (2026)
di: Stępień, Jakub, et al.
Pubblicazione: (2026)
EPIC: Explanation of Pretrained Image Classification Networks via Prototype
di: Borycki, Piotr, et al.
Pubblicazione: (2025)
di: Borycki, Piotr, et al.
Pubblicazione: (2025)
DAVE: Distribution-aware Attribution via ViT Gradient Decomposition
di: Wróbel, Adam, et al.
Pubblicazione: (2026)
di: Wróbel, Adam, et al.
Pubblicazione: (2026)
Beyond [cls]: Exploring the true potential of Masked Image Modeling representations
di: Przewięźlikowski, Marcin, et al.
Pubblicazione: (2024)
di: Przewięźlikowski, Marcin, et al.
Pubblicazione: (2024)
TACTIC for Navigating the Unknown: Tabular Anomaly deteCTion via In-Context inference
di: Marszałek, Patryk, et al.
Pubblicazione: (2026)
di: Marszałek, Patryk, et al.
Pubblicazione: (2026)
LucidPPN: Unambiguous Prototypical Parts Network for User-centric Interpretable Computer Vision
di: Pach, Mateusz, et al.
Pubblicazione: (2024)
di: Pach, Mateusz, et al.
Pubblicazione: (2024)
SEM: Sparse Embedding Modulation for Post-Hoc Debiasing of Vision-Language Models
di: Guimard, Quentin, et al.
Pubblicazione: (2026)
di: Guimard, Quentin, et al.
Pubblicazione: (2026)
ProPML: Probability Partial Multi-label Learning
di: Struski, Łukasz, et al.
Pubblicazione: (2024)
di: Struski, Łukasz, et al.
Pubblicazione: (2024)
Disentangling Mean Embeddings for Better Diagnostics of Image Generators
di: Gruber, Sebastian G., et al.
Pubblicazione: (2024)
di: Gruber, Sebastian G., et al.
Pubblicazione: (2024)
HoPE: Hybrid of Position Embedding for Long Context Vision-Language Models
di: Li, Haoran, et al.
Pubblicazione: (2025)
di: Li, Haoran, et al.
Pubblicazione: (2025)
ParFormer: A Vision Transformer with Parallel Mixer and Sparse Channel Attention Patch Embedding
di: Setyawan, Novendra, et al.
Pubblicazione: (2024)
di: Setyawan, Novendra, et al.
Pubblicazione: (2024)
Conceptual Learning via Embedding Approximations for Reinforcing Interpretability and Transparency
di: Dikter, Maor, et al.
Pubblicazione: (2024)
di: Dikter, Maor, et al.
Pubblicazione: (2024)
Probabilistic Conceptual Explainers: Trustworthy Conceptual Explanations for Vision Foundation Models
di: Wang, Hengyi, et al.
Pubblicazione: (2024)
di: Wang, Hengyi, et al.
Pubblicazione: (2024)
Cross-Modal Redundancy and the Geometry of Vision-Language Embeddings
di: Dhimoïla, Grégoire, et al.
Pubblicazione: (2026)
di: Dhimoïla, Grégoire, et al.
Pubblicazione: (2026)
Domain Adaptation with a Single Vision-Language Embedding
di: Fahes, Mohammad, et al.
Pubblicazione: (2024)
di: Fahes, Mohammad, et al.
Pubblicazione: (2024)
Probabilistic Embeddings for Frozen Vision-Language Models: Uncertainty Quantification with Gaussian Process Latent Variable Models
di: Venkataramanan, Aishwarya, et al.
Pubblicazione: (2025)
di: Venkataramanan, Aishwarya, et al.
Pubblicazione: (2025)
BendVLM: Test-Time Debiasing of Vision-Language Embeddings
di: Gerych, Walter, et al.
Pubblicazione: (2024)
di: Gerych, Walter, et al.
Pubblicazione: (2024)
Probing the Representational Power of Sparse Autoencoders in Vision Models
di: Olson, Matthew Lyle, et al.
Pubblicazione: (2025)
di: Olson, Matthew Lyle, et al.
Pubblicazione: (2025)
Analyzing Hierarchical Structure in Vision Models with Sparse Autoencoders
di: Olson, Matthew Lyle, et al.
Pubblicazione: (2025)
di: Olson, Matthew Lyle, et al.
Pubblicazione: (2025)
PRISM: Reducing Spurious Implicit Biases in Vision-Language Models with LLM-Guided Embedding Projection
di: Molahasani, Mahdiyar, et al.
Pubblicazione: (2025)
di: Molahasani, Mahdiyar, et al.
Pubblicazione: (2025)
Bayesian Fine-tuning in Projected Subspaces
di: Dubovik, Viktar, et al.
Pubblicazione: (2026)
di: Dubovik, Viktar, et al.
Pubblicazione: (2026)
Minimal Ranks, Maximum Confidence: Parameter-efficient Uncertainty Quantification for LoRA
di: Marszałek, Patryk, et al.
Pubblicazione: (2025)
di: Marszałek, Patryk, et al.
Pubblicazione: (2025)
NeuCo-Bench: A Novel Benchmark Framework for Neural Embeddings in Earth Observation
di: Vinge, Rikard, et al.
Pubblicazione: (2025)
di: Vinge, Rikard, et al.
Pubblicazione: (2025)
As Good as It KAN Get: High-Fidelity Audio Representation
di: Marszałek, Patryk, et al.
Pubblicazione: (2025)
di: Marszałek, Patryk, et al.
Pubblicazione: (2025)
Sparse Autoencoders Learn Monosemantic Features in Vision-Language Models
di: Pach, Mateusz, et al.
Pubblicazione: (2025)
di: Pach, Mateusz, et al.
Pubblicazione: (2025)
Vision Foundation Model Embedding-Based Semantic Anomaly Detection
di: Ronecker, Max Peter, et al.
Pubblicazione: (2025)
di: Ronecker, Max Peter, et al.
Pubblicazione: (2025)
CounterFlowNet: From Minimal Changes to Meaningful Counterfactual Explanations
di: Furman, Oleksii, et al.
Pubblicazione: (2026)
di: Furman, Oleksii, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Stop Marginalizing My Dreams: Model Inversion via Laplace Kernel for Continual Learning
di: Krukowski, Patryk, et al.
Pubblicazione: (2026) -
SIDE: Sparse Information Disentanglement for Explainable Artificial Intelligence
di: Dubovik, Viktar, et al.
Pubblicazione: (2025) -
InfoDisent: Explainability of Image Classification Models by Information Disentanglement
di: Struski, Łukasz, et al.
Pubblicazione: (2024) -
VisTabNet: Adapting Vision Transformers for Tabular Data
di: Wydmański, Witold, et al.
Pubblicazione: (2024) -
LAPLEX: The FFT of Learnable Laplace Kernels
di: Struski, Łukasz, et al.
Pubblicazione: (2026)