Unlearning-based Neural Interpretations
Fuente:
arXiv
Salvato in:
| Autori principali: | Choi, Ching Lam, Duplessis, Alexandre, Belongie, Serge |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Sparse Autoencoders Learn Monosemantic Features in Vision-Language Models
di: Pach, Mateusz, et al.
Pubblicazione: (2025)
di: Pach, Mateusz, et al.
Pubblicazione: (2025)
The Latent Color Subspace: Emergent Order in High-Dimensional Chaos
di: Pach, Mateusz, et al.
Pubblicazione: (2026)
di: Pach, Mateusz, et al.
Pubblicazione: (2026)
Stitch: Training-Free Position Control in Multimodal Diffusion Transformers
di: Bader, Jessica, et al.
Pubblicazione: (2025)
di: Bader, Jessica, et al.
Pubblicazione: (2025)
MMEarth: Exploring Multi-Modal Pretext Tasks For Geospatial Representation Learning
di: Nedungadi, Vishal, et al.
Pubblicazione: (2024)
di: Nedungadi, Vishal, et al.
Pubblicazione: (2024)
ICED: Concept-level Machine Unlearning via Interpretable Concept Decomposition
di: Lin, Shen, et al.
Pubblicazione: (2026)
di: Lin, Shen, et al.
Pubblicazione: (2026)
Stitched Value Model for Diffusion Alignment
di: Go, Hyojun, et al.
Pubblicazione: (2026)
di: Go, Hyojun, et al.
Pubblicazione: (2026)
Prompt-Based Safety Guidance Is Ineffective for Unlearned Text-to-Image Diffusion Models
di: Shin, Jiwoo, et al.
Pubblicazione: (2025)
di: Shin, Jiwoo, et al.
Pubblicazione: (2025)
Adapt then Unlearn: Exploring Parameter Space Semantics for Unlearning in Generative Adversarial Networks
di: Tiwary, Piyush, et al.
Pubblicazione: (2023)
di: Tiwary, Piyush, et al.
Pubblicazione: (2023)
Concept-Guided Interpretability via Neural Chunking
di: Wu, Shuchen, et al.
Pubblicazione: (2025)
di: Wu, Shuchen, et al.
Pubblicazione: (2025)
Building Optimal Neural Architectures using Interpretable Knowledge
di: Mills, Keith G., et al.
Pubblicazione: (2024)
di: Mills, Keith G., et al.
Pubblicazione: (2024)
Thinking in Frames: How Visual Context and Test-Time Scaling Empower Video Reasoning
di: Li, Chengzu, et al.
Pubblicazione: (2026)
di: Li, Chengzu, et al.
Pubblicazione: (2026)
Is Retain Set All You Need in Machine Unlearning? Restoring Performance of Unlearned Models with Out-Of-Distribution Images
di: Bonato, Jacopo, et al.
Pubblicazione: (2024)
di: Bonato, Jacopo, et al.
Pubblicazione: (2024)
B-cosification: Transforming Deep Neural Networks to be Inherently Interpretable
di: Arya, Shreyash, et al.
Pubblicazione: (2024)
di: Arya, Shreyash, et al.
Pubblicazione: (2024)
Hypnopaedia-Aware Machine Unlearning via Psychometrics of Artificial Mental Imagery
di: Chang, Ching-Chun, et al.
Pubblicazione: (2024)
di: Chang, Ching-Chun, et al.
Pubblicazione: (2024)
One-Shot Machine Unlearning with Mnemonic Code
di: Yamashita, Tomoya, et al.
Pubblicazione: (2023)
di: Yamashita, Tomoya, et al.
Pubblicazione: (2023)
QuAD: Query-based Interpretable Neural Motion Planning for Autonomous Driving
di: Biswas, Sourav, et al.
Pubblicazione: (2024)
di: Biswas, Sourav, et al.
Pubblicazione: (2024)
$\nabla τ$: Gradient-based and Task-Agnostic machine Unlearning
di: Trippa, Daniel, et al.
Pubblicazione: (2024)
di: Trippa, Daniel, et al.
Pubblicazione: (2024)
CLIPErase: Efficient Unlearning of Visual-Textual Associations in CLIP
di: Yang, Tianyu, et al.
Pubblicazione: (2024)
di: Yang, Tianyu, et al.
Pubblicazione: (2024)
Disentangled Sparse Representations for Concept-Separated Diffusion Unlearning
di: Kim, Hyeonjin, et al.
Pubblicazione: (2026)
di: Kim, Hyeonjin, et al.
Pubblicazione: (2026)
Face Identity Unlearning for Retrieval via Embedding Dispersion
di: Zakharov, Mikhail
Pubblicazione: (2025)
di: Zakharov, Mikhail
Pubblicazione: (2025)
Unleashing Uncertainty: Efficient Machine Unlearning for Generative AI
di: Spartalis, Christoforos N., et al.
Pubblicazione: (2025)
di: Spartalis, Christoforos N., et al.
Pubblicazione: (2025)
ECG-IMN: Interpretable Mesomorphic Neural Networks for 12-Lead Electrocardiogram Interpretation
di: Thambawita, Vajira, et al.
Pubblicazione: (2026)
di: Thambawita, Vajira, et al.
Pubblicazione: (2026)
Training-Free Restoration of Pruned Neural Networks
di: Lee, Keonho, et al.
Pubblicazione: (2025)
di: Lee, Keonho, et al.
Pubblicazione: (2025)
Privacy-Preserving Debiasing using Data Augmentation and Machine Unlearning
di: Pan, Zhixin, et al.
Pubblicazione: (2024)
di: Pan, Zhixin, et al.
Pubblicazione: (2024)
CoUn: Empowering Machine Unlearning via Contrastive Learning
di: Khalil, Yasser H., et al.
Pubblicazione: (2025)
di: Khalil, Yasser H., et al.
Pubblicazione: (2025)
Machine Unlearning in the Era of Quantum Machine Learning: An Empirical Study
di: Crivoi, Carla, et al.
Pubblicazione: (2025)
di: Crivoi, Carla, et al.
Pubblicazione: (2025)
Rethinking Post-Unlearning Behavior of Large Vision-Language Models
di: Kim, Minsung, et al.
Pubblicazione: (2025)
di: Kim, Minsung, et al.
Pubblicazione: (2025)
Multi-Class Unlearning for Image Classification via Weight Filtering
di: Poppi, Samuele, et al.
Pubblicazione: (2023)
di: Poppi, Samuele, et al.
Pubblicazione: (2023)
Financial Fraud Identification and Interpretability Study for Listed Companies Based on Convolutional Neural Network
di: Li, Xiao
Pubblicazione: (2025)
di: Li, Xiao
Pubblicazione: (2025)
SafeRedir: Prompt Embedding Redirection for Robust Unlearning in Image Generation Models
di: Liu, Renyang, et al.
Pubblicazione: (2026)
di: Liu, Renyang, et al.
Pubblicazione: (2026)
Understanding Distributed Representations of Concepts in Deep Neural Networks without Supervision
di: Chang, Wonjoon, et al.
Pubblicazione: (2023)
di: Chang, Wonjoon, et al.
Pubblicazione: (2023)
I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts
di: Xin, Jiayi, et al.
Pubblicazione: (2025)
di: Xin, Jiayi, et al.
Pubblicazione: (2025)
Challenging Forgets: Unveiling the Worst-Case Forget Sets in Machine Unlearning
di: Fan, Chongyu, et al.
Pubblicazione: (2024)
di: Fan, Chongyu, et al.
Pubblicazione: (2024)
LoTUS: Large-Scale Machine Unlearning with a Taste of Uncertainty
di: Spartalis, Christoforos N., et al.
Pubblicazione: (2025)
di: Spartalis, Christoforos N., et al.
Pubblicazione: (2025)
Concept Unlearning via Cross-Attention Activation Projection for Diffusion Models
di: Moon, Saemi, et al.
Pubblicazione: (2026)
di: Moon, Saemi, et al.
Pubblicazione: (2026)
CATA: Continual Machine Unlearning via Conflict-Averse Task Arithmetic
di: Lin, Shen, et al.
Pubblicazione: (2026)
di: Lin, Shen, et al.
Pubblicazione: (2026)
Deep Unlearning: Fast and Efficient Gradient-free Approach to Class Forgetting
di: Kodge, Sangamesh, et al.
Pubblicazione: (2023)
di: Kodge, Sangamesh, et al.
Pubblicazione: (2023)
Class Unlearning via Depth-Aware Removal of Forget-Specific Directions
di: Hatami, Arman, et al.
Pubblicazione: (2026)
di: Hatami, Arman, et al.
Pubblicazione: (2026)
Controllable Unlearning for Image-to-Image Generative Models via $\varepsilon$-Constrained Optimization
di: Feng, Xiaohua, et al.
Pubblicazione: (2024)
di: Feng, Xiaohua, et al.
Pubblicazione: (2024)
From Dormant to Deleted: Tamper-Resistant Unlearning Through Weight-Space Regularization
di: Siddiqui, Shoaib Ahmed, et al.
Pubblicazione: (2025)
di: Siddiqui, Shoaib Ahmed, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Sparse Autoencoders Learn Monosemantic Features in Vision-Language Models
di: Pach, Mateusz, et al.
Pubblicazione: (2025) -
The Latent Color Subspace: Emergent Order in High-Dimensional Chaos
di: Pach, Mateusz, et al.
Pubblicazione: (2026) -
Stitch: Training-Free Position Control in Multimodal Diffusion Transformers
di: Bader, Jessica, et al.
Pubblicazione: (2025) -
MMEarth: Exploring Multi-Modal Pretext Tasks For Geospatial Representation Learning
di: Nedungadi, Vishal, et al.
Pubblicazione: (2024) -
ICED: Concept-level Machine Unlearning via Interpretable Concept Decomposition
di: Lin, Shen, et al.
Pubblicazione: (2026)