Efficient Bias Mitigation Without Privileged Information
Fuente:
arXiv
Salvato in:
| Autori principali: | Zarlenga, Mateo Espinosa, Sankaranarayanan, Swami, Andrews, Jerone T. A., Shams, Zohreh, Jamnik, Mateja, Xiang, Alice |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Avoiding Leakage Poisoning: Concept Interventions Under Distribution Shifts
di: Zarlenga, Mateo Espinosa, et al.
Pubblicazione: (2025)
di: Zarlenga, Mateo Espinosa, et al.
Pubblicazione: (2025)
Digging Deeper: Learning Multi-Level Concept Hierarchies
di: Hill, Oscar, et al.
Pubblicazione: (2026)
di: Hill, Oscar, et al.
Pubblicazione: (2026)
Hierarchical Concept-based Interpretable Models
di: Hill, Oscar, et al.
Pubblicazione: (2026)
di: Hill, Oscar, et al.
Pubblicazione: (2026)
Learning to Receive Help: Intervention-Aware Concept Embedding Models
di: Zarlenga, Mateo Espinosa, et al.
Pubblicazione: (2023)
di: Zarlenga, Mateo Espinosa, et al.
Pubblicazione: (2023)
Do Concept Bottleneck Models Respect Localities?
di: Raman, Naveen, et al.
Pubblicazione: (2024)
di: Raman, Naveen, et al.
Pubblicazione: (2024)
Foundations of Interpretable Models
di: Barbiero, Pietro, et al.
Pubblicazione: (2025)
di: Barbiero, Pietro, et al.
Pubblicazione: (2025)
Understanding Inter-Concept Relationships in Concept-Based Models
di: Raman, Naveen, et al.
Pubblicazione: (2024)
di: Raman, Naveen, et al.
Pubblicazione: (2024)
Actionable Interpretability Must Be Defined in Terms of Symmetries
di: Barbiero, Pietro, et al.
Pubblicazione: (2026)
di: Barbiero, Pietro, et al.
Pubblicazione: (2026)
Multimodal Lego: Model Merging and Fine-Tuning Across Topologies and Modalities in Biomedicine
di: Hemker, Konstantin, et al.
Pubblicazione: (2024)
di: Hemker, Konstantin, et al.
Pubblicazione: (2024)
HEALNet: Multimodal Fusion for Heterogeneous Biomedical Data
di: Hemker, Konstantin, et al.
Pubblicazione: (2023)
di: Hemker, Konstantin, et al.
Pubblicazione: (2023)
Interpretable Neural-Symbolic Concept Reasoning
di: Barbiero, Pietro, et al.
Pubblicazione: (2023)
di: Barbiero, Pietro, et al.
Pubblicazione: (2023)
Addressing Concept Mislabeling in Concept Bottleneck Models Through Preference Optimization
di: Penaloza, Emiliano, et al.
Pubblicazione: (2025)
di: Penaloza, Emiliano, et al.
Pubblicazione: (2025)
TabMDA: Tabular Manifold Data Augmentation for Any Classifier using Transformers with In-context Subsetting
di: Margeloiu, Andrei, et al.
Pubblicazione: (2024)
di: Margeloiu, Andrei, et al.
Pubblicazione: (2024)
Don't Lose Focus: Activation Steering via Key-Orthogonal Projections
di: Luo, Haoyan, et al.
Pubblicazione: (2026)
di: Luo, Haoyan, et al.
Pubblicazione: (2026)
LLM Embeddings for Deep Learning on Tabular Data
di: Koloski, Boshko, et al.
Pubblicazione: (2025)
di: Koloski, Boshko, et al.
Pubblicazione: (2025)
Mitigating Participation Imbalance Bias in Asynchronous Federated Learning
di: Chang, Xiangyu, et al.
Pubblicazione: (2025)
di: Chang, Xiangyu, et al.
Pubblicazione: (2025)
Causal Concept Graph Models: Beyond Causal Opacity in Deep Learning
di: Dominici, Gabriele, et al.
Pubblicazione: (2024)
di: Dominici, Gabriele, et al.
Pubblicazione: (2024)
Privileged Information Distillation for Language Models
di: Penaloza, Emiliano, et al.
Pubblicazione: (2026)
di: Penaloza, Emiliano, et al.
Pubblicazione: (2026)
Distilling Privileged Information for Dubins Traveling Salesman Problems with Neighborhoods
di: Shin, Min Kyu, et al.
Pubblicazione: (2024)
di: Shin, Min Kyu, et al.
Pubblicazione: (2024)
Position: Measure Dataset Diversity, Don't Just Claim It
di: Zhao, Dora, et al.
Pubblicazione: (2024)
di: Zhao, Dora, et al.
Pubblicazione: (2024)
Mixture of Concept Bottleneck Experts
di: De Santis, Francesco, et al.
Pubblicazione: (2026)
di: De Santis, Francesco, et al.
Pubblicazione: (2026)
RO-FIGS: Efficient and Expressive Tree-Based Ensembles for Tabular Data
di: Matjašec, Urška, et al.
Pubblicazione: (2025)
di: Matjašec, Urška, et al.
Pubblicazione: (2025)
Shifting Perspectives: Steering Vectors for Robust Bias Mitigation in LLMs
di: Siddique, Zara, et al.
Pubblicazione: (2025)
di: Siddique, Zara, et al.
Pubblicazione: (2025)
Neural Interpretable Reasoning
di: Barbiero, Pietro, et al.
Pubblicazione: (2025)
di: Barbiero, Pietro, et al.
Pubblicazione: (2025)
Bias Fitting to Mitigate Length Bias of Reward Model in RLHF
di: Zhao, Kangwen, et al.
Pubblicazione: (2025)
di: Zhao, Kangwen, et al.
Pubblicazione: (2025)
Images Speak Louder than Words: Understanding and Mitigating Bias in Vision-Language Model from a Causal Mediation Perspective
di: Weng, Zhaotian, et al.
Pubblicazione: (2024)
di: Weng, Zhaotian, et al.
Pubblicazione: (2024)
Subgroups Matter for Robust Bias Mitigation
di: Alloula, Anissa, et al.
Pubblicazione: (2025)
di: Alloula, Anissa, et al.
Pubblicazione: (2025)
EMA Without the Lag: Bias-Corrected Iterate Averaging Schemes
di: Block, Adam, et al.
Pubblicazione: (2025)
di: Block, Adam, et al.
Pubblicazione: (2025)
Whither Bias Goes, I Will Go: An Integrative, Systematic Review of Algorithmic Bias Mitigation
di: Hickman, Louis, et al.
Pubblicazione: (2024)
di: Hickman, Louis, et al.
Pubblicazione: (2024)
Sphere Neural-Networks for Rational Reasoning
di: Dong, Tiansi, et al.
Pubblicazione: (2024)
di: Dong, Tiansi, et al.
Pubblicazione: (2024)
Privileged Sensing Scaffolds Reinforcement Learning
di: Hu, Edward S., et al.
Pubblicazione: (2024)
di: Hu, Edward S., et al.
Pubblicazione: (2024)
Uncovering Bias in Foundation Models: Impact, Testing, Harm, and Mitigation
di: Sun, Shuzhou, et al.
Pubblicazione: (2025)
di: Sun, Shuzhou, et al.
Pubblicazione: (2025)
Learning Using Generated Privileged Information by Text-to-Image Diffusion Models
di: Menadil, Rafael-Edy, et al.
Pubblicazione: (2023)
di: Menadil, Rafael-Edy, et al.
Pubblicazione: (2023)
Measuring and Mitigating Bias for Tabular Datasets with Multiple Protected Attributes
di: Duong, Manh Khoi, et al.
Pubblicazione: (2024)
di: Duong, Manh Khoi, et al.
Pubblicazione: (2024)
Adaptive Repetition for Mitigating Position Bias in LLM-Based Ranking
di: Vardasbi, Ali, et al.
Pubblicazione: (2025)
di: Vardasbi, Ali, et al.
Pubblicazione: (2025)
DRUPI: Dataset Reduction Using Privileged Information
di: Wang, Shaobo, et al.
Pubblicazione: (2024)
di: Wang, Shaobo, et al.
Pubblicazione: (2024)
Toward Privileged Foundation Models:LUPI for Accelerated and Improved Learning
di: Ding, Xueying, et al.
Pubblicazione: (2026)
di: Ding, Xueying, et al.
Pubblicazione: (2026)
Mitigating Estimation Bias with Representation Learning in TD Error-Driven Regularization
di: Chen, Haohui, et al.
Pubblicazione: (2025)
di: Chen, Haohui, et al.
Pubblicazione: (2025)
HDPO: Hybrid Distillation Policy Optimization via Privileged Self-Distillation
di: Ding, Ken
Pubblicazione: (2026)
di: Ding, Ken
Pubblicazione: (2026)
Eliminating Inductive Bias in Reward Models with Information-Theoretic Guidance
di: Li, Zhuo, et al.
Pubblicazione: (2025)
di: Li, Zhuo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Avoiding Leakage Poisoning: Concept Interventions Under Distribution Shifts
di: Zarlenga, Mateo Espinosa, et al.
Pubblicazione: (2025) -
Digging Deeper: Learning Multi-Level Concept Hierarchies
di: Hill, Oscar, et al.
Pubblicazione: (2026) -
Hierarchical Concept-based Interpretable Models
di: Hill, Oscar, et al.
Pubblicazione: (2026) -
Learning to Receive Help: Intervention-Aware Concept Embedding Models
di: Zarlenga, Mateo Espinosa, et al.
Pubblicazione: (2023) -
Do Concept Bottleneck Models Respect Localities?
di: Raman, Naveen, et al.
Pubblicazione: (2024)