NeuronTune: Towards Self-Guided Spurious Bias Mitigation
Fuente:
arXiv
Guardado en:
| Autores principales: | Zheng, Guangtao, Ye, Wenqian, Zhang, Aidong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Learning Robust Classifiers with Self-Guided Spurious Correlation Mitigation
por: Zheng, Guangtao, et al.
Publicado: (2024)
por: Zheng, Guangtao, et al.
Publicado: (2024)
Benchmarking Spurious Bias in Few-Shot Image Classifiers
por: Zheng, Guangtao, et al.
Publicado: (2024)
por: Zheng, Guangtao, et al.
Publicado: (2024)
Improving Group Robustness on Spurious Correlation via Evidential Alignment
por: Ye, Wenqian, et al.
Publicado: (2025)
por: Ye, Wenqian, et al.
Publicado: (2025)
SAGE: Spuriousness-Aware Guided Prompt Exploration for Mitigating Multimodal Bias
por: Ye, Wenqian, et al.
Publicado: (2025)
por: Ye, Wenqian, et al.
Publicado: (2025)
ShortcutProbe: Probing Prediction Shortcuts for Learning Robust Models
por: Zheng, Guangtao, et al.
Publicado: (2025)
por: Zheng, Guangtao, et al.
Publicado: (2025)
Rectifying Shortcut Behaviors in Preference-based Reward Learning
por: Ye, Wenqian, et al.
Publicado: (2025)
por: Ye, Wenqian, et al.
Publicado: (2025)
Spuriousness-Aware Meta-Learning for Learning Robust Classifiers
por: Zheng, Guangtao, et al.
Publicado: (2024)
por: Zheng, Guangtao, et al.
Publicado: (2024)
MM-SpuBench: Towards Better Understanding of Spurious Biases in Multimodal LLMs
por: Ye, Wenqian, et al.
Publicado: (2024)
por: Ye, Wenqian, et al.
Publicado: (2024)
NeuronTune: Fine-Grained Neuron Modulation for Balanced Safety-Utility Alignment in LLMs
por: Pan, Birong, et al.
Publicado: (2025)
por: Pan, Birong, et al.
Publicado: (2025)
The Clever Hans Mirage: A Comprehensive Survey on Spurious Correlations in Machine Learning
por: Ye, Wenqian, et al.
Publicado: (2024)
por: Ye, Wenqian, et al.
Publicado: (2024)
Mitigating Spurious Background Bias in Multimedia Recognition with Disentangled Concept Bottlenecks
por: Huang, Gaoxiang, et al.
Publicado: (2025)
por: Huang, Gaoxiang, et al.
Publicado: (2025)
Mitigating Spurious Correlations with Causal Logit Perturbation
por: Zhou, Xiaoling, et al.
Publicado: (2025)
por: Zhou, Xiaoling, et al.
Publicado: (2025)
The Trap of Trajectory: Towards Understanding and Mitigating Spurious Correlations in Agentic Memory
por: Tang, Luoxi, et al.
Publicado: (2026)
por: Tang, Luoxi, et al.
Publicado: (2026)
Reasoning Towards Fairness: Mitigating Bias in Language Models through Reasoning-Guided Fine-Tuning
por: Kabra, Sanchit, et al.
Publicado: (2025)
por: Kabra, Sanchit, et al.
Publicado: (2025)
Superclass-Guided Representation Disentanglement for Spurious Correlation Mitigation
por: Liu, Chenruo, et al.
Publicado: (2025)
por: Liu, Chenruo, et al.
Publicado: (2025)
Elastic Representation: Mitigating Spurious Correlations for Group Robustness
por: Wen, Tao, et al.
Publicado: (2025)
por: Wen, Tao, et al.
Publicado: (2025)
Erase or Hide? Suppressing Spurious Unlearning Neurons for Robust Unlearning
por: Yang, Nakyeong, et al.
Publicado: (2025)
por: Yang, Nakyeong, et al.
Publicado: (2025)
Shortcut Mitigation via Spurious-Positive Samples
por: Le, Phuong Quynh, et al.
Publicado: (2026)
por: Le, Phuong Quynh, et al.
Publicado: (2026)
Freeze then Train: Towards Provable Representation Learning under Spurious Correlations and Feature Noise
por: Ye, Haotian, et al.
Publicado: (2022)
por: Ye, Haotian, et al.
Publicado: (2022)
Mitigating Copy Bias in In-Context Learning through Neuron Pruning
por: Ali, Ameen, et al.
Publicado: (2024)
por: Ali, Ameen, et al.
Publicado: (2024)
Safety Mirage: How Spurious Correlations Undermine VLM Safety Fine-Tuning and Can Be Mitigated by Machine Unlearning
por: Chen, Yiwei, et al.
Publicado: (2025)
por: Chen, Yiwei, et al.
Publicado: (2025)
A Self-explaining Neural Architecture for Generalizable Concept Learning
por: Sinha, Sanchit, et al.
Publicado: (2024)
por: Sinha, Sanchit, et al.
Publicado: (2024)
Mitigating Spurious Correlations via Disagreement Probability
por: Han, Hyeonggeun, et al.
Publicado: (2024)
por: Han, Hyeonggeun, et al.
Publicado: (2024)
Unsupervised Concept Discovery Mitigates Spurious Correlations
por: Arefin, Md Rifat, et al.
Publicado: (2024)
por: Arefin, Md Rifat, et al.
Publicado: (2024)
Unsupervised Identification and Removal of Spurious Correlations During Fine-Tuning
por: Gilligan-Lee, Ciarán M., et al.
Publicado: (2026)
por: Gilligan-Lee, Ciarán M., et al.
Publicado: (2026)
Reasoning in Transformers -- Mitigating Spurious Correlations and Reasoning Shortcuts
por: Enström, Daniel, et al.
Publicado: (2024)
por: Enström, Daniel, et al.
Publicado: (2024)
The Instinctive Bias: Spurious Images lead to Illusion in MLLMs
por: Han, Tianyang, et al.
Publicado: (2024)
por: Han, Tianyang, et al.
Publicado: (2024)
Mitigating Spurious Correlations in LLMs via Causality-Aware Post-Training
por: Gui, Shurui, et al.
Publicado: (2025)
por: Gui, Shurui, et al.
Publicado: (2025)
Combating Spurious Correlations in Graph Interpretability via Self-Reflection
por: Cai, Kecheng, et al.
Publicado: (2026)
por: Cai, Kecheng, et al.
Publicado: (2026)
Diagnosing and Mitigating System Bias in Self-Rewarding RL
por: Tan, Chuyi, et al.
Publicado: (2025)
por: Tan, Chuyi, et al.
Publicado: (2025)
Quantifying and Mitigating Self-Preference Bias of LLM Judges
por: Yang, Jinming, et al.
Publicado: (2026)
por: Yang, Jinming, et al.
Publicado: (2026)
Mitigating Spurious Correlation via Distributionally Robust Learning with Hierarchical Ambiguity Sets
por: Jo, Sung Ho, et al.
Publicado: (2025)
por: Jo, Sung Ho, et al.
Publicado: (2025)
Spurious Correlations in High Dimensional Regression: The Roles of Regularization, Simplicity Bias and Over-Parameterization
por: Bombari, Simone, et al.
Publicado: (2025)
por: Bombari, Simone, et al.
Publicado: (2025)
Benchmarking Fairness in Spiking Neural Networks: Data Bias, Spurious Features, and Hardware Effects
por: He, Hudi, et al.
Publicado: (2026)
por: He, Hudi, et al.
Publicado: (2026)
Mitigating Biases for Instruction-following Language Models via Bias Neurons Elimination
por: Yang, Nakyeong, et al.
Publicado: (2023)
por: Yang, Nakyeong, et al.
Publicado: (2023)
Mitigating Spurious Correlations in Patch-wise Tumor Classification on High-Resolution Multimodal Images
por: Asaad, Ihab, et al.
Publicado: (2025)
por: Asaad, Ihab, et al.
Publicado: (2025)
Spurious Forgetting in Continual Learning of Language Models
por: Zheng, Junhao, et al.
Publicado: (2025)
por: Zheng, Junhao, et al.
Publicado: (2025)
Sebra: Debiasing Through Self-Guided Bias Ranking
por: Kappiyath, Adarsh, et al.
Publicado: (2025)
por: Kappiyath, Adarsh, et al.
Publicado: (2025)
Decompose-and-Compose: A Compositional Approach to Mitigating Spurious Correlation
por: Noohdani, Fahimeh Hosseini, et al.
Publicado: (2024)
por: Noohdani, Fahimeh Hosseini, et al.
Publicado: (2024)
Towards Unveiling Predictive Uncertainty Vulnerabilities in the Context of the Right to Be Forgotten
por: Qian, Wei, et al.
Publicado: (2025)
por: Qian, Wei, et al.
Publicado: (2025)
Ejemplares similares
-
Learning Robust Classifiers with Self-Guided Spurious Correlation Mitigation
por: Zheng, Guangtao, et al.
Publicado: (2024) -
Benchmarking Spurious Bias in Few-Shot Image Classifiers
por: Zheng, Guangtao, et al.
Publicado: (2024) -
Improving Group Robustness on Spurious Correlation via Evidential Alignment
por: Ye, Wenqian, et al.
Publicado: (2025) -
SAGE: Spuriousness-Aware Guided Prompt Exploration for Mitigating Multimodal Bias
por: Ye, Wenqian, et al.
Publicado: (2025) -
ShortcutProbe: Probing Prediction Shortcuts for Learning Robust Models
por: Zheng, Guangtao, et al.
Publicado: (2025)