VersusDebias: Universal Zero-Shot Debiasing for Text-to-Image Models via SLM-Based Prompt Engineering and Generative Adversary
Fuente:
arXiv
Saved in:
| Main Authors: | Luo, Hanjun, Deng, Ziye, Huang, Haoyu, Liu, Xuecheng, Chen, Ruizhe, Liu, Zuozhu |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
FAIntbench: A Holistic and Precise Benchmark for Bias Evaluation in Text-to-Image Models
by: Luo, Hanjun, et al.
Published: (2024)
by: Luo, Hanjun, et al.
Published: (2024)
BiasIG: Benchmarking Multi-dimensional Social Biases in Text-to-Image Models
by: Luo, Hanjun, et al.
Published: (2026)
by: Luo, Hanjun, et al.
Published: (2026)
BIGbench: A Unified Benchmark for Evaluating Multi-dimensional Social Biases in Text-to-Image Models
by: Luo, Hanjun, et al.
Published: (2024)
by: Luo, Hanjun, et al.
Published: (2024)
DebiasPI: Inference-time Debiasing by Prompt Iteration of a Text-to-Image Generative Model
by: Bonna, Sarah, et al.
Published: (2025)
by: Bonna, Sarah, et al.
Published: (2025)
AutoDebias: Automated Framework for Debiasing Text-to-Image Models
by: Cai, Hongyi, et al.
Published: (2025)
by: Cai, Hongyi, et al.
Published: (2025)
DynamicNER: A Dynamic, Multilingual, and Fine-Grained Dataset for LLM-based Named Entity Recognition
by: Luo, Hanjun, et al.
Published: (2024)
by: Luo, Hanjun, et al.
Published: (2024)
Multiple-Debias: A Full-process Debiasing Method for Multilingual Pre-trained Language Models
by: Liang, Haoyu, et al.
Published: (2026)
by: Liang, Haoyu, et al.
Published: (2026)
SDR-CIR: Semantic Debias Retrieval Framework for Training-Free Zero-Shot Composed Image Retrieval
by: Sun, Yi, et al.
Published: (2026)
by: Sun, Yi, et al.
Published: (2026)
HateDebias: On the Diversity and Variability of Hate Speech Debiasing
by: Wu, Hongyan, et al.
Published: (2024)
by: Wu, Hongyan, et al.
Published: (2024)
FairSteer: Inference Time Debiasing for LLMs with Dynamic Activation Steering
by: Li, Yichen, et al.
Published: (2025)
by: Li, Yichen, et al.
Published: (2025)
TIMA: Text-Image Mutual Awareness for Balancing Zero-Shot Adversarial Robustness and Generalization Ability
by: Ma, Fengji, et al.
Published: (2024)
by: Ma, Fengji, et al.
Published: (2024)
Self-Debias: Self-correcting for Debiasing Large Language Models
by: Feng, Xuan, et al.
Published: (2026)
by: Feng, Xuan, et al.
Published: (2026)
BiasGuard: A Reasoning-enhanced Bias Detection Tool For Large Language Models
by: Fan, Zhiting, et al.
Published: (2025)
by: Fan, Zhiting, et al.
Published: (2025)
Prompting Fairness: Integrating Causality to Debias Large Language Models
by: Li, Jingling, et al.
Published: (2024)
by: Li, Jingling, et al.
Published: (2024)
RobustDebias: Debiasing Language Models using Distributionally Robust Optimization
by: Gandhi, Deep, et al.
Published: (2026)
by: Gandhi, Deep, et al.
Published: (2026)
Debias Can be Unreliable: Mitigating Bias Issue in Evaluating Debiasing Recommendation
by: Wang, Chengbing, et al.
Published: (2024)
by: Wang, Chengbing, et al.
Published: (2024)
EMO-Debias: Benchmarking Gender Debiasing Techniques in Multi-Label Speech Emotion Recognition
by: Lin, Yi-Cheng, et al.
Published: (2025)
by: Lin, Yi-Cheng, et al.
Published: (2025)
Debias-CLR: A Contrastive Learning Based Debiasing Method for Algorithmic Fairness in Healthcare Applications
by: Agarwal, Ankita, et al.
Published: (2024)
by: Agarwal, Ankita, et al.
Published: (2024)
Text Prompt Injection of Vision Language Models
by: Zhu, Ruizhe
Published: (2025)
by: Zhu, Ruizhe
Published: (2025)
The Impact of Prompts on Zero-Shot Detection of AI-Generated Text
by: Taguchi, Kaito, et al.
Published: (2024)
by: Taguchi, Kaito, et al.
Published: (2024)
Pseudo-label Based Domain Adaptation for Zero-Shot Text Steganalysis
by: Luo, Yufei, et al.
Published: (2024)
by: Luo, Yufei, et al.
Published: (2024)
PAD: Personalized Alignment of LLMs at Decoding-Time
by: Chen, Ruizhe, et al.
Published: (2024)
by: Chen, Ruizhe, et al.
Published: (2024)
FreqDebias: Towards Generalizable Deepfake Detection via Consistency-Driven Frequency Debiasing
by: Kashiani, Hossein, et al.
Published: (2025)
by: Kashiani, Hossein, et al.
Published: (2025)
Self-Improving for Zero-Shot Named Entity Recognition with Large Language Models
by: Xie, Tingyu, et al.
Published: (2023)
by: Xie, Tingyu, et al.
Published: (2023)
Learning by Imagining: Debiased Feature Augmentation for Compositional Zero-Shot Learning
by: Zhang, Haozhe, et al.
Published: (2025)
by: Zhang, Haozhe, et al.
Published: (2025)
Representation-Level Counterfactual Calibration for Debiased Zero-Shot Recognition
by: Peng, Pei, et al.
Published: (2025)
by: Peng, Pei, et al.
Published: (2025)
Med-GLIP: Advancing Medical Language-Image Pre-training with Large-scale Grounded Dataset
by: Deng, Ziye, et al.
Published: (2025)
by: Deng, Ziye, et al.
Published: (2025)
Persona-judge: Personalized Alignment of Large Language Models via Token-level Self-judgment
by: Zhang, Xiaotian, et al.
Published: (2025)
by: Zhang, Xiaotian, et al.
Published: (2025)
Large Language Model Bias Mitigation from the Perspective of Knowledge Editing
by: Chen, Ruizhe, et al.
Published: (2024)
by: Chen, Ruizhe, et al.
Published: (2024)
FairMT-Bench: Benchmarking Fairness for Multi-turn Dialogue in Conversational LLMs
by: Fan, Zhiting, et al.
Published: (2024)
by: Fan, Zhiting, et al.
Published: (2024)
BiasAlert: A Plug-and-play Tool for Social Bias Detection in LLMs
by: Fan, Zhiting, et al.
Published: (2024)
by: Fan, Zhiting, et al.
Published: (2024)
Learnable Privacy Neurons Localization in Language Models
by: Chen, Ruizhe, et al.
Published: (2024)
by: Chen, Ruizhe, et al.
Published: (2024)
Value-Aligned Prompt Moderation via Zero-Shot Agentic Rewriting for Safe Image Generation
by: Zhao, Xin, et al.
Published: (2025)
by: Zhao, Xin, et al.
Published: (2025)
SLM-TTA: A Framework for Test-Time Adaptation of Generative Spoken Language Models
by: Wu, Yuan-Kuei, et al.
Published: (2025)
by: Wu, Yuan-Kuei, et al.
Published: (2025)
Can we Debias Social Stereotypes in AI-Generated Images? Examining Text-to-Image Outputs and User Perceptions
by: Barve, Saharsh, et al.
Published: (2025)
by: Barve, Saharsh, et al.
Published: (2025)
Zero-Shot Detection of LLM-Generated Text via Implicit Reward Model
by: Liu, Runheng, et al.
Published: (2026)
by: Liu, Runheng, et al.
Published: (2026)
Zero-Shot Styled Text Image Generation, but Make It Autoregressive
by: Pippi, Vittorio, et al.
Published: (2025)
by: Pippi, Vittorio, et al.
Published: (2025)
Complementary Text-Guided Attention for Zero-Shot Adversarial Robustness
by: Yu, Lu, et al.
Published: (2026)
by: Yu, Lu, et al.
Published: (2026)
Unleashing Text-to-Image Diffusion Prior for Zero-Shot Image Captioning
by: Luo, Jianjie, et al.
Published: (2024)
by: Luo, Jianjie, et al.
Published: (2024)
Zero-Shot Industrial Anomaly Segmentation with Image-Aware Prompt Generation
by: Park, SoYoung, et al.
Published: (2025)
by: Park, SoYoung, et al.
Published: (2025)
Similar Items
-
FAIntbench: A Holistic and Precise Benchmark for Bias Evaluation in Text-to-Image Models
by: Luo, Hanjun, et al.
Published: (2024) -
BiasIG: Benchmarking Multi-dimensional Social Biases in Text-to-Image Models
by: Luo, Hanjun, et al.
Published: (2026) -
BIGbench: A Unified Benchmark for Evaluating Multi-dimensional Social Biases in Text-to-Image Models
by: Luo, Hanjun, et al.
Published: (2024) -
DebiasPI: Inference-time Debiasing by Prompt Iteration of a Text-to-Image Generative Model
by: Bonna, Sarah, et al.
Published: (2025) -
AutoDebias: Automated Framework for Debiasing Text-to-Image Models
by: Cai, Hongyi, et al.
Published: (2025)