Mitigating Selection Bias with Node Pruning and Auxiliary Options
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Choi, Hyeong Kyu, Xu, Weijie, Xue, Chi, Eckman, Stephanie, Reddy, Chandan K. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SATA-BENCH: Select All That Apply Benchmark for Multiple Choice Questions
par: Xu, Weijie, et autres
Publié: (2025)
par: Xu, Weijie, et autres
Publié: (2025)
The Personalization Trap: How User Memory Alters Emotional Reasoning in LLMs
par: Fang, Xi, et autres
Publié: (2025)
par: Fang, Xi, et autres
Publié: (2025)
FalseReject: A Resource for Improving Contextual Safety and Mitigating Over-Refusals in LLMs via Structured Reasoning
par: Zhang, Zhehao, et autres
Publié: (2025)
par: Zhang, Zhehao, et autres
Publié: (2025)
ModeX: Evaluator-Free Best-of-N Selection for Open-Ended Generation
par: Choi, Hyeong Kyu, et autres
Publié: (2026)
par: Choi, Hyeong Kyu, et autres
Publié: (2026)
When Identity Skews Debate: Anonymization for Bias-Reduced Multi-Agent Reasoning
par: Choi, Hyeong Kyu, et autres
Publié: (2025)
par: Choi, Hyeong Kyu, et autres
Publié: (2025)
Reasoning Towards Fairness: Mitigating Bias in Language Models through Reasoning-Guided Fine-Tuning
par: Kabra, Sanchit, et autres
Publié: (2025)
par: Kabra, Sanchit, et autres
Publié: (2025)
PICLe: Eliciting Diverse Behaviors from Large Language Models with Persona In-Context Learning
par: Choi, Hyeong Kyu, et autres
Publié: (2024)
par: Choi, Hyeong Kyu, et autres
Publié: (2024)
Distractor Injection Attacks on Large Reasoning Models: Characterization and Defense
par: Zhang, Zhehao, et autres
Publié: (2025)
par: Zhang, Zhehao, et autres
Publié: (2025)
Safety-Aware Fine-Tuning of Large Language Models
par: Choi, Hyeong Kyu, et autres
Publié: (2024)
par: Choi, Hyeong Kyu, et autres
Publié: (2024)
Quantifying Fairness in LLMs Beyond Tokens: A Semantic and Statistical Perspective
par: Xu, Weijie, et autres
Publié: (2025)
par: Xu, Weijie, et autres
Publié: (2025)
Stop Comparing LLM Agents Without Disclosing the Harness
par: Zhang, Yunbei, et autres
Publié: (2026)
par: Zhang, Yunbei, et autres
Publié: (2026)
Multi-View Node Pruning for Accurate Graph Representation
par: Kim, Hanjin, et autres
Publié: (2025)
par: Kim, Hanjin, et autres
Publié: (2025)
Mitigating Easy Option Bias in Multiple-Choice Question Answering
par: Zhang, Hao, et autres
Publié: (2025)
par: Zhang, Hao, et autres
Publié: (2025)
Detecting Distillation Data from Reasoning Models
par: Zhang, Hengxiang, et autres
Publié: (2025)
par: Zhang, Hengxiang, et autres
Publié: (2025)
Towards Scientific Discovery with Generative AI: Progress, Opportunities, and Challenges
par: Reddy, Chandan K, et autres
Publié: (2024)
par: Reddy, Chandan K, et autres
Publié: (2024)
BiasBusters: Uncovering and Mitigating Tool Selection Bias in Large Language Models
par: Blankenstein, Thierry, et autres
Publié: (2025)
par: Blankenstein, Thierry, et autres
Publié: (2025)
LLM-Guided Synthetic Augmentation (LGSA) for Mitigating Bias in AI Systems
par: Karri, Sai Suhruth Reddy, et autres
Publié: (2025)
par: Karri, Sai Suhruth Reddy, et autres
Publié: (2025)
Multi-Granular Node Pruning for Circuit Discovery
par: Haider, Muhammad Umair, et autres
Publié: (2025)
par: Haider, Muhammad Umair, et autres
Publié: (2025)
Mitigating Strategy-Selection Bias in Reasoning for More Effective Test-Time Scaling
par: Wu, Zongqian, et autres
Publié: (2025)
par: Wu, Zongqian, et autres
Publié: (2025)
From Ground Truth to Measurement: A Statistical Framework for Human Labeling
par: Chew, Robert, et autres
Publié: (2026)
par: Chew, Robert, et autres
Publié: (2026)
How Contaminated Is Your Benchmark? Quantifying Dataset Leakage in Large Language Models with Kernel Divergence
par: Choi, Hyeong Kyu, et autres
Publié: (2025)
par: Choi, Hyeong Kyu, et autres
Publié: (2025)
Mitigating Degree Bias Adaptively with Hard-to-Learn Nodes in Graph Contrastive Learning
par: Hu, Jingyu, et autres
Publié: (2025)
par: Hu, Jingyu, et autres
Publié: (2025)
Mitigating the Structural Bias in Graph Adversarial Defenses
par: Fang, Junyuan, et autres
Publié: (2025)
par: Fang, Junyuan, et autres
Publié: (2025)
Improving Commonsense Bias Classification by Mitigating the Influence of Demographic Terms
par: Lee, JinKyu, et autres
Publié: (2024)
par: Lee, JinKyu, et autres
Publié: (2024)
Bias Fitting to Mitigate Length Bias of Reward Model in RLHF
par: Zhao, Kangwen, et autres
Publié: (2025)
par: Zhao, Kangwen, et autres
Publié: (2025)
Sycophancy Mitigation Through Reinforcement Learning with Uncertainty-Aware Adaptive Reasoning Trajectories
par: Beigi, Mohammad, et autres
Publié: (2025)
par: Beigi, Mohammad, et autres
Publié: (2025)
Catalyst: a Novel Regularizer for Structured Pruning with Auxiliary Extension of Parameter Space
par: Jung, Jaeheun, et autres
Publié: (2025)
par: Jung, Jaeheun, et autres
Publié: (2025)
Generative AI and Power Imbalances in Global Education: Frameworks for Bias Mitigation
par: Nyaaba, Matthew, et autres
Publié: (2024)
par: Nyaaba, Matthew, et autres
Publié: (2024)
FairQE: Multi-Agent Framework for Mitigating Gender Bias in Translation Quality Estimation
par: Jang, Jinhee, et autres
Publié: (2026)
par: Jang, Jinhee, et autres
Publié: (2026)
Aligned at the Start: Conceptual Groupings in LLM Embeddings
par: Khatir, Mehrdad, et autres
Publié: (2024)
par: Khatir, Mehrdad, et autres
Publié: (2024)
KnowBias: Mitigating Social Bias in LLMs via Know-Bias Neuron Enhancement
par: Pan, Jinhao, et autres
Publié: (2026)
par: Pan, Jinhao, et autres
Publié: (2026)
Grade Score: Quantifying LLM Performance in Option Selection
par: Iourovitski, Dmitri
Publié: (2024)
par: Iourovitski, Dmitri
Publié: (2024)
Mitigating Query Selection Bias in Referring Video Object Segmentation
par: Zhang, Dingwei, et autres
Publié: (2025)
par: Zhang, Dingwei, et autres
Publié: (2025)
Pure Node Selection for Imbalanced Graph Node Classification
par: Zeng, Fanlong, et autres
Publié: (2025)
par: Zeng, Fanlong, et autres
Publié: (2025)
Bias Mitigation Agent: Optimizing Source Selection for Fair and Balanced Knowledge Retrieval
par: Singh, Karanbir, et autres
Publié: (2025)
par: Singh, Karanbir, et autres
Publié: (2025)
Fisher-Guided Selective Forgetting: Mitigating The Primacy Bias in Deep Reinforcement Learning
par: Falzari, Massimiliano, et autres
Publié: (2025)
par: Falzari, Massimiliano, et autres
Publié: (2025)
CogBias: Measuring and Mitigating Cognitive Bias in Large Language Models
par: Huang, Fan, et autres
Publié: (2026)
par: Huang, Fan, et autres
Publié: (2026)
VAUQ: Vision-Aware Uncertainty Quantification for LVLM Self-Evaluation
par: Park, Seongheon, et autres
Publié: (2026)
par: Park, Seongheon, et autres
Publié: (2026)
LD-Pruner: Efficient Pruning of Latent Diffusion Models using Task-Agnostic Insights
par: Castells, Thibault, et autres
Publié: (2024)
par: Castells, Thibault, et autres
Publié: (2024)
Reward Bias Substitution: Single-Axis Bias Mitigations Redirect Optimization Pressure
par: Lamparth, Max, et autres
Publié: (2026)
par: Lamparth, Max, et autres
Publié: (2026)
Documents similaires
-
SATA-BENCH: Select All That Apply Benchmark for Multiple Choice Questions
par: Xu, Weijie, et autres
Publié: (2025) -
The Personalization Trap: How User Memory Alters Emotional Reasoning in LLMs
par: Fang, Xi, et autres
Publié: (2025) -
FalseReject: A Resource for Improving Contextual Safety and Mitigating Over-Refusals in LLMs via Structured Reasoning
par: Zhang, Zhehao, et autres
Publié: (2025) -
ModeX: Evaluator-Free Best-of-N Selection for Open-Ended Generation
par: Choi, Hyeong Kyu, et autres
Publié: (2026) -
When Identity Skews Debate: Anonymization for Bias-Reduced Multi-Agent Reasoning
par: Choi, Hyeong Kyu, et autres
Publié: (2025)