Evaluating Model Bias Requires Characterizing its Mistakes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Albuquerque, Isabela, Schrouff, Jessica, Warde-Farley, David, Cemgil, Taylan, Gowal, Sven, Wiles, Olivia |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluating Numerical Reasoning in Text-to-Image Models
par: Kajić, Ivana, et autres
Publié: (2024)
par: Kajić, Ivana, et autres
Publié: (2024)
Benchmarking Diversity in Image Generation via Attribute-Conditional Human Evaluation
par: Albuquerque, Isabela, et autres
Publié: (2025)
par: Albuquerque, Isabela, et autres
Publié: (2025)
Mind the Graph When Balancing Data for Fairness or Robustness
par: Schrouff, Jessica, et autres
Publié: (2024)
par: Schrouff, Jessica, et autres
Publié: (2024)
Dynamic Classifier-Free Diffusion Guidance via Online Feedback
par: Papalampidi, Pinelopi, et autres
Publié: (2025)
par: Papalampidi, Pinelopi, et autres
Publié: (2025)
On the Difficulty of Constructing a Robust and Publicly-Detectable Watermark
par: Fairoze, Jaiden, et autres
Publié: (2025)
par: Fairoze, Jaiden, et autres
Publié: (2025)
Evaluating LLMs in Finance Requires Explicit Bias Consideration
par: Kong, Yaxuan, et autres
Publié: (2026)
par: Kong, Yaxuan, et autres
Publié: (2026)
FunBO: Discovering Acquisition Functions for Bayesian Optimization with FunSearch
par: Aglietti, Virginia, et autres
Publié: (2024)
par: Aglietti, Virginia, et autres
Publié: (2024)
Learn from Your Mistakes: Self-Correcting Masked Diffusion Models
par: Schiff, Yair, et autres
Publié: (2026)
par: Schiff, Yair, et autres
Publié: (2026)
Rich Insights from Cheap Signals: Efficient Evaluations via Tensor Factorization
par: Polo, Felipe Maia, et autres
Publié: (2026)
par: Polo, Felipe Maia, et autres
Publié: (2026)
Mistake-Bounded Language Generation
par: Kleinberg, Jon, et autres
Publié: (2026)
par: Kleinberg, Jon, et autres
Publié: (2026)
Optimal Mistake Bounds for Transductive Online Learning
par: Chase, Zachary, et autres
Publié: (2025)
par: Chase, Zachary, et autres
Publié: (2025)
Exposing the Achilles' Heel: Evaluating LLMs Ability to Handle Mistakes in Mathematical Reasoning
par: Singh, Joykirat, et autres
Publié: (2024)
par: Singh, Joykirat, et autres
Publié: (2024)
Mitigating LLM Hallucinations via Conformal Abstention
par: Yadkori, Yasin Abbasi, et autres
Publié: (2024)
par: Yadkori, Yasin Abbasi, et autres
Publié: (2024)
AsymVLM: Asymmetric Token Pruning for Efficient Vision-Language Model Inference
par: Feng, Yilin, et autres
Publié: (2026)
par: Feng, Yilin, et autres
Publié: (2026)
Improving SAM Requires Rethinking its Optimization Formulation
par: Xie, Wanyun, et autres
Publié: (2024)
par: Xie, Wanyun, et autres
Publié: (2024)
Generalizing to unseen domains via distribution matching
par: Albuquerque, Isabela, et autres
Publié: (2019)
par: Albuquerque, Isabela, et autres
Publié: (2019)
AI Oversight and Human Mistakes: Evidence from Centre Court
par: Almog, David, et autres
Publié: (2024)
par: Almog, David, et autres
Publié: (2024)
Distributionally Robust K-Means Clustering
par: Malik, Vikrant, et autres
Publié: (2026)
par: Malik, Vikrant, et autres
Publié: (2026)
Don't Waste Mistakes: Leveraging Negative RL-Groups via Confidence Reweighting
par: Feng, Yunzhen, et autres
Publié: (2025)
par: Feng, Yunzhen, et autres
Publié: (2025)
Evaluating Fairness in Transaction Fraud Models: Fairness Metrics, Bias Audits, and Challenges
par: Kamalaruban, Parameswaran, et autres
Publié: (2024)
par: Kamalaruban, Parameswaran, et autres
Publié: (2024)
On-Policy Distillation of Language Models: Learning from Self-Generated Mistakes
par: Agarwal, Rishabh, et autres
Publié: (2023)
par: Agarwal, Rishabh, et autres
Publié: (2023)
Automatic Replication of LLM Mistakes in Medical Conversations
par: Proniakin, Oleksii, et autres
Publié: (2025)
par: Proniakin, Oleksii, et autres
Publié: (2025)
Mistake-bounded online learning with operation caps
par: Geneson, Jesse, et autres
Publié: (2025)
par: Geneson, Jesse, et autres
Publié: (2025)
Automatic Detection and Analysis of Singing Mistakes for Music Pedagogy
par: Kumar, Sumit, et autres
Publié: (2026)
par: Kumar, Sumit, et autres
Publié: (2026)
Neural Compression of Atmospheric States
par: Mirowski, Piotr, et autres
Publié: (2024)
par: Mirowski, Piotr, et autres
Publié: (2024)
Understanding-Enhanced Model Collaboration for Long-Tailed Egocentric Mistake Detection
par: Han, Boyu, et autres
Publié: (2026)
par: Han, Boyu, et autres
Publié: (2026)
Gaining Wisdom from Setbacks: Aligning Large Language Models via Mistake Analysis
par: Chen, Kai, et autres
Publié: (2023)
par: Chen, Kai, et autres
Publié: (2023)
On Mitigating Affinity Bias through Bandits with Evolving Biased Feedback
par: Faw, Matthew, et autres
Publié: (2025)
par: Faw, Matthew, et autres
Publié: (2025)
TIDES: Implicit Time-Awareness in Selective State Space Models
par: Soydan, Taylan, et autres
Publié: (2026)
par: Soydan, Taylan, et autres
Publié: (2026)
On the Growth of Mistakes in Differentially Private Online Learning: A Lower Bound Perspective
par: Dmitriev, Daniil, et autres
Publié: (2024)
par: Dmitriev, Daniil, et autres
Publié: (2024)
Evaluating AI systems under uncertain ground truth: a case study in dermatology
par: Stutz, David, et autres
Publié: (2023)
par: Stutz, David, et autres
Publié: (2023)
Bias in Large Language Models: Origin, Evaluation, and Mitigation
par: Guo, Yufei, et autres
Publié: (2024)
par: Guo, Yufei, et autres
Publié: (2024)
Fighting Sampling Bias: A Framework for Training and Evaluating Credit Scoring Models
par: Kozodoi, Nikita, et autres
Publié: (2024)
par: Kozodoi, Nikita, et autres
Publié: (2024)
CEM: A Data-Efficient Method for Large Language Models to Continue Evolving From Mistakes
par: Zhao, Haokun, et autres
Publié: (2024)
par: Zhao, Haokun, et autres
Publié: (2024)
Soft-prompt Tuning for Large Language Models to Evaluate Bias
par: Tian, Jacob-Junqi, et autres
Publié: (2023)
par: Tian, Jacob-Junqi, et autres
Publié: (2023)
Mistake, Manipulation and Margin Guarantees in Online Strategic Classification
par: Shen, Lingqing, et autres
Publié: (2024)
par: Shen, Lingqing, et autres
Publié: (2024)
Worst-Group Equalized Odds Regularization for Multi-Attribute Fair Medical Image Classification
par: Kurian, Nikhil Cherian, et autres
Publié: (2026)
par: Kurian, Nikhil Cherian, et autres
Publié: (2026)
Tradeoffs between Mistakes and ERM Oracle Calls in Online and Transductive Online Learning
par: Attias, Idan, et autres
Publié: (2025)
par: Attias, Idan, et autres
Publié: (2025)
Pairwise or Pointwise? Evaluating Feedback Protocols for Bias in LLM-Based Evaluation
par: Tripathi, Tuhina, et autres
Publié: (2025)
par: Tripathi, Tuhina, et autres
Publié: (2025)
Class-wise Autoencoders Measure Classification Difficulty And Detect Label Mistakes
par: Marks, Jacob, et autres
Publié: (2024)
par: Marks, Jacob, et autres
Publié: (2024)
Documents similaires
-
Evaluating Numerical Reasoning in Text-to-Image Models
par: Kajić, Ivana, et autres
Publié: (2024) -
Benchmarking Diversity in Image Generation via Attribute-Conditional Human Evaluation
par: Albuquerque, Isabela, et autres
Publié: (2025) -
Mind the Graph When Balancing Data for Fairness or Robustness
par: Schrouff, Jessica, et autres
Publié: (2024) -
Dynamic Classifier-Free Diffusion Guidance via Online Feedback
par: Papalampidi, Pinelopi, et autres
Publié: (2025) -
On the Difficulty of Constructing a Robust and Publicly-Detectable Watermark
par: Fairoze, Jaiden, et autres
Publié: (2025)