Disclosure and Evaluation as Fairness Interventions for General-Purpose AI
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Raman, Vyoma, Shen, Judy Hanwen, Zhang, Andy K., Gailmard, Lindsey, Bommasani, Rishi, Ho, Daniel E., Wang, Angelina |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Limits of AI Data Transparency Policy: Three Disclosure Fallacies
par: Shen, Judy Hanwen, et autres
Publié: (2026)
par: Shen, Judy Hanwen, et autres
Publié: (2026)
The Societal Impact of Foundation Models: Advancing Evidence-based AI Policy
par: Bommasani, Rishi
Publié: (2025)
par: Bommasani, Rishi
Publié: (2025)
Assessing Human Rights Risks in AI: A Framework for Model Evaluation
par: Raman, Vyoma, et autres
Publié: (2025)
par: Raman, Vyoma, et autres
Publié: (2025)
Effective Mitigations for Systemic Risks from General-Purpose AI
par: Uuk, Risto, et autres
Publié: (2024)
par: Uuk, Risto, et autres
Publié: (2024)
Do AI Companies Make Good on Voluntary Commitments to the White House?
par: Wang, Jennifer, et autres
Publié: (2025)
par: Wang, Jennifer, et autres
Publié: (2025)
How AI Impacts Skill Formation
par: Shen, Judy Hanwen, et autres
Publié: (2026)
par: Shen, Judy Hanwen, et autres
Publié: (2026)
The California Report on Frontier AI Policy
par: Bommasani, Rishi, et autres
Publié: (2025)
par: Bommasani, Rishi, et autres
Publié: (2025)
Societal Impacts Research Requires Benchmarks for Creative Composition Tasks
par: Shen, Judy Hanwen, et autres
Publié: (2025)
par: Shen, Judy Hanwen, et autres
Publié: (2025)
Fairness through Difference Awareness: Measuring Desired Group Discrimination in LLMs
par: Wang, Angelina, et autres
Publié: (2025)
par: Wang, Angelina, et autres
Publié: (2025)
NeurIPS should lead scientific consensus on AI policy
par: Bommasani, Rishi
Publié: (2025)
par: Bommasani, Rishi
Publié: (2025)
Beyond Release: Access Considerations for Generative AI Systems
par: Solaiman, Irene, et autres
Publié: (2025)
par: Solaiman, Irene, et autres
Publié: (2025)
Evaluating General-Purpose AI with Psychometrics
par: Wang, Xiting, et autres
Publié: (2023)
par: Wang, Xiting, et autres
Publié: (2023)
Language model developers should report train-test overlap
par: Zhang, Andy K, et autres
Publié: (2024)
par: Zhang, Andy K, et autres
Publié: (2024)
Two Tickets are Better than One: Fair and Accurate Hiring Under Strategic LLM Manipulations
par: Cohen, Lee, et autres
Publié: (2025)
par: Cohen, Lee, et autres
Publié: (2025)
STREAM (ChemBio): A Standard for Transparently Reporting Evaluations in AI Model Reports
par: McCaslin, Tegan, et autres
Publié: (2025)
par: McCaslin, Tegan, et autres
Publié: (2025)
Identities are not Interchangeable: The Problem of Overgeneralization in Fair Machine Learning
par: Wang, Angelina
Publié: (2025)
par: Wang, Angelina
Publié: (2025)
AI Risk-Management Standards Profile for General-Purpose AI (GPAI) and Foundation Models
par: Barrett, Anthony M., et autres
Publié: (2025)
par: Barrett, Anthony M., et autres
Publié: (2025)
Investigating Data Interventions for Subgroup Fairness: An ICU Case Study
par: Tan, Erin, et autres
Publié: (2026)
par: Tan, Erin, et autres
Publié: (2026)
Algorithmic Monocultures in Hiring
par: Bommasani, Rishi, et autres
Publié: (2026)
par: Bommasani, Rishi, et autres
Publié: (2026)
A Taxonomy of Systemic Risks from General-Purpose AI
par: Uuk, Risto, et autres
Publié: (2024)
par: Uuk, Risto, et autres
Publié: (2024)
Distinguishing Task-Specific and General-Purpose AI in Regulation
par: Wang, Jennifer, et autres
Publié: (2025)
par: Wang, Jennifer, et autres
Publié: (2025)
Ecosystem Graphs: The Social Footprint of Foundation Models
par: Bommasani, Rishi, et autres
Publié: (2023)
par: Bommasani, Rishi, et autres
Publié: (2023)
FairWire: Fair Graph Generation
par: Kose, O. Deniz, et autres
Publié: (2024)
par: Kose, O. Deniz, et autres
Publié: (2024)
The Dilemma of Uncertainty Estimation for General Purpose AI in the EU AI Act
par: Valdenegro-Toro, Matias, et autres
Publié: (2024)
par: Valdenegro-Toro, Matias, et autres
Publié: (2024)
In-House Evaluation Is Not Enough: Towards Robust Third-Party Flaw Disclosure for General-Purpose AI
par: Longpre, Shayne, et autres
Publié: (2025)
par: Longpre, Shayne, et autres
Publié: (2025)
Designing Incident Reporting Systems for Harms from General-Purpose AI
par: Wei, Kevin, et autres
Publié: (2025)
par: Wei, Kevin, et autres
Publié: (2025)
Ecosystem-level Analysis of Deployed Machine Learning Reveals Homogeneous Outcomes
par: Toups, Connor, et autres
Publié: (2023)
par: Toups, Connor, et autres
Publié: (2023)
The 2024 Foundation Model Transparency Index
par: Bommasani, Rishi, et autres
Publié: (2024)
par: Bommasani, Rishi, et autres
Publié: (2024)
Advancing Science- and Evidence-based AI Policy
par: Bommasani, Rishi, et autres
Publié: (2025)
par: Bommasani, Rishi, et autres
Publié: (2025)
When Is Self-Disclosure Optimal? Incentives and Governance of AI-Generated Content
par: Wu, Juan, et autres
Publié: (2026)
par: Wu, Juan, et autres
Publié: (2026)
Copyright Laundering Through the AI Ouroboros: Adapting the 'Fruit of the Poisonous Tree' Doctrine to Recursive AI Training
par: Mukherjee, Anirban, et autres
Publié: (2026)
par: Mukherjee, Anirban, et autres
Publié: (2026)
Toward an Evaluation Science for Generative AI Systems
par: Weidinger, Laura, et autres
Publié: (2025)
par: Weidinger, Laura, et autres
Publié: (2025)
Risk Sources and Risk Management Measures in Support of Standards for General-Purpose AI Systems
par: Gipiškis, Rokas, et autres
Publié: (2024)
par: Gipiškis, Rokas, et autres
Publié: (2024)
The Case for ESM3 as a General-Purpose AI Model with Systemic Risk Under the EU AI Act
par: Qureshi, Taro, et autres
Publié: (2026)
par: Qureshi, Taro, et autres
Publié: (2026)
Art-ificial Intelligence: The Effect of AI Disclosure on Evaluations of Creative Content
par: Raj, Manav, et autres
Publié: (2023)
par: Raj, Manav, et autres
Publié: (2023)
Agentic AI: Autonomy, Accountability, and the Algorithmic Society
par: Mukherjee, Anirban, et autres
Publié: (2025)
par: Mukherjee, Anirban, et autres
Publié: (2025)
Privacy Risks of General-Purpose AI Systems: A Foundation for Investigating Practitioner Perspectives
par: Meisenbacher, Stephen, et autres
Publié: (2024)
par: Meisenbacher, Stephen, et autres
Publié: (2024)
Purposeful remixing with generative AI: Constructing designer voice in multimodal composing
par: Tan, Xiao, et autres
Publié: (2024)
par: Tan, Xiao, et autres
Publié: (2024)
Strategies for Increasing Corporate Responsible AI Prioritization
par: Wang, Angelina, et autres
Publié: (2024)
par: Wang, Angelina, et autres
Publié: (2024)
Trustworthy Social Bias Measurement
par: Bommasani, Rishi, et autres
Publié: (2022)
par: Bommasani, Rishi, et autres
Publié: (2022)
Documents similaires
-
The Limits of AI Data Transparency Policy: Three Disclosure Fallacies
par: Shen, Judy Hanwen, et autres
Publié: (2026) -
The Societal Impact of Foundation Models: Advancing Evidence-based AI Policy
par: Bommasani, Rishi
Publié: (2025) -
Assessing Human Rights Risks in AI: A Framework for Model Evaluation
par: Raman, Vyoma, et autres
Publié: (2025) -
Effective Mitigations for Systemic Risks from General-Purpose AI
par: Uuk, Risto, et autres
Publié: (2024) -
Do AI Companies Make Good on Voluntary Commitments to the White House?
par: Wang, Jennifer, et autres
Publié: (2025)