Fostering the Ecosystem of AI for Social Impact Requires Expanding and Strengthening Evaluation Standards
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wilder, Bryan, Zhou, Angela |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AI Supply Chains: An Emerging Ecosystem of AI Actors, Products, and Services
par: Hopkins, Aspen, et autres
Publié: (2025)
par: Hopkins, Aspen, et autres
Publié: (2025)
Auditing Fairness under Unobserved Confounding
par: Byun, Yewon, et autres
Publié: (2024)
par: Byun, Yewon, et autres
Publié: (2024)
NeurIPS Should Require Reproducibility Standards for Frontier AI Safety Claims
par: Vishwarupe, Varad, et autres
Publié: (2026)
par: Vishwarupe, Varad, et autres
Publié: (2026)
Who Evaluates AI's Social Impacts? Mapping Coverage and Gaps in First and Third Party Evaluations
par: Reuel, Anka, et autres
Publié: (2025)
par: Reuel, Anka, et autres
Publié: (2025)
Healthcare LLM Benchmarks Are Only as Good as Their Explicit Assumptions
par: Raman, Naveen, et autres
Publié: (2026)
par: Raman, Naveen, et autres
Publié: (2026)
Auditing Fairness by Betting
par: Chugg, Ben, et autres
Publié: (2023)
par: Chugg, Ben, et autres
Publié: (2023)
Ecosystem Graphs: The Social Footprint of Foundation Models
par: Bommasani, Rishi, et autres
Publié: (2023)
par: Bommasani, Rishi, et autres
Publié: (2023)
Farsight: Fostering Responsible AI Awareness During AI Application Prototyping
par: Wang, Zijie J., et autres
Publié: (2024)
par: Wang, Zijie J., et autres
Publié: (2024)
Towards Standardizing AI Bias Exploration
par: Krasanakis, Emmanouil, et autres
Publié: (2024)
par: Krasanakis, Emmanouil, et autres
Publié: (2024)
Rigor in AI: Doing Rigorous AI Work Requires a Broader, Responsible AI-Informed Conception of Rigor
par: Olteanu, Alexandra, et autres
Publié: (2025)
par: Olteanu, Alexandra, et autres
Publié: (2025)
AI for Scientific Discovery is a Social Problem
par: Channing, Georgia, et autres
Publié: (2025)
par: Channing, Georgia, et autres
Publié: (2025)
Continuous Pupillography: A Case for Visual Health Ecosystem
par: Younus, Usama, et autres
Publié: (2024)
par: Younus, Usama, et autres
Publié: (2024)
Bridging Prediction and Intervention Problems in Social Systems
par: Liu, Lydia T., et autres
Publié: (2025)
par: Liu, Lydia T., et autres
Publié: (2025)
Facets of Disparate Impact: Evaluating Legally Consistent Bias in Machine Learning
par: Briscoe, Jarren, et autres
Publié: (2025)
par: Briscoe, Jarren, et autres
Publié: (2025)
Measurement to Meaning: A Validity-Centered Framework for AI Evaluation
par: Salaudeen, Olawale, et autres
Publié: (2025)
par: Salaudeen, Olawale, et autres
Publié: (2025)
Auditing LLMs for Algorithmic Fairness in Casenote-Augmented Tabular Prediction
par: Lee, Xiao Qi, et autres
Publié: (2026)
par: Lee, Xiao Qi, et autres
Publié: (2026)
Standardizing Intelligence: Aligning Generative AI for Regulatory and Operational Compliance
par: Imperial, Joseph Marvin, et autres
Publié: (2025)
par: Imperial, Joseph Marvin, et autres
Publié: (2025)
How Green Can AI Be? A Study of Trends in Machine Learning Environmental Impacts
par: Morand, Clément, et autres
Publié: (2024)
par: Morand, Clément, et autres
Publié: (2024)
Fair Machine Learning for Healthcare Requires Recognizing the Intersectionality of Sociodemographic Factors, a Case Study
par: Valentine, Alissa A., et autres
Publié: (2024)
par: Valentine, Alissa A., et autres
Publié: (2024)
Stronger Baseline Models -- A Key Requirement for Aligning Machine Learning Research with Clinical Utility
par: Wolfrath, Nathan, et autres
Publié: (2024)
par: Wolfrath, Nathan, et autres
Publié: (2024)
Risk Sources and Risk Management Measures in Support of Standards for General-Purpose AI Systems
par: Gipiškis, Rokas, et autres
Publié: (2024)
par: Gipiškis, Rokas, et autres
Publié: (2024)
On Prediction-Modelers and Decision-Makers: Why Fairness Requires More Than a Fair Prediction Model
par: Scantamburlo, Teresa, et autres
Publié: (2023)
par: Scantamburlo, Teresa, et autres
Publié: (2023)
Bridging the gap: Towards an Expanded Toolkit for AI-driven Decision-Making in the Public Sector
par: Fischer-Abaigar, Unai, et autres
Publié: (2023)
par: Fischer-Abaigar, Unai, et autres
Publié: (2023)
Towards Socially and Environmentally Responsible AI
par: Li, Pengfei, et autres
Publié: (2024)
par: Li, Pengfei, et autres
Publié: (2024)
Allocation Requires Prediction Only if Inequality Is Low
par: Shirali, Ali, et autres
Publié: (2024)
par: Shirali, Ali, et autres
Publié: (2024)
Learning Progression-Guided AI Evaluation of Scientific Models To Support Diverse Multi-Modal Understanding in NGSS Classroom
par: Kaldaras, Leonora, et autres
Publié: (2025)
par: Kaldaras, Leonora, et autres
Publié: (2025)
Generalization in Healthcare AI: Evaluation of a Clinical Large Language Model
par: Rahman, Salman, et autres
Publié: (2024)
par: Rahman, Salman, et autres
Publié: (2024)
Computational Approaches to Understanding Large Language Model Impact on Writing and Information Ecosystems
par: Liang, Weixin
Publié: (2025)
par: Liang, Weixin
Publié: (2025)
Integrating Social Determinants of Health into Knowledge Graphs: Evaluating Prediction Bias and Fairness in Healthcare
par: Shang, Tianqi, et autres
Publié: (2024)
par: Shang, Tianqi, et autres
Publié: (2024)
Deterministic AI Agent Personality Expression through Standard Psychological Diagnostics
par: Kruijssen, J. M. Diederik, et autres
Publié: (2025)
par: Kruijssen, J. M. Diederik, et autres
Publié: (2025)
Artificial Intelligence Ecosystem for Automating Self-Directed Teaching
par: Gotavade, Tejas Satish
Publié: (2024)
par: Gotavade, Tejas Satish
Publié: (2024)
The ATOM Report: Measuring the Open Language Model Ecosystem
par: Lambert, Nathan, et autres
Publié: (2026)
par: Lambert, Nathan, et autres
Publié: (2026)
"They've Stolen My GPL-Licensed Model!": Toward Standardized and Transparent Model Licensing
par: Duan, Moming, et autres
Publié: (2024)
par: Duan, Moming, et autres
Publié: (2024)
Measuring and Fostering Peace through Machine Learning and Artificial Intelligence
par: Gilda, P., et autres
Publié: (2026)
par: Gilda, P., et autres
Publié: (2026)
Evaluating LLMs for Demographic-Targeted Social Bias Detection: A Comprehensive Benchmark Study
par: Majumdar, Ayan, et autres
Publié: (2025)
par: Majumdar, Ayan, et autres
Publié: (2025)
Holistically Evaluating the Environmental Impact of Creating Language Models
par: Morrison, Jacob, et autres
Publié: (2025)
par: Morrison, Jacob, et autres
Publié: (2025)
What Makes An Expert? Reviewing How ML Researchers Define "Expert"
par: Díaz, Mark, et autres
Publié: (2024)
par: Díaz, Mark, et autres
Publié: (2024)
The Malicious Technical Ecosystem: Exposing Limitations in Technical Governance of AI-Generated Non-Consensual Intimate Images of Adults
par: Ding, Michelle L., et autres
Publié: (2025)
par: Ding, Michelle L., et autres
Publié: (2025)
Comparing Targeting Strategies for Maximizing Social Welfare with Limited Resources
par: Sharma, Vibhhu, et autres
Publié: (2024)
par: Sharma, Vibhhu, et autres
Publié: (2024)
Batch-Adaptive Causal Annotations
par: Nwankwo, Ezinne, et autres
Publié: (2025)
par: Nwankwo, Ezinne, et autres
Publié: (2025)
Documents similaires
-
AI Supply Chains: An Emerging Ecosystem of AI Actors, Products, and Services
par: Hopkins, Aspen, et autres
Publié: (2025) -
Auditing Fairness under Unobserved Confounding
par: Byun, Yewon, et autres
Publié: (2024) -
NeurIPS Should Require Reproducibility Standards for Frontier AI Safety Claims
par: Vishwarupe, Varad, et autres
Publié: (2026) -
Who Evaluates AI's Social Impacts? Mapping Coverage and Gaps in First and Third Party Evaluations
par: Reuel, Anka, et autres
Publié: (2025) -
Healthcare LLM Benchmarks Are Only as Good as Their Explicit Assumptions
par: Raman, Naveen, et autres
Publié: (2026)