Justifications for Democratizing AI Alignment and Their Prospects
Fuente:
arXiv
Salvato in:
| Autori principali: | Steingrüber, André, Baum, Kevin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Disentangling AI Alignment: A Structured Taxonomy Beyond Safety and Ethics
di: Baum, Kevin
Pubblicazione: (2025)
di: Baum, Kevin
Pubblicazione: (2025)
Breaking Up with Normatively Monolithic Agency with GRACE: A Reason-Based Neuro-Symbolic Architecture for Safe and Ethical AI Alignment
di: Jahn, Felix, et al.
Pubblicazione: (2026)
di: Jahn, Felix, et al.
Pubblicazione: (2026)
The Value of Gen-AI Conversations: A bottom-up Framework for AI Value Alignment
di: Motnikar, Lenart, et al.
Pubblicazione: (2025)
di: Motnikar, Lenart, et al.
Pubblicazione: (2025)
Bringing AI Participation Down to Scale: A Comment on Open AIs Democratic Inputs to AI Project
di: Moats, David, et al.
Pubblicazione: (2024)
di: Moats, David, et al.
Pubblicazione: (2024)
Particip-AI: A Democratic Surveying Framework for Anticipating Future AI Use Cases, Harms and Benefits
di: Mun, Jimin, et al.
Pubblicazione: (2024)
di: Mun, Jimin, et al.
Pubblicazione: (2024)
Evaluating AI Evaluation: Perils and Prospects
di: Burden, John
Pubblicazione: (2024)
di: Burden, John
Pubblicazione: (2024)
The AI Alignment Paradox
di: West, Robert, et al.
Pubblicazione: (2024)
di: West, Robert, et al.
Pubblicazione: (2024)
Artificial Authority: From Machine Minds to Political Alignments. An Experimental Analysis of Democratic and Autocratic Biases in Large-Language Models
di: Ożegalska-Łukasik, Natalia, et al.
Pubblicazione: (2025)
di: Ożegalska-Łukasik, Natalia, et al.
Pubblicazione: (2025)
Rethinking AI Cultural Alignment
di: Bravansky, Michal, et al.
Pubblicazione: (2025)
di: Bravansky, Michal, et al.
Pubblicazione: (2025)
Fair Voting Methods as a Catalyst for Democratic Resilience: A Trilogy on Legitimacy, Impact and AI Safeguarding
di: Pournaras, Evangelos
Pubblicazione: (2025)
di: Pournaras, Evangelos
Pubblicazione: (2025)
Exploring AI Writers: Technology, Impact, and Future Prospects
di: Huang, Zhiqian
Pubblicazione: (2025)
di: Huang, Zhiqian
Pubblicazione: (2025)
Are There Exceptions to Goodhart's Law? On the Moral Justification of Fairness-Aware Machine Learning
di: Weerts, Hilde, et al.
Pubblicazione: (2022)
di: Weerts, Hilde, et al.
Pubblicazione: (2022)
Understanding the Process of Human-AI Value Alignment
di: McKinlay, Jack, et al.
Pubblicazione: (2025)
di: McKinlay, Jack, et al.
Pubblicazione: (2025)
Privacy Ethics Alignment in AI: A Stakeholder-Centric Framework for Ethical AI
di: Barthwal, Ankur, et al.
Pubblicazione: (2025)
di: Barthwal, Ankur, et al.
Pubblicazione: (2025)
Whose Truth? Pluralistic Geo-Alignment for (Agentic) AI
di: Janowicz, Krzysztof, et al.
Pubblicazione: (2025)
di: Janowicz, Krzysztof, et al.
Pubblicazione: (2025)
AI-Based Reconstruction from Inherited Personal Data: Analysis, Feasibility, and Prospects
di: Zilberman, Mark
Pubblicazione: (2025)
di: Zilberman, Mark
Pubblicazione: (2025)
Modularizing Educational LLM-Agency for Fostering Responsible Learning Assistance
di: Gabelmann, Julius, et al.
Pubblicazione: (2026)
di: Gabelmann, Julius, et al.
Pubblicazione: (2026)
AI and Human Oversight: A Risk-Based Framework for Alignment
di: Kandikatla, Laxmiraju, et al.
Pubblicazione: (2025)
di: Kandikatla, Laxmiraju, et al.
Pubblicazione: (2025)
Acting for the Right Reasons: Creating Reason-Sensitive Artificial Moral Agents
di: Baum, Kevin, et al.
Pubblicazione: (2024)
di: Baum, Kevin, et al.
Pubblicazione: (2024)
Alignment, Agency and Autonomy in Frontier AI: A Systems Engineering Perspective
di: Tallam, Krti
Pubblicazione: (2025)
di: Tallam, Krti
Pubblicazione: (2025)
Using AI Alignment Theory to understand the potential pitfalls of regulatory frameworks
di: Tlaie, Alejandro
Pubblicazione: (2024)
di: Tlaie, Alejandro
Pubblicazione: (2024)
Generative AI Carries Non-Democratic Biases and Stereotypes: Representation of Women, Black Individuals, Age Groups, and People with Disability in AI-Generated Images across Occupations
di: Sadeghiani, Ayoob
Pubblicazione: (2024)
di: Sadeghiani, Ayoob
Pubblicazione: (2024)
Wide Reflective Equilibrium in LLM Alignment: Bridging Moral Epistemology and AI Safety
di: Brophy, Matthew
Pubblicazione: (2025)
di: Brophy, Matthew
Pubblicazione: (2025)
AI Alignment at Your Discretion
di: Buyl, Maarten, et al.
Pubblicazione: (2025)
di: Buyl, Maarten, et al.
Pubblicazione: (2025)
Alignment Is Not Enough: A Relational Framework for Moral Standing in Human-AI Interaction
di: Pasandi, Faezeh B., et al.
Pubblicazione: (2026)
di: Pasandi, Faezeh B., et al.
Pubblicazione: (2026)
Rules, Cases, and Reasoning: Positivist Legal Theory as a Framework for Pluralistic AI Alignment
di: Caputo, Nicholas A.
Pubblicazione: (2024)
di: Caputo, Nicholas A.
Pubblicazione: (2024)
The 2025 AI Agent Index: Documenting Technical and Safety Features of Deployed Agentic AI Systems
di: Staufer, Leon, et al.
Pubblicazione: (2026)
di: Staufer, Leon, et al.
Pubblicazione: (2026)
Characterizing AI Agents for Alignment and Governance
di: Kasirzadeh, Atoosa, et al.
Pubblicazione: (2025)
di: Kasirzadeh, Atoosa, et al.
Pubblicazione: (2025)
The Coming Crisis of Multi-Agent Misalignment: AI Alignment Must Be a Dynamic and Social Process
di: Carichon, Florian, et al.
Pubblicazione: (2025)
di: Carichon, Florian, et al.
Pubblicazione: (2025)
An analysis of AI Decision under Risk: Prospect theory emerges in Large Language Models
di: Payne, Kenneth
Pubblicazione: (2025)
di: Payne, Kenneth
Pubblicazione: (2025)
Measuring AI Diffusion: A Population-Normalized Metric for Tracking Global AI Usage
di: Misra, Amit, et al.
Pubblicazione: (2025)
di: Misra, Amit, et al.
Pubblicazione: (2025)
Why AI Alignment Failure Is Structural: Learned Human Interaction Structures and AGI as an Endogenous Evolutionary Shock
di: Sornette, Didier, et al.
Pubblicazione: (2026)
di: Sornette, Didier, et al.
Pubblicazione: (2026)
Chain of Alignment: Integrating Public Will with Expert Intelligence for Language Model Alignment
di: Konya, Andrew, et al.
Pubblicazione: (2024)
di: Konya, Andrew, et al.
Pubblicazione: (2024)
The AI Pentad, the CHARME$^{2}$D Model, and an Assessment of Current-State AI Regulation
di: Gao, Di Kevin, et al.
Pubblicazione: (2025)
di: Gao, Di Kevin, et al.
Pubblicazione: (2025)
Do AI Companies Make Good on Voluntary Commitments to the White House?
di: Wang, Jennifer, et al.
Pubblicazione: (2025)
di: Wang, Jennifer, et al.
Pubblicazione: (2025)
Alignment Debt: The Hidden Work of Making AI Usable
di: Oyemike, Cumi, et al.
Pubblicazione: (2025)
di: Oyemike, Cumi, et al.
Pubblicazione: (2025)
Balancing Safety and Helpfulness in Healthcare AI Assistants through Iterative Preference Alignment
di: Nghiem, Huy, et al.
Pubblicazione: (2025)
di: Nghiem, Huy, et al.
Pubblicazione: (2025)
Democratizing Differential Privacy: A Participatory AI Framework for Public Decision-Making
di: Yang, Wenjun, et al.
Pubblicazione: (2025)
di: Yang, Wenjun, et al.
Pubblicazione: (2025)
New Tools are Needed for Tracking Adherence to AI Model Behavioral Use Clauses
di: McDuff, Daniel, et al.
Pubblicazione: (2025)
di: McDuff, Daniel, et al.
Pubblicazione: (2025)
Towards Integrated Alignment
di: Reis, Ben Y., et al.
Pubblicazione: (2025)
di: Reis, Ben Y., et al.
Pubblicazione: (2025)
Documenti analoghi
-
Disentangling AI Alignment: A Structured Taxonomy Beyond Safety and Ethics
di: Baum, Kevin
Pubblicazione: (2025) -
Breaking Up with Normatively Monolithic Agency with GRACE: A Reason-Based Neuro-Symbolic Architecture for Safe and Ethical AI Alignment
di: Jahn, Felix, et al.
Pubblicazione: (2026) -
The Value of Gen-AI Conversations: A bottom-up Framework for AI Value Alignment
di: Motnikar, Lenart, et al.
Pubblicazione: (2025) -
Bringing AI Participation Down to Scale: A Comment on Open AIs Democratic Inputs to AI Project
di: Moats, David, et al.
Pubblicazione: (2024) -
Particip-AI: A Democratic Surveying Framework for Anticipating Future AI Use Cases, Harms and Benefits
di: Mun, Jimin, et al.
Pubblicazione: (2024)