The Problem of Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hristova, Tsvetelina, Magee, Liam, Soldatic, Karen |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Automating Thematic Analysis: How LLMs Analyse Controversial Topics
par: Khan, Awais Hameed, et autres
Publié: (2024)
par: Khan, Awais Hameed, et autres
Publié: (2024)
Attention is All You Want: Machinic Gaze and the Anthropocene
par: Magee, Liam, et autres
Publié: (2024)
par: Magee, Liam, et autres
Publié: (2024)
The Drama Machine: Simulating Character Development with LLM Agents
par: Magee, Liam, et autres
Publié: (2024)
par: Magee, Liam, et autres
Publié: (2024)
Programming Skills are Not Enough: a Greedy Strategy to Attract More Girls to Study Computer Science
par: Catarci, Tiziana, et autres
Publié: (2023)
par: Catarci, Tiziana, et autres
Publié: (2023)
Textual Entailment is not a Better Bias Metric than Token Probability
par: Felkner, Virginia K., et autres
Publié: (2025)
par: Felkner, Virginia K., et autres
Publié: (2025)
GPT is Not an Annotator: The Necessity of Human Annotation in Fairness Benchmark Construction
par: Felkner, Virginia K., et autres
Publié: (2024)
par: Felkner, Virginia K., et autres
Publié: (2024)
An Automated Tool to Detect Suicidal Susceptibility from Social Media Posts
par: Dus, Yasin, et autres
Publié: (2023)
par: Dus, Yasin, et autres
Publié: (2023)
Fairness in Socio-technical Systems: a Case Study of Wikipedia
par: Damadi, Mir Saeed, et autres
Publié: (2023)
par: Damadi, Mir Saeed, et autres
Publié: (2023)
Can Online GenAI Discussion Serve as Bellwether for Labor Market Shifts?
par: Cao, Shurui, et autres
Publié: (2025)
par: Cao, Shurui, et autres
Publié: (2025)
Generative AI and the transformation of Work in Latin America -- Brazil
par: Bonfacio, Carmen, et autres
Publié: (2025)
par: Bonfacio, Carmen, et autres
Publié: (2025)
How Utilitarian Are OpenAI's Models Really? Replicating and Reinterpreting Pfeffer, Krügel, and Uhl (2025)
par: Himmelreich, Johannes
Publié: (2026)
par: Himmelreich, Johannes
Publié: (2026)
Pitfalls in Effective Knowledge Management: Insights from an International Information Technology Organization
par: Koivisto, Kalle, et autres
Publié: (2023)
par: Koivisto, Kalle, et autres
Publié: (2023)
The Future of the AI Summit Series
par: Velasco, Lucia, et autres
Publié: (2025)
par: Velasco, Lucia, et autres
Publié: (2025)
Ethical conundrums: Hacked data in the study of far-right violent extremism
par: Waldek, Lise, et autres
Publié: (2025)
par: Waldek, Lise, et autres
Publié: (2025)
Geist in the Machine: Simulating Recognition and Inner Dialogue in AI-Mediated Teaching and Research
par: Magee, Liam
Publié: (2026)
par: Magee, Liam
Publié: (2026)
Mental health of computing professionals and students: A systematic literature review
par: Takaoka, Alicia Julia Wilson, et autres
Publié: (2024)
par: Takaoka, Alicia Julia Wilson, et autres
Publié: (2024)
Driving Accessibility: Shifting the Narrative & Design of Automated Vehicle Systems for Persons With Disabilities Through a Collaborative Scoring System
par: Barnes, Savvy, et autres
Publié: (2026)
par: Barnes, Savvy, et autres
Publié: (2026)
Multiple Approaches for Teaching Responsible Computing
par: Doore, Stacy A., et autres
Publié: (2025)
par: Doore, Stacy A., et autres
Publié: (2025)
The Illusion of Competence: Self-Perceived Digital Literacy and AI Readiness Among European Secondary Students
par: Rodriguez-Alvarez, Nicolas, et autres
Publié: (2026)
par: Rodriguez-Alvarez, Nicolas, et autres
Publié: (2026)
Understanding the concerns and choices of public when using large language models for healthcare
par: Xiao, Yunpeng, et autres
Publié: (2024)
par: Xiao, Yunpeng, et autres
Publié: (2024)
Sustainable and Adaptive Growth in Computing Education
par: Ayalp, Enes
Publié: (2025)
par: Ayalp, Enes
Publié: (2025)
Gender, Race, and Intersectional Bias in Resume Screening via Language Model Retrieval
par: Wilson, Kyra, et autres
Publié: (2024)
par: Wilson, Kyra, et autres
Publié: (2024)
How Knowledge Workers Think Generative AI Will (Not) Transform Their Industries
par: Woodruff, Allison, et autres
Publié: (2023)
par: Woodruff, Allison, et autres
Publié: (2023)
AI-Driven Media & Synthetic Knowledge: Rethinking Society in Generative Futures
par: Feher, Katalin
Publié: (2025)
par: Feher, Katalin
Publié: (2025)
Physiological Data: Challenges for Privacy and Ethics
par: Davis, Keith, et autres
Publié: (2024)
par: Davis, Keith, et autres
Publié: (2024)
Rejected Dialects: Biases Against African American Language in Reward Models
par: Mire, Joel, et autres
Publié: (2025)
par: Mire, Joel, et autres
Publié: (2025)
Benchmarking Bengali Dialectal Bias: A Multi-Stage Framework Integrating RAG-Based Translation and Human-Augmented RLAIF
par: Sami, K. M. Jubair, et autres
Publié: (2026)
par: Sami, K. M. Jubair, et autres
Publié: (2026)
Performativity and Prospective Fairness
par: Zezulka, Sebastian, et autres
Publié: (2023)
par: Zezulka, Sebastian, et autres
Publié: (2023)
What are AI researchers worried about?
par: O'Donovan, Cian, et autres
Publié: (2026)
par: O'Donovan, Cian, et autres
Publié: (2026)
No Thoughts Just AI: Biased LLM Hiring Recommendations Alter Human Decision Making and Limit Human Autonomy
par: Wilson, Kyra, et autres
Publié: (2025)
par: Wilson, Kyra, et autres
Publié: (2025)
Large language models can replicate cross-cultural differences in personality
par: Niszczota, Paweł, et autres
Publié: (2023)
par: Niszczota, Paweł, et autres
Publié: (2023)
PromptAug: Fine-grained Conflict Classification Using Data Augmentation
par: Warke, Oliver, et autres
Publié: (2025)
par: Warke, Oliver, et autres
Publié: (2025)
Fairness Is Not Enough: Auditing Competence and Intersectional Bias in AI-powered Resume Screening
par: Webster, Kevin T
Publié: (2025)
par: Webster, Kevin T
Publié: (2025)
AI-Augmented Science and the New Institutional Scarcities
par: Lovén, Lauri
Publié: (2026)
par: Lovén, Lauri
Publié: (2026)
Generative AI and the Future of the Digital Commons: Five Open Questions and Knowledge Gaps
par: Noroozian, Arman, et autres
Publié: (2025)
par: Noroozian, Arman, et autres
Publié: (2025)
An Analysis of the New EU AI Act and A Proposed Standardization Framework for Machine Learning Fairness
par: Teodorescu, Mike, et autres
Publié: (2025)
par: Teodorescu, Mike, et autres
Publié: (2025)
Digital Accessibility Literacy: A Conceptual Framework for Training on Digital Accessibility
par: Fisseler, Björn
Publié: (2024)
par: Fisseler, Björn
Publié: (2024)
Algorithmic neutrality
par: Phillips-Brown, Milo
Publié: (2023)
par: Phillips-Brown, Milo
Publié: (2023)
Resume-ing Control: (Mis)Perceptions of Agency Around GenAI Use in Recruiting Workflows
par: Surati, Sajel, et autres
Publié: (2026)
par: Surati, Sajel, et autres
Publié: (2026)
The Emerging Generative Artificial Intelligence Divide in the United States
par: Daepp, Madeleine I. G., et autres
Publié: (2024)
par: Daepp, Madeleine I. G., et autres
Publié: (2024)
Documents similaires
-
Automating Thematic Analysis: How LLMs Analyse Controversial Topics
par: Khan, Awais Hameed, et autres
Publié: (2024) -
Attention is All You Want: Machinic Gaze and the Anthropocene
par: Magee, Liam, et autres
Publié: (2024) -
The Drama Machine: Simulating Character Development with LLM Agents
par: Magee, Liam, et autres
Publié: (2024) -
Programming Skills are Not Enough: a Greedy Strategy to Attract More Girls to Study Computer Science
par: Catarci, Tiziana, et autres
Publié: (2023) -
Textual Entailment is not a Better Bias Metric than Token Probability
par: Felkner, Virginia K., et autres
Publié: (2025)