Interactive AI Alignment: Specification, Process, and Evaluation Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Terry, Michael, Kulkarni, Chinmay, Wattenberg, Martin, Dixon, Lucas, Morris, Meredith Ringel |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Intentmaking and Sensemaking: Human Interaction with AI-Guided Mathematical Discovery
par: Bäuerle, Alex, et autres
Publié: (2026)
par: Bäuerle, Alex, et autres
Publié: (2026)
Position: Towards Bidirectional Human-AI Alignment
par: Shen, Hua, et autres
Publié: (2024)
par: Shen, Hua, et autres
Publié: (2024)
Farsight: Fostering Responsible AI Awareness During AI Application Prototyping
par: Wang, Zijie J., et autres
Publié: (2024)
par: Wang, Zijie J., et autres
Publié: (2024)
Interoceptive Divergence in Aesthetic Evaluation and Implications for Human-AI Alignment
par: Abe, Yoshia, et autres
Publié: (2026)
par: Abe, Yoshia, et autres
Publié: (2026)
Human-AI Interaction Alignment: Designing, Evaluating, and Evolving Value-Centered AI For Reciprocal Human-AI Futures
par: Shen, Hua, et autres
Publié: (2025)
par: Shen, Hua, et autres
Publié: (2025)
Does visualization help AI understand data?
par: Li, Victoria R., et autres
Publié: (2025)
par: Li, Victoria R., et autres
Publié: (2025)
CUPID: Evaluating Personalized and Contextualized Alignment of LLMs from Interactions
par: Kim, Tae Soo, et autres
Publié: (2025)
par: Kim, Tae Soo, et autres
Publié: (2025)
Urbanite: A Dataflow-Based Framework for Human-AI Interactive Alignment in Urban Visual Analytics
par: Moreira, Gustavo, et autres
Publié: (2025)
par: Moreira, Gustavo, et autres
Publié: (2025)
Speaking the Right Language: The Impact of Expertise Alignment in User-AI Interactions
par: Palta, Shramay, et autres
Publié: (2025)
par: Palta, Shramay, et autres
Publié: (2025)
Alignment-Process-Outcome: Rethinking How AIs and Humans Collaborate
par: Li, Haichang, et autres
Publié: (2026)
par: Li, Haichang, et autres
Publié: (2026)
Evaluating AI Alignment in LLMs: Output Analysis of Value Priorities Across 75 Models with Human Benchmarking
par: Lau, Gabriel Rongyang, et autres
Publié: (2025)
par: Lau, Gabriel Rongyang, et autres
Publié: (2025)
Designing AI for Real Users -- Accessibility Gaps in Retail AI Front-End
par: Puri, Neha, et autres
Publié: (2026)
par: Puri, Neha, et autres
Publié: (2026)
The Impact of AI on Educational Assessment: A Framework for Constructive Alignment
par: Stokkink, Patrick
Publié: (2025)
par: Stokkink, Patrick
Publié: (2025)
Everyone prefers human writers, including AI
par: Haverals, Wouter, et autres
Publié: (2025)
par: Haverals, Wouter, et autres
Publié: (2025)
Value Alignment Tax: Measuring Value Trade-offs in LLM Alignment
par: Chen, Jiajun, et autres
Publié: (2026)
par: Chen, Jiajun, et autres
Publié: (2026)
Toward Human-AI Alignment in Large-Scale Multi-Player Games
par: Sharma, Sugandha, et autres
Publié: (2024)
par: Sharma, Sugandha, et autres
Publié: (2024)
Principles Do Not Apply Themselves: A Hermeneutic Perspective on AI Alignment
par: Razeghi, Behrooz
Publié: (2026)
par: Razeghi, Behrooz
Publié: (2026)
Deliberate Lab: A Platform for Real-Time Human-AI Social Experiments
par: Qian, Crystal, et autres
Publié: (2025)
par: Qian, Crystal, et autres
Publié: (2025)
Evaluating Behavioral Alignment in Conflict Dialogue: A Multi-Dimensional Comparison of LLM Agents and Humans
par: Kwon, Deuksin, et autres
Publié: (2025)
par: Kwon, Deuksin, et autres
Publié: (2025)
The Moral Turing Test: Evaluating Human-LLM Alignment in Moral Decision-Making
par: Garcia, Basile, et autres
Publié: (2024)
par: Garcia, Basile, et autres
Publié: (2024)
DxHF: Providing High-Quality Human Feedback for LLM Alignment via Interactive Decomposition
par: Shi, Danqing, et autres
Publié: (2025)
par: Shi, Danqing, et autres
Publié: (2025)
Disrupting Cognitive Passivity: Rethinking AI-Assisted Data Literacy through Cognitive Alignment
par: Ahn, Yongsu, et autres
Publié: (2026)
par: Ahn, Yongsu, et autres
Publié: (2026)
Alignment Debt: The Hidden Work of Making AI Usable
par: Oyemike, Cumi, et autres
Publié: (2025)
par: Oyemike, Cumi, et autres
Publié: (2025)
Alignment has a Fantasia Problem
par: Jo, Nathanael, et autres
Publié: (2026)
par: Jo, Nathanael, et autres
Publié: (2026)
Enabling Rapid Shared Human-AI Mental Model Alignment via the After-Action Review
par: Gu, Edward, et autres
Publié: (2025)
par: Gu, Edward, et autres
Publié: (2025)
Bidirectional Human-AI Alignment in Education for Trustworthy Learning Environments
par: Shen, Hua
Publié: (2025)
par: Shen, Hua
Publié: (2025)
Direct Language Model Alignment from Online AI Feedback
par: Guo, Shangmin, et autres
Publié: (2024)
par: Guo, Shangmin, et autres
Publié: (2024)
SimStep: Chain-of-Abstractions for Incremental Specification and Debugging of AI-Generated Interactive Simulations
par: Kaputa, Zoe, et autres
Publié: (2025)
par: Kaputa, Zoe, et autres
Publié: (2025)
Chain of Alignment: Integrating Public Will with Expert Intelligence for Language Model Alignment
par: Konya, Andrew, et autres
Publié: (2024)
par: Konya, Andrew, et autres
Publié: (2024)
Disentangling AI Alignment: A Structured Taxonomy Beyond Safety and Ethics
par: Baum, Kevin
Publié: (2025)
par: Baum, Kevin
Publié: (2025)
Learning to Decide with AI Assistance under Human-Alignment
par: Benz, Nina Corvelo, et autres
Publié: (2026)
par: Benz, Nina Corvelo, et autres
Publié: (2026)
Rationalize: Shared Semantic Reasoning for Human-AI Alignment
par: Dasgupta, Aritra, et autres
Publié: (2026)
par: Dasgupta, Aritra, et autres
Publié: (2026)
Democratizing Reward Design for Personal and Representative Value-Alignment
par: Blair, Carter, et autres
Publié: (2024)
par: Blair, Carter, et autres
Publié: (2024)
The Alignment Target Problem: Divergent Moral Judgments of Humans, AI Systems, and Their Designers
par: Chen, Benjamin Minhao, et autres
Publié: (2026)
par: Chen, Benjamin Minhao, et autres
Publié: (2026)
Designing for Human-Agent Alignment: Understanding what humans want from their agents
par: Goyal, Nitesh, et autres
Publié: (2024)
par: Goyal, Nitesh, et autres
Publié: (2024)
Human Preferences for Constructive Interactions in Language Model Alignment
par: Kyrychenko, Yara, et autres
Publié: (2025)
par: Kyrychenko, Yara, et autres
Publié: (2025)
LLM Agents Grounded in Self-Reports Enable General-Purpose Simulation of Individuals
par: Park, Joon Sung, et autres
Publié: (2024)
par: Park, Joon Sung, et autres
Publié: (2024)
Unpacking Vibe Coding: Help-Seeking Processes in Student-AI Interactions While Programming
par: Rinja, Daiana, et autres
Publié: (2026)
par: Rinja, Daiana, et autres
Publié: (2026)
An Audio-Visual Fusion Emotion Generation Model Based on Neuroanatomical Alignment
par: Wang, Haidong, et autres
Publié: (2025)
par: Wang, Haidong, et autres
Publié: (2025)
The Burden of Interactive Alignment with Inconsistent Preferences
par: Shirali, Ali
Publié: (2025)
par: Shirali, Ali
Publié: (2025)
Documents similaires
-
Intentmaking and Sensemaking: Human Interaction with AI-Guided Mathematical Discovery
par: Bäuerle, Alex, et autres
Publié: (2026) -
Position: Towards Bidirectional Human-AI Alignment
par: Shen, Hua, et autres
Publié: (2024) -
Farsight: Fostering Responsible AI Awareness During AI Application Prototyping
par: Wang, Zijie J., et autres
Publié: (2024) -
Interoceptive Divergence in Aesthetic Evaluation and Implications for Human-AI Alignment
par: Abe, Yoshia, et autres
Publié: (2026) -
Human-AI Interaction Alignment: Designing, Evaluating, and Evolving Value-Centered AI For Reciprocal Human-AI Futures
par: Shen, Hua, et autres
Publié: (2025)