Human Misperception of Generative-AI Alignment: A Laboratory Experiment
Fuente:
arXiv
Guardado en:
| Autores principales: | He, Kevin, Shorrer, Ran, Xia, Mengjia |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Strategic Algorithmic Monoculture: Experimental Evidence from Coordination Games
por: Ballestero, Gonzalo, et al.
Publicado: (2026)
por: Ballestero, Gonzalo, et al.
Publicado: (2026)
A Revealed Preference Framework for AI Alignment
por: Suleymanov, Elchin
Publicado: (2026)
por: Suleymanov, Elchin
Publicado: (2026)
Human-AI Productivity Paradoxes: Modeling the Interplay of Skill, Effort, and AI Assistance
por: Aouad, Ali, et al.
Publicado: (2026)
por: Aouad, Ali, et al.
Publicado: (2026)
Will AI Trade? A Computational Inversion of the No-Trade Theorem
por: Li, Hanyu, et al.
Publicado: (2025)
por: Li, Hanyu, et al.
Publicado: (2025)
Creative Ownership in the Age of AI
por: Liang, Annie, et al.
Publicado: (2026)
por: Liang, Annie, et al.
Publicado: (2026)
Fine-Tuning Games: Bargaining and Adaptation for General-Purpose Models
por: Laufer, Benjamin, et al.
Publicado: (2023)
por: Laufer, Benjamin, et al.
Publicado: (2023)
Rational Adversaries and the Maintenance of Fragility: A Game-Theoretic Theory of Rational Stagnation
por: Hirota, Daisuke
Publicado: (2025)
por: Hirota, Daisuke
Publicado: (2025)
Friend or Foe: Delegating to an AI Whose Alignment is Unknown
por: Fudenberg, Drew, et al.
Publicado: (2025)
por: Fudenberg, Drew, et al.
Publicado: (2025)
Tell Me Why: Incentivizing Explanations
por: Srinivasan, Siddarth, et al.
Publicado: (2025)
por: Srinivasan, Siddarth, et al.
Publicado: (2025)
Understanding EFX Allocations: Counting and Variants
por: Neoh, Tzeh Yuan, et al.
Publicado: (2025)
por: Neoh, Tzeh Yuan, et al.
Publicado: (2025)
Collective dynamics of strategic classification
por: Couto, Marta C., et al.
Publicado: (2025)
por: Couto, Marta C., et al.
Publicado: (2025)
Misspecified Explore-then-Exploit Leads to Supra-Competitive Prices
por: Baek, Jackie, et al.
Publicado: (2026)
por: Baek, Jackie, et al.
Publicado: (2026)
Learned Collusion
por: Compte, Olivier
Publicado: (2023)
por: Compte, Olivier
Publicado: (2023)
Extrapolating Volition with Recursive Information Markets
por: Sudhir, Abhimanyu Pallavi, et al.
Publicado: (2026)
por: Sudhir, Abhimanyu Pallavi, et al.
Publicado: (2026)
Artificial Intelligence for Multi-Unit Auction design
por: Khezr, Peyman, et al.
Publicado: (2024)
por: Khezr, Peyman, et al.
Publicado: (2024)
Post-AGI Economies: Autonomy and the First Fundamental Theorem of Welfare Economics
por: Perrier, Elija
Publicado: (2026)
por: Perrier, Elija
Publicado: (2026)
Algorithmic Persuasion Through Simulation
por: Harris, Keegan, et al.
Publicado: (2023)
por: Harris, Keegan, et al.
Publicado: (2023)
Dueling Over Dessert, Mastering the Art of Repeated Cake Cutting
por: Brânzei, Simina, et al.
Publicado: (2024)
por: Brânzei, Simina, et al.
Publicado: (2024)
Two-Sided Time-Independent Regret for Matching Markets with Limited Interviews
por: Mirfakhar, Amirmahdi, et al.
Publicado: (2026)
por: Mirfakhar, Amirmahdi, et al.
Publicado: (2026)
Delegation and Verification Under AI
por: Huang, Lingxiao, et al.
Publicado: (2026)
por: Huang, Lingxiao, et al.
Publicado: (2026)
Misspecified learning and evolutionary stability
por: He, Kevin, et al.
Publicado: (2025)
por: He, Kevin, et al.
Publicado: (2025)
The Backfiring Effect of Weak AI Safety Regulation
por: Laufer, Benjamin, et al.
Publicado: (2025)
por: Laufer, Benjamin, et al.
Publicado: (2025)
Human strategic decision making in parametrized games
por: Ganzfried, Sam
Publicado: (2021)
por: Ganzfried, Sam
Publicado: (2021)
Opponent Modeling in Multiplayer Imperfect-Information Games
por: Ganzfried, Sam, et al.
Publicado: (2022)
por: Ganzfried, Sam, et al.
Publicado: (2022)
A New Lower Bound for the Random Offerer Mechanism in Bilateral Trade using AI-Guided Evolutionary Search
por: Cai, Yang, et al.
Publicado: (2026)
por: Cai, Yang, et al.
Publicado: (2026)
Algorithmic Collusion by Large Language Models
por: Fish, Sara, et al.
Publicado: (2024)
por: Fish, Sara, et al.
Publicado: (2024)
Facility Location Games with Scaling Effects
por: He, Yu, et al.
Publicado: (2024)
por: He, Yu, et al.
Publicado: (2024)
Generalized Principal-Agent Problem with a Learning Agent
por: Lin, Tao, et al.
Publicado: (2024)
por: Lin, Tao, et al.
Publicado: (2024)
Computing Most Equitable Voting Rules
por: Xia, Lirong
Publicado: (2024)
por: Xia, Lirong
Publicado: (2024)
Feedback in Dynamic Contests: Theory and Experiment
por: Goel, Sumit, et al.
Publicado: (2025)
por: Goel, Sumit, et al.
Publicado: (2025)
Monotonic Mechanisms for Selling Multiple Goods
por: Ben-Moshe, Ran, et al.
Publicado: (2022)
por: Ben-Moshe, Ran, et al.
Publicado: (2022)
The Cost of EFX: Generalized-Mean Welfare and Complexity Dichotomies with Few Surplus Items
por: Lim, Eugene, et al.
Publicado: (2026)
por: Lim, Eugene, et al.
Publicado: (2026)
Language-based game theory in the age of artificial intelligence
por: Capraro, Valerio, et al.
Publicado: (2024)
por: Capraro, Valerio, et al.
Publicado: (2024)
Private Private Information
por: He, Kevin, et al.
Publicado: (2021)
por: He, Kevin, et al.
Publicado: (2021)
The Value of Context: Human versus Black Box Evaluators
por: Iakovlev, Andrei, et al.
Publicado: (2024)
por: Iakovlev, Andrei, et al.
Publicado: (2024)
A General Framework for a Class of Quarrels: The Quarrelling Paradox Revisited
por: Abizadeh, Arash, et al.
Publicado: (2022)
por: Abizadeh, Arash, et al.
Publicado: (2022)
Rank-Guaranteed Auctions
por: He, Wei, et al.
Publicado: (2024)
por: He, Wei, et al.
Publicado: (2024)
Generalizing Instant Runoff Voting to Allow Indifferences
por: Delemazure, Théo, et al.
Publicado: (2024)
por: Delemazure, Théo, et al.
Publicado: (2024)
Approximate Revenue Maximization for Diffusion Auctions
por: Huang, Yifan, et al.
Publicado: (2025)
por: Huang, Yifan, et al.
Publicado: (2025)
Markets with Heterogeneous Agents: Dynamics and Survival of Bayesian vs. No-Regret Learners
por: Easley, David, et al.
Publicado: (2025)
por: Easley, David, et al.
Publicado: (2025)
Ejemplares similares
-
Strategic Algorithmic Monoculture: Experimental Evidence from Coordination Games
por: Ballestero, Gonzalo, et al.
Publicado: (2026) -
A Revealed Preference Framework for AI Alignment
por: Suleymanov, Elchin
Publicado: (2026) -
Human-AI Productivity Paradoxes: Modeling the Interplay of Skill, Effort, and AI Assistance
por: Aouad, Ali, et al.
Publicado: (2026) -
Will AI Trade? A Computational Inversion of the No-Trade Theorem
por: Li, Hanyu, et al.
Publicado: (2025) -
Creative Ownership in the Age of AI
por: Liang, Annie, et al.
Publicado: (2026)