Intrinsic Barriers and Practical Pathways for Human-AI Alignment: An Agreement-Based Complexity Analysis
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Nayebi, Aran |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Core Safety Values for Provably Corrigible Agents
par: Nayebi, Aran
Publié: (2025)
par: Nayebi, Aran
Publié: (2025)
Mechanism-Based Intelligence (MBI): Differentiable Incentives for Rational Coordination and Guaranteed Alignment in Multi-Agent Systems
par: Grassi, Stefano
Publié: (2025)
par: Grassi, Stefano
Publié: (2025)
Computational Social Choice: Parameterized Complexity and Challenges
par: Chen, Jiehua, et autres
Publié: (2024)
par: Chen, Jiehua, et autres
Publié: (2024)
Analysing the Sample Complexity of Opponent Shaping
par: Fung, Kitty, et autres
Publié: (2024)
par: Fung, Kitty, et autres
Publié: (2024)
Socially-Weighted Alignment: A Game-Theoretic Framework for Multi-Agent LLM Systems
par: Mumcu, Furkan, et autres
Publié: (2026)
par: Mumcu, Furkan, et autres
Publié: (2026)
On the Complexity of Learning to Cooperate with Populations of Socially Rational Agents
par: Loftin, Robert, et autres
Publié: (2024)
par: Loftin, Robert, et autres
Publié: (2024)
Nash Learning from Human Feedback
par: Munos, Rémi, et autres
Publié: (2023)
par: Munos, Rémi, et autres
Publié: (2023)
Approval-Based Committee Voting under Incomplete Information
par: Imber, Aviram, et autres
Publié: (2021)
par: Imber, Aviram, et autres
Publié: (2021)
Adaptive Network Intervention for Complex Systems: A Hierarchical Graph Reinforcement Learning Approach
par: Chen, Qiliang, et autres
Publié: (2024)
par: Chen, Qiliang, et autres
Publié: (2024)
Stackelberg Learning from Human Feedback: Preference Optimization as a Sequential Game
par: Pásztor, Barna, et autres
Publié: (2025)
par: Pásztor, Barna, et autres
Publié: (2025)
Preference-Based Multi-Agent Reinforcement Learning: Data Coverage and Algorithmic Techniques
par: Zhang, Natalia, et autres
Publié: (2024)
par: Zhang, Natalia, et autres
Publié: (2024)
Mathematical Modelling of Ethical AI Use in Higher Education: A Coordination Game Framework for Future-Facing Learning
par: Ogbo, Ndidi Bianca, et autres
Publié: (2026)
par: Ogbo, Ndidi Bianca, et autres
Publié: (2026)
Game-Theoretic and Algorithmic Analyses of Multi-Agent Routing under Crossing Costs
par: Hanaka, Tesshu, et autres
Publié: (2026)
par: Hanaka, Tesshu, et autres
Publié: (2026)
On the Tractability Landscape of the Conditional Minisum Approval Voting Rule
par: Amanatidis, Georgios, et autres
Publié: (2024)
par: Amanatidis, Georgios, et autres
Publié: (2024)
Online Learning of Counter Categories and Ratings in PvP Games
par: Lin, Chiu-Chou, et autres
Publié: (2025)
par: Lin, Chiu-Chou, et autres
Publié: (2025)
AdaFair-MARL: Enforcing Adaptive Fairness Constraints in Multi-Agent Reinforcement Learning
par: Ekpo, Promise, et autres
Publié: (2025)
par: Ekpo, Promise, et autres
Publié: (2025)
Learning Mean Field Control on Sparse Graphs
par: Fabian, Christian, et autres
Publié: (2025)
par: Fabian, Christian, et autres
Publié: (2025)
Cooperative Game-Theoretic Credit Assignment for Multi-Agent Policy Gradients via the Core
par: Ji, Mengda, et autres
Publié: (2025)
par: Ji, Mengda, et autres
Publié: (2025)
Reinforcement Learning for Hanabi
par: Cohen, Nina, et autres
Publié: (2025)
par: Cohen, Nina, et autres
Publié: (2025)
Heterogeneous Multi-Agent Bandits with Parsimonious Hints
par: Mirfakhar, Amirmahdi, et autres
Publié: (2025)
par: Mirfakhar, Amirmahdi, et autres
Publié: (2025)
Learning Bilateral Team Formation in Cooperative Multi-Agent Reinforcement Learning
par: Moslemi, Koorosh, et autres
Publié: (2025)
par: Moslemi, Koorosh, et autres
Publié: (2025)
Evaluating LLMs in Open-Source Games
par: Sistla, Swadesh, et autres
Publié: (2025)
par: Sistla, Swadesh, et autres
Publié: (2025)
Learning to Negotiate via Voluntary Commitment
par: Zhu, Shuhui, et autres
Publié: (2025)
par: Zhu, Shuhui, et autres
Publié: (2025)
Offline Learning of Nash Stable Coalition Structures with Possibly Overlapping Coalitions
par: Cohen, Saar
Publié: (2026)
par: Cohen, Saar
Publié: (2026)
Distributed Stackelberg Strategies in State-based Potential Games for Autonomous Decentralized Learning Manufacturing Systems
par: Yuwono, Steve, et autres
Publié: (2024)
par: Yuwono, Steve, et autres
Publié: (2024)
Combining Tree-Search, Generative Models, and Nash Bargaining Concepts in Game-Theoretic Reinforcement Learning
par: Li, Zun, et autres
Publié: (2023)
par: Li, Zun, et autres
Publié: (2023)
Procedural Fairness in Multi-Agent Bandits
par: Caiata, Joshua, et autres
Publié: (2026)
par: Caiata, Joshua, et autres
Publié: (2026)
Learning Mean Field Games on Sparse Graphs: A Hybrid Graphex Approach
par: Fabian, Christian, et autres
Publié: (2024)
par: Fabian, Christian, et autres
Publié: (2024)
Multi-Agent Training beyond Zero-Sum with Correlated Equilibrium Meta-Solvers
par: Marris, Luke, et autres
Publié: (2021)
par: Marris, Luke, et autres
Publié: (2021)
Bounded Rationality Equilibrium Learning in Mean Field Games
par: Eich, Yannick, et autres
Publié: (2024)
par: Eich, Yannick, et autres
Publié: (2024)
A Black-box Approach for Non-stationary Multi-agent Reinforcement Learning
par: Jiang, Haozhe, et autres
Publié: (2023)
par: Jiang, Haozhe, et autres
Publié: (2023)
A Scalable Neural Network for DSIC Affine Maximizer Auction Design
par: Duan, Zhijian, et autres
Publié: (2023)
par: Duan, Zhijian, et autres
Publié: (2023)
Sample-Efficient Hypergradient Estimation for Decentralized Bi-Level Reinforcement Learning
par: Kudo, Mikoto, et autres
Publié: (2026)
par: Kudo, Mikoto, et autres
Publié: (2026)
Observation Interference in Partially Observable Assistance Games
par: Emmons, Scott, et autres
Publié: (2024)
par: Emmons, Scott, et autres
Publié: (2024)
Offline Fictitious Self-Play for Competitive Games
par: Chen, Jingxiao, et autres
Publié: (2024)
par: Chen, Jingxiao, et autres
Publié: (2024)
Independent RL for Cooperative-Competitive Agents: A Mean-Field Perspective
par: Zaman, Muhammad Aneeq uz, et autres
Publié: (2024)
par: Zaman, Muhammad Aneeq uz, et autres
Publié: (2024)
The Benefits of Power Regularization in Cooperative Reinforcement Learning
par: Li, Michelle, et autres
Publié: (2024)
par: Li, Michelle, et autres
Publié: (2024)
RuleSmith: Multi-Agent LLMs for Automated Game Balancing
par: Zeng, Ziyao, et autres
Publié: (2026)
par: Zeng, Ziyao, et autres
Publié: (2026)
Strategic Classification With Externalities
par: Hossain, Safwan, et autres
Publié: (2024)
par: Hossain, Safwan, et autres
Publié: (2024)
Learning Optimal Tax Design in Nonatomic Congestion Games
par: Cui, Qiwen, et autres
Publié: (2024)
par: Cui, Qiwen, et autres
Publié: (2024)
Documents similaires
-
Core Safety Values for Provably Corrigible Agents
par: Nayebi, Aran
Publié: (2025) -
Mechanism-Based Intelligence (MBI): Differentiable Incentives for Rational Coordination and Guaranteed Alignment in Multi-Agent Systems
par: Grassi, Stefano
Publié: (2025) -
Computational Social Choice: Parameterized Complexity and Challenges
par: Chen, Jiehua, et autres
Publié: (2024) -
Analysing the Sample Complexity of Opponent Shaping
par: Fung, Kitty, et autres
Publié: (2024) -
Socially-Weighted Alignment: A Game-Theoretic Framework for Multi-Agent LLM Systems
par: Mumcu, Furkan, et autres
Publié: (2026)