Multi-Agent Risks from Advanced AI
Fuente:
arXiv
Guardado en:
| Autores principales: | Hammond, Lewis, Chan, Alan, Clifton, Jesse, Hoelscher-Obermaier, Jason, Khan, Akbir, McLean, Euan, Smith, Chandler, Barfuss, Wolfram, Foerster, Jakob, Gavenčiak, Tomáš, Han, The Anh, Hughes, Edward, Kovařík, Vojtěch, Kulveit, Jan, Leibo, Joel Z., Oesterheld, Caspar, de Witt, Christian Schroeder, Shah, Nisarg, Wellman, Michael, Bova, Paolo, Cimpeanu, Theodor, Ezell, Carson, Feuillade-Montixi, Quentin, Franklin, Matija, Kran, Esben, Krawczuk, Igor, Lamparth, Max, Lauffer, Niklas, Meinke, Alexander, Motwani, Sumeet, Reuel, Anka, Conitzer, Vincent, Dennis, Michael, Gabriel, Iason, Gleave, Adam, Hadfield, Gillian, Haghtalab, Nika, Kasirzadeh, Atoosa, Krier, Sébastien, Larson, Kate, Lehman, Joel, Parkes, David C., Piliouras, Georgios, Rahwan, Iyad |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Das lyrische Werk Antoni Langes
por: Hoelscher-Obermaier, Hans-Peter
Publicado: (2019)
por: Hoelscher-Obermaier, Hans-Peter
Publicado: (2019)
Andrzej Kuśniewicz' synkretistische Romanpoetik
por: Hoelscher-Obermaier, Hans-Peter
Publicado: (2019)
por: Hoelscher-Obermaier, Hans-Peter
Publicado: (2019)
Analyzing And Editing Inner Mechanisms Of Backdoored Language Models
por: Lamparth, Max, et al.
Publicado: (2023)
por: Lamparth, Max, et al.
Publicado: (2023)
Choosing What Game to Play without Selecting Equilibria: Inferring Safe (Pareto) Improvements in Binary Constraint Structures
por: Oesterheld, Caspar, et al.
Publicado: (2025)
por: Oesterheld, Caspar, et al.
Publicado: (2025)
LLM Robustness Leaderboard v1 --Technical report
por: Lefebvre, Pierre Peigné -, et al.
Publicado: (2025)
por: Lefebvre, Pierre Peigné -, et al.
Publicado: (2025)
Multi-Agent Security Tax: Trading Off Security and Collaboration Capabilities in Multi-Agent Systems
por: Peigne-Lefebvre, Pierre, et al.
Publicado: (2025)
por: Peigne-Lefebvre, Pierre, et al.
Publicado: (2025)
Maximizing Social Welfare with Side Payments
por: Geffner, Ivan, et al.
Publicado: (2025)
por: Geffner, Ivan, et al.
Publicado: (2025)
Can CDT rationalise the ex ante optimal policy via modified anthropics?
por: Cooper, Emery, et al.
Publicado: (2024)
por: Cooper, Emery, et al.
Publicado: (2024)
Game Theory with Simulation of Other Players
por: Kovarik, Vojtech, et al.
Publicado: (2023)
por: Kovarik, Vojtech, et al.
Publicado: (2023)
Recursive Joint Simulation in Games
por: Kovarik, Vojtech, et al.
Publicado: (2024)
por: Kovarik, Vojtech, et al.
Publicado: (2024)
Characterising Simulation-Based Program Equilibria
por: Cooper, Emery, et al.
Publicado: (2024)
por: Cooper, Emery, et al.
Publicado: (2024)
Visualizing 2x2 Normal-Form Games: twoxtwogame LaTeX Package
por: Marris, Luke, et al.
Publicado: (2024)
por: Marris, Luke, et al.
Publicado: (2024)
AI-AI Bias: large language models favor communications generated by large language models
por: Laurito, Walter, et al.
Publicado: (2024)
por: Laurito, Walter, et al.
Publicado: (2024)
Observation Interference in Partially Observable Assistance Games
por: Emmons, Scott, et al.
Publicado: (2024)
por: Emmons, Scott, et al.
Publicado: (2024)
Neural Population Learning beyond Symmetric Zero-sum Games
por: Liu, Siqi, et al.
Publicado: (2024)
por: Liu, Siqi, et al.
Publicado: (2024)
Societal and technological progress as sewing an ever-growing, ever-changing, patchy, and polychrome quilt
por: Leibo, Joel Z., et al.
Publicado: (2025)
por: Leibo, Joel Z., et al.
Publicado: (2025)
La prescripción en el derecho internacional privado argentino
por: Milton Feuillade
Publicado: (2022)
por: Milton Feuillade
Publicado: (2022)
Simulation Streams: A Programming Paradigm for Controlling Large Language Models and Building Complex Systems with Generative AI
por: Sunehag, Peter, et al.
Publicado: (2025)
por: Sunehag, Peter, et al.
Publicado: (2025)
Implementing surrogate goals for safer bargaining in LLM-based agents
por: Oesterheld, Caspar, et al.
Publicado: (2026)
por: Oesterheld, Caspar, et al.
Publicado: (2026)
How Many Votes is a Lie Worth? Measuring Strategyproofness through Resource Augmentation
por: Berker, Ratip Emin, et al.
Publicado: (2026)
por: Berker, Ratip Emin, et al.
Publicado: (2026)
Computing Game Symmetries and Equilibria That Respect Them
por: Tewolde, Emanuel, et al.
Publicado: (2025)
por: Tewolde, Emanuel, et al.
Publicado: (2025)
Escalation Risks from Language Models in Military and Diplomatic Decision-Making
por: Rivera, Juan-Pablo, et al.
Publicado: (2024)
por: Rivera, Juan-Pablo, et al.
Publicado: (2024)
BetterBench: Assessing AI Benchmarks, Uncovering Issues, and Establishing Best Practices
por: Reuel, Anka, et al.
Publicado: (2024)
por: Reuel, Anka, et al.
Publicado: (2024)
Using Large Language Models to Simulate Human Behavioural Experiments: Port of Mars
por: Slumbers, Oliver, et al.
Publicado: (2025)
por: Slumbers, Oliver, et al.
Publicado: (2025)
Familienunternehmer als externe Beiräte
por: Obermaier, Otto W.
Publicado: (2020)
por: Obermaier, Otto W.
Publicado: (2020)
D3.8 - LIBS technology for elemental analysis of water
por: Krawczuk, Simon
Publicado: (2024)
por: Krawczuk, Simon
Publicado: (2024)
Online Additive Hyperplanes (OAH)
por: Krawczuk, Jerzy
Publicado: (2026)
por: Krawczuk, Jerzy
Publicado: (2026)
Digging In and Branching Out: Collaborative Processes of Building, Embedding, and Evolving Online Interactive Learning Modules for Library Instruction
por: Ezell, Jon
Publicado: (2021)
por: Ezell, Jon
Publicado: (2021)
Digital primary source literacy: Developing skills for online archival research
por: Colleen Hoelscher
Publicado: (2024)
por: Colleen Hoelscher
Publicado: (2024)
One-Shots in Special Collections and Archives: Moving from Gatekeeper to Guide
por: Hoelscher, Colleen
Publicado: (2022)
por: Hoelscher, Colleen
Publicado: (2022)
Evaluating Collective Behaviour of Hundreds of LLM Agents
por: Willis, Richard, et al.
Publicado: (2026)
por: Willis, Richard, et al.
Publicado: (2026)
InvestESG: A multi-agent reinforcement learning benchmark for studying climate investment as a social dilemma
por: Hou, Xiaoxuan, et al.
Publicado: (2024)
por: Hou, Xiaoxuan, et al.
Publicado: (2024)
Will Systems of LLM Agents Cooperate: An Investigation into a Social Dilemma
por: Willis, Richard, et al.
Publicado: (2025)
por: Willis, Richard, et al.
Publicado: (2025)
Quantifying the Self-Interest Level of Markov Social Dilemmas
por: Willis, Richard, et al.
Publicado: (2025)
por: Willis, Richard, et al.
Publicado: (2025)
Resolving social dilemmas with minimal reward transfer
por: Willis, Richard, et al.
Publicado: (2023)
por: Willis, Richard, et al.
Publicado: (2023)
Measurement challenges in AI catastrophic risk governance and safety frameworks
por: Kasirzadeh, Atoosa
Publicado: (2024)
por: Kasirzadeh, Atoosa
Publicado: (2024)
Two Types of AI Existential Risk: Decisive and Accumulative
por: Kasirzadeh, Atoosa
Publicado: (2024)
por: Kasirzadeh, Atoosa
Publicado: (2024)
Habilidades sociais, auto-eficácia e decisão de carreira em universitários em no final de curso
por: Sheila Lauffer Glaser
Publicado: (2011)
por: Sheila Lauffer Glaser
Publicado: (2011)
A new class of orthogonal polynomials
por: Kahler, Stefan, et al.
Publicado: (2026)
por: Kahler, Stefan, et al.
Publicado: (2026)
Do We Use Relatively Bad (Algorithmic) Advice? The Effects of Performance Feedback and Advice Representation on Advice Usage
por: Stefan Daschner, et al.
Publicado: (2024)
por: Stefan Daschner, et al.
Publicado: (2024)
Ejemplares similares
-
Das lyrische Werk Antoni Langes
por: Hoelscher-Obermaier, Hans-Peter
Publicado: (2019) -
Andrzej Kuśniewicz' synkretistische Romanpoetik
por: Hoelscher-Obermaier, Hans-Peter
Publicado: (2019) -
Analyzing And Editing Inner Mechanisms Of Backdoored Language Models
por: Lamparth, Max, et al.
Publicado: (2023) -
Choosing What Game to Play without Selecting Equilibria: Inferring Safe (Pareto) Improvements in Binary Constraint Structures
por: Oesterheld, Caspar, et al.
Publicado: (2025) -
LLM Robustness Leaderboard v1 --Technical report
por: Lefebvre, Pierre Peigné -, et al.
Publicado: (2025)