Detecting Multi-Agent Collusion Through Multi-Agent Interpretability
Fuente:
arXiv
Salvato in:
| Autori principali: | Rose, Aaron, Cullen, Carissa, Abdelnabi, Sahar, Torr, Philip, Kaplowitz, Brandon Gary, de Witt, Christian Schroeder |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Colosseum: Auditing Collusion in Cooperative Multi-Agent Systems
di: Nakamura, Mason, et al.
Pubblicazione: (2026)
di: Nakamura, Mason, et al.
Pubblicazione: (2026)
Audit the Whisper: Detecting Steganographic Collusion in Multi-Agent LLMs
di: Tailor, Om
Pubblicazione: (2025)
di: Tailor, Om
Pubblicazione: (2025)
Multi-Agent Security Tax: Trading Off Security and Collaboration Capabilities in Multi-Agent Systems
di: Peigne-Lefebvre, Pierre, et al.
Pubblicazione: (2025)
di: Peigne-Lefebvre, Pierre, et al.
Pubblicazione: (2025)
Multi-Agent Reinforcement Learning for Market Making: Competition without Collusion
di: Wang, Ziyi, et al.
Pubblicazione: (2025)
di: Wang, Ziyi, et al.
Pubblicazione: (2025)
Voluntary Collusion with Secret Tools in Competing LLM Agents
di: Zeng, Xijie, et al.
Pubblicazione: (2026)
di: Zeng, Xijie, et al.
Pubblicazione: (2026)
SymboSLAM: Semantic Map Generation in a Multi-Agent System
di: Colelough, Brandon Curtis
Pubblicazione: (2024)
di: Colelough, Brandon Curtis
Pubblicazione: (2024)
Interpreting Emergent Extreme Events in Multi-Agent Systems
di: Tang, Ling, et al.
Pubblicazione: (2026)
di: Tang, Ling, et al.
Pubblicazione: (2026)
BMW Agents -- A Framework For Task Automation Through Multi-Agent Collaboration
di: Crawford, Noel, et al.
Pubblicazione: (2024)
di: Crawford, Noel, et al.
Pubblicazione: (2024)
Lying with Truths: Open-Channel Multi-Agent Collusion for Belief Manipulation via Generative Montage
di: Hu, Jinwei, et al.
Pubblicazione: (2026)
di: Hu, Jinwei, et al.
Pubblicazione: (2026)
MultiVer: Zero-Shot Multi-Agent Vulnerability Detection
di: Rajan, Shreshth
Pubblicazione: (2026)
di: Rajan, Shreshth
Pubblicazione: (2026)
Large Language Models Miss the Multi-Agent Mark
di: La Malfa, Emanuele, et al.
Pubblicazione: (2025)
di: La Malfa, Emanuele, et al.
Pubblicazione: (2025)
XAgents: A Framework for Interpretable Rule-Based Multi-Agents Cooperation
di: Yang, Hailong, et al.
Pubblicazione: (2024)
di: Yang, Hailong, et al.
Pubblicazione: (2024)
High-order Interactions Modeling for Interpretable Multi-Agent Q-Learning
di: Xu, Qinyu, et al.
Pubblicazione: (2025)
di: Xu, Qinyu, et al.
Pubblicazione: (2025)
Data-Efficient Multi-Agent Spatial Planning with LLMs
di: Su, Huangyuan, et al.
Pubblicazione: (2025)
di: Su, Huangyuan, et al.
Pubblicazione: (2025)
LLM Constitutional Multi-Agent Governance
di: de Curtò, J., et al.
Pubblicazione: (2026)
di: de Curtò, J., et al.
Pubblicazione: (2026)
Scalable Safe Multi-Agent Reinforcement Learning for Multi-Agent System
di: Du, Haikuo, et al.
Pubblicazione: (2025)
di: Du, Haikuo, et al.
Pubblicazione: (2025)
Rethinking Multi-Agent Intelligence Through the Lens of Small-World Networks
di: Wang, Boxuan, et al.
Pubblicazione: (2025)
di: Wang, Boxuan, et al.
Pubblicazione: (2025)
Inverse Attention Agents for Multi-Agent Systems
di: Long, Qian, et al.
Pubblicazione: (2024)
di: Long, Qian, et al.
Pubblicazione: (2024)
Single-Agent Scaling Fails Multi-Agent Intelligence: Towards Foundation Models with Native Multi-Agent Intelligence
di: Hu, Shuyue, et al.
Pubblicazione: (2025)
di: Hu, Shuyue, et al.
Pubblicazione: (2025)
Open Challenges in Multi-Agent Security: Towards Secure Systems of Interacting AI Agents
di: de Witt, Christian Schroeder, et al.
Pubblicazione: (2025)
di: de Witt, Christian Schroeder, et al.
Pubblicazione: (2025)
AgentMixer: Multi-Agent Correlated Policy Factorization
di: Li, Zhiyuan, et al.
Pubblicazione: (2024)
di: Li, Zhiyuan, et al.
Pubblicazione: (2024)
MPAC: A Multi-Principal Agent Coordination Protocol for Interoperable Multi-Agent Collaboration
di: Qian, Kaiyang, et al.
Pubblicazione: (2026)
di: Qian, Kaiyang, et al.
Pubblicazione: (2026)
Who's the Mole? Modeling and Detecting Intention-Hiding Malicious Agents in LLM-Based Multi-Agent Systems
di: Xie, Yizhe, et al.
Pubblicazione: (2025)
di: Xie, Yizhe, et al.
Pubblicazione: (2025)
JaxMARL: Multi-Agent RL Environments and Algorithms in JAX
di: Rutherford, Alexander, et al.
Pubblicazione: (2023)
di: Rutherford, Alexander, et al.
Pubblicazione: (2023)
AgentArk: Distilling Multi-Agent Intelligence into a Single LLM Agent
di: Luo, Yinyi, et al.
Pubblicazione: (2026)
di: Luo, Yinyi, et al.
Pubblicazione: (2026)
The Heterogeneous Multi-Agent Challenge
di: Dansereau, Charles, et al.
Pubblicazione: (2025)
di: Dansereau, Charles, et al.
Pubblicazione: (2025)
Advancing Multi-Agent Systems Through Model Context Protocol: Architecture, Implementation, and Applications
di: Krishnan, Naveen
Pubblicazione: (2025)
di: Krishnan, Naveen
Pubblicazione: (2025)
LLMDR: LLM-Driven Deadlock Detection and Resolution in Multi-Agent Pathfinding
di: Seo, Seungbae, et al.
Pubblicazione: (2025)
di: Seo, Seungbae, et al.
Pubblicazione: (2025)
BioAgents: Democratizing Bioinformatics Analysis with Multi-Agent Systems
di: Mehandru, Nikita, et al.
Pubblicazione: (2025)
di: Mehandru, Nikita, et al.
Pubblicazione: (2025)
Optimizing Agent Collaboration through Heuristic Multi-Agent Planning
di: Soffair, Nitsan
Pubblicazione: (2023)
di: Soffair, Nitsan
Pubblicazione: (2023)
Very Large-Scale Multi-Agent Simulation in AgentScope
di: Pan, Xuchen, et al.
Pubblicazione: (2024)
di: Pan, Xuchen, et al.
Pubblicazione: (2024)
AgentSchool: An LLM-Powered Multi-Agent Simulation for Education
di: Ye, Yulei, et al.
Pubblicazione: (2026)
di: Ye, Yulei, et al.
Pubblicazione: (2026)
Extending the OWASP Multi-Agentic System Threat Modeling Guide: Insights from Multi-Agent Security Research
di: Krawiecka, Klaudia, et al.
Pubblicazione: (2025)
di: Krawiecka, Klaudia, et al.
Pubblicazione: (2025)
When Cloud Agents Meet Device Agents: Lessons from Hybrid Multi-Agent Systems
di: Rainone, Corrado, et al.
Pubblicazione: (2026)
di: Rainone, Corrado, et al.
Pubblicazione: (2026)
OPTAGENT: Optimizing Multi-Agent LLM Interactions Through Verbal Reinforcement Learning for Enhanced Reasoning
di: Bi, Zhenyu, et al.
Pubblicazione: (2025)
di: Bi, Zhenyu, et al.
Pubblicazione: (2025)
PanelTR: Zero-Shot Table Reasoning Framework Through Multi-Agent Scientific Discussion
di: Ma, Yiran Rex
Pubblicazione: (2025)
di: Ma, Yiran Rex
Pubblicazione: (2025)
MASTER: Multi-Agent Security Through Exploration of Roles and Topological Structures -- A Comprehensive Framework
di: Zhu, Yifan, et al.
Pubblicazione: (2025)
di: Zhu, Yifan, et al.
Pubblicazione: (2025)
Vulnerable Agent Identification in Large-Scale Multi-Agent Reinforcement Learning
di: Li, Simin, et al.
Pubblicazione: (2025)
di: Li, Simin, et al.
Pubblicazione: (2025)
TAPE: Leveraging Agent Topology for Cooperative Multi-Agent Policy Gradient
di: Lou, Xingzhou, et al.
Pubblicazione: (2023)
di: Lou, Xingzhou, et al.
Pubblicazione: (2023)
Enforcement Agents: Enhancing Accountability and Resilience in Multi-Agent AI Frameworks
di: Tamang, Sagar, et al.
Pubblicazione: (2025)
di: Tamang, Sagar, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Colosseum: Auditing Collusion in Cooperative Multi-Agent Systems
di: Nakamura, Mason, et al.
Pubblicazione: (2026) -
Audit the Whisper: Detecting Steganographic Collusion in Multi-Agent LLMs
di: Tailor, Om
Pubblicazione: (2025) -
Multi-Agent Security Tax: Trading Off Security and Collaboration Capabilities in Multi-Agent Systems
di: Peigne-Lefebvre, Pierre, et al.
Pubblicazione: (2025) -
Multi-Agent Reinforcement Learning for Market Making: Competition without Collusion
di: Wang, Ziyi, et al.
Pubblicazione: (2025) -
Voluntary Collusion with Secret Tools in Competing LLM Agents
di: Zeng, Xijie, et al.
Pubblicazione: (2026)