The Social Laboratory: A Psychometric Framework for Multi-Agent LLM Evaluation
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Reza, Zarreen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Interactional Fairness in LLM Multi-Agent Systems: An Evaluation Framework
par: Binkyte, Ruta
Publié: (2025)
par: Binkyte, Ruta
Publié: (2025)
MetaCogAgent: A Metacognitive Multi-Agent LLM Framework with Self-Aware Task Delegation
par: Wang, Chenyu, et autres
Publié: (2026)
par: Wang, Chenyu, et autres
Publié: (2026)
LLM-enabled Social Agents
par: Gürcan, Önder, et autres
Publié: (2026)
par: Gürcan, Önder, et autres
Publié: (2026)
Regulator-Manufacturer AI Agents Modeling: Mathematical Feedback-Driven Multi-Agent LLM Framework
par: Han, Yu, et autres
Publié: (2024)
par: Han, Yu, et autres
Publié: (2024)
Evaluating Theory of Mind and Internal Beliefs in LLM-Based Multi-Agent Systems
par: Kostka, Adam, et autres
Publié: (2026)
par: Kostka, Adam, et autres
Publié: (2026)
Technical Implementation of Tippy: Multi-Agent Architecture and System Design for Drug Discovery Laboratory Automation
par: Fehlis, Yao, et autres
Publié: (2025)
par: Fehlis, Yao, et autres
Publié: (2025)
Silo-Bench: A Scalable Environment for Evaluating Distributed Coordination in Multi-Agent LLM Systems
par: Zhang, Yuzhe, et autres
Publié: (2026)
par: Zhang, Yuzhe, et autres
Publié: (2026)
SODE: Analyzing Social Dynamics in LLM Agents
par: Jung, Inseo, et autres
Publié: (2026)
par: Jung, Inseo, et autres
Publié: (2026)
Swarm Intelligence Enhanced Reasoning: A Density-Driven Framework for LLM-Based Multi-Agent Optimization
par: Zhu, Ying, et autres
Publié: (2025)
par: Zhu, Ying, et autres
Publié: (2025)
A Safety-Aware Role-Orchestrated Multi-Agent LLM Framework for Behavioral Health Communication Simulation
par: Cho, Ha Na
Publié: (2026)
par: Cho, Ha Na
Publié: (2026)
The Role of Social Learning and Collective Norm Formation in Fostering Cooperation in LLM Multi-Agent Systems
par: Gupta, Prateek, et autres
Publié: (2025)
par: Gupta, Prateek, et autres
Publié: (2025)
LLM Constitutional Multi-Agent Governance
par: de Curtò, J., et autres
Publié: (2026)
par: de Curtò, J., et autres
Publié: (2026)
Evaluating Creativity and Deception in Large Language Models: A Simulation Framework for Multi-Agent Balderdash
par: Hejabi, Parsa, et autres
Publié: (2024)
par: Hejabi, Parsa, et autres
Publié: (2024)
AgentSchool: An LLM-Powered Multi-Agent Simulation for Education
par: Ye, Yulei, et autres
Publié: (2026)
par: Ye, Yulei, et autres
Publié: (2026)
AgentArk: Distilling Multi-Agent Intelligence into a Single LLM Agent
par: Luo, Yinyi, et autres
Publié: (2026)
par: Luo, Yinyi, et autres
Publié: (2026)
PartnerMAS: An LLM Hierarchical Multi-Agent Framework for Business Partner Selection on High-Dimensional Features
par: Li, Lingyao, et autres
Publié: (2025)
par: Li, Lingyao, et autres
Publié: (2025)
Integrating LLM in Agent-Based Social Simulation: Opportunities and Challenges
par: Taillandier, Patrick, et autres
Publié: (2025)
par: Taillandier, Patrick, et autres
Publié: (2025)
BMW Agents -- A Framework For Task Automation Through Multi-Agent Collaboration
par: Crawford, Noel, et autres
Publié: (2024)
par: Crawford, Noel, et autres
Publié: (2024)
NAAMSE: Framework for Evolutionary Security Evaluation of Agents
par: Pai, Kunal, et autres
Publié: (2026)
par: Pai, Kunal, et autres
Publié: (2026)
SAGE: Multi-Agent Self-Evolution for LLM Reasoning
par: Peng, Yulin, et autres
Publié: (2026)
par: Peng, Yulin, et autres
Publié: (2026)
Insider Attacks in Multi-Agent LLM Consensus Systems
par: Sun, Xiaolin, et autres
Publié: (2026)
par: Sun, Xiaolin, et autres
Publié: (2026)
LLM Multi-Agent Systems: Challenges and Open Problems
par: Han, Shanshan, et autres
Publié: (2024)
par: Han, Shanshan, et autres
Publié: (2024)
Conjunctive Prompt Attacks in Multi-Agent LLM Systems
par: Arif, Nokimul Hasan, et autres
Publié: (2026)
par: Arif, Nokimul Hasan, et autres
Publié: (2026)
Gradientsys: A Multi-Agent LLM Scheduler with ReAct Orchestration
par: Song, Xinyuan, et autres
Publié: (2025)
par: Song, Xinyuan, et autres
Publié: (2025)
Hierarchical LLM-Based Multi-Agent Framework with Prompt Optimization for Multi-Robot Task Planning
par: Kawabe, Tomoya, et autres
Publié: (2026)
par: Kawabe, Tomoya, et autres
Publié: (2026)
Toward LLM-Agent-Based Modeling of Transportation Systems: A Conceptual Framework
par: Liu, Tianming, et autres
Publié: (2024)
par: Liu, Tianming, et autres
Publié: (2024)
QD-MAPPER: A Quality Diversity Framework to Automatically Evaluate Multi-Agent Path Finding Algorithms in Diverse Maps
par: Qian, Cheng, et autres
Publié: (2024)
par: Qian, Cheng, et autres
Publié: (2024)
HAWK: A Hierarchical Workflow Framework for Multi-Agent Collaboration
par: Cheng, Yuyang, et autres
Publié: (2025)
par: Cheng, Yuyang, et autres
Publié: (2025)
Enforcement Agents: Enhancing Accountability and Resilience in Multi-Agent AI Frameworks
par: Tamang, Sagar, et autres
Publié: (2025)
par: Tamang, Sagar, et autres
Publié: (2025)
What Is Your Agent's GPA? A Framework for Evaluating Agent Goal-Plan-Action Alignment
par: Jia, Allison Sihan, et autres
Publié: (2025)
par: Jia, Allison Sihan, et autres
Publié: (2025)
LLM Enabled Multi-Agent System for 6G Networks: Framework and Method of Dual-Loop Edge-Terminal Collaboration
par: Qu, Zheyan, et autres
Publié: (2025)
par: Qu, Zheyan, et autres
Publié: (2025)
RPA-Check: A Multi-Stage Automated Framework for Evaluating Dynamic LLM-based Role-Playing Agents
par: Rosati, Riccardo, et autres
Publié: (2026)
par: Rosati, Riccardo, et autres
Publié: (2026)
Games Agents Play: Towards Transactional Analysis in LLM-based Multi-Agent Systems
par: Zamojska, Monika, et autres
Publié: (2025)
par: Zamojska, Monika, et autres
Publié: (2025)
SocialGFs: Learning Social Gradient Fields for Multi-Agent Reinforcement Learning
par: Long, Qian, et autres
Publié: (2024)
par: Long, Qian, et autres
Publié: (2024)
TAMAS: Benchmarking Adversarial Risks in Multi-Agent LLM Systems
par: Kavathekar, Ishan, et autres
Publié: (2025)
par: Kavathekar, Ishan, et autres
Publié: (2025)
Optimizing Sequential Multi-Step Tasks with Parallel LLM Agents
par: Zhang, Enhao, et autres
Publié: (2025)
par: Zhang, Enhao, et autres
Publié: (2025)
LLM-Agent-Controller: A Universal Multi-Agent Large Language Model System as a Control Engineer
par: Zahedifar, Rasoul, et autres
Publié: (2025)
par: Zahedifar, Rasoul, et autres
Publié: (2025)
NegotiationGym: Self-Optimizing Agents in a Multi-Agent Social Simulation Environment
par: Mangla, Shashank, et autres
Publié: (2025)
par: Mangla, Shashank, et autres
Publié: (2025)
Spontaneous Emergence of Agent Individuality through Social Interactions in LLM-Based Communities
par: Takata, Ryosuke, et autres
Publié: (2024)
par: Takata, Ryosuke, et autres
Publié: (2024)
MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework
par: Hong, Sirui, et autres
Publié: (2023)
par: Hong, Sirui, et autres
Publié: (2023)
Documents similaires
-
Interactional Fairness in LLM Multi-Agent Systems: An Evaluation Framework
par: Binkyte, Ruta
Publié: (2025) -
MetaCogAgent: A Metacognitive Multi-Agent LLM Framework with Self-Aware Task Delegation
par: Wang, Chenyu, et autres
Publié: (2026) -
LLM-enabled Social Agents
par: Gürcan, Önder, et autres
Publié: (2026) -
Regulator-Manufacturer AI Agents Modeling: Mathematical Feedback-Driven Multi-Agent LLM Framework
par: Han, Yu, et autres
Publié: (2024) -
Evaluating Theory of Mind and Internal Beliefs in LLM-Based Multi-Agent Systems
par: Kostka, Adam, et autres
Publié: (2026)