TeamBench: Evaluating Agent Coordination under Enforced Role Separation
Fuente:
arXiv
Salvato in:
| Autori principali: | Kim, Yubin, Park, Chanwoo, Kim, Taehan, Park, Eugene, Schmidgall, Samuel, Rahman, Salman, Park, Chunjong, Breazeal, Cynthia, Liu, Xin, Palangi, Hamid, Park, Hae Won, McDuff, Daniel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
InvThink: Premortem Reasoning for Safer Language Models
di: Kim, Yubin, et al.
Pubblicazione: (2025)
di: Kim, Yubin, et al.
Pubblicazione: (2025)
Health-LLM: Large Language Models for Health Prediction via Wearable Sensor Data
di: Kim, Yubin, et al.
Pubblicazione: (2024)
di: Kim, Yubin, et al.
Pubblicazione: (2024)
VocalAgent: Large Language Models for Vocal Health Diagnostics with Safety-Aware Evaluation
di: Kim, Yubin, et al.
Pubblicazione: (2025)
di: Kim, Yubin, et al.
Pubblicazione: (2025)
Tiered Agentic Oversight: A Hierarchical Multi-Agent System for Healthcare Safety
di: Kim, Yubin, et al.
Pubblicazione: (2025)
di: Kim, Yubin, et al.
Pubblicazione: (2025)
MDAgents: An Adaptive Collaboration of LLMs for Medical Decision-Making
di: Kim, Yubin, et al.
Pubblicazione: (2024)
di: Kim, Yubin, et al.
Pubblicazione: (2024)
A Demonstration of Adaptive Collaboration of Large Language Models for Medical Decision-Making
di: Kim, Yubin, et al.
Pubblicazione: (2024)
di: Kim, Yubin, et al.
Pubblicazione: (2024)
BehaviorSFT: Behavioral Token Conditioning for Clinical Agents Across the Proactivity Spectrum
di: Kim, Yubin, et al.
Pubblicazione: (2025)
di: Kim, Yubin, et al.
Pubblicazione: (2025)
Integrating Flow Theory and Adaptive Robot Roles: A Conceptual Model of Dynamic Robot Role Adaptation for the Enhanced Flow Experience in Long-term Multi-person Human-Robot Interactions
di: Chen, Huili, et al.
Pubblicazione: (2024)
di: Chen, Huili, et al.
Pubblicazione: (2024)
Does "Reasoning" with Large Language Models Improve Recognizing, Generating, and Reframing Unhelpful Thoughts?
di: Qi, Yilin, et al.
Pubblicazione: (2025)
di: Qi, Yilin, et al.
Pubblicazione: (2025)
EmpathicStories++: A Multimodal Dataset for Empathy towards Personal Experiences
di: Shen, Jocelyn, et al.
Pubblicazione: (2024)
di: Shen, Jocelyn, et al.
Pubblicazione: (2024)
Improving Dialogue Agents by Decomposing One Global Explicit Annotation with Local Implicit Multimodal Feedback
di: Lee, Dong Won, et al.
Pubblicazione: (2024)
di: Lee, Dong Won, et al.
Pubblicazione: (2024)
Towards a Science of Scaling Agent Systems
di: Kim, Yubin, et al.
Pubblicazione: (2025)
di: Kim, Yubin, et al.
Pubblicazione: (2025)
Aligning Dialogue Agents with Global Feedback via Large Language Model Multimodal Reward Decomposition
di: Lee, Dong Won, et al.
Pubblicazione: (2025)
di: Lee, Dong Won, et al.
Pubblicazione: (2025)
An Effective Energy Mask-based Adversarial Evasion Attacks against Misclassification in Speaker Recognition Systems
di: Park, Chanwoo, et al.
Pubblicazione: (2026)
di: Park, Chanwoo, et al.
Pubblicazione: (2026)
CoDaS: AI Co-Data-Scientist for Biomarker Discovery via Wearable Sensors
di: Kim, Yubin, et al.
Pubblicazione: (2026)
di: Kim, Yubin, et al.
Pubblicazione: (2026)
HEART-felt Narratives: Tracing Empathy and Narrative Style in Personal Stories with LLMs
di: Shen, Jocelyn, et al.
Pubblicazione: (2024)
di: Shen, Jocelyn, et al.
Pubblicazione: (2024)
Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning
di: Lee, Dong Won, et al.
Pubblicazione: (2025)
di: Lee, Dong Won, et al.
Pubblicazione: (2025)
Medical Hallucinations in Foundation Models and Their Impact on Healthcare
di: Kim, Yubin, et al.
Pubblicazione: (2025)
di: Kim, Yubin, et al.
Pubblicazione: (2025)
EL-AGHF: Extended Lagrangian Affine Geometric Heat Flow
di: Kim, Sangmin, et al.
Pubblicazione: (2025)
di: Kim, Sangmin, et al.
Pubblicazione: (2025)
A Modern System Recipe for Situated Embodied Human-Robot Conversation with Real-Time Multimodal LLMs and Tool-Calling
di: Lee, Dong Won, et al.
Pubblicazione: (2026)
di: Lee, Dong Won, et al.
Pubblicazione: (2026)
Separate and Reconstruct: Asymmetric Encoder-Decoder for Speech Separation
di: Shin, Ui-Hyeop, et al.
Pubblicazione: (2024)
di: Shin, Ui-Hyeop, et al.
Pubblicazione: (2024)
Social Robots as Social Proxies for Fostering Connection and Empathy Towards Humanity
di: Shen, Jocelyn, et al.
Pubblicazione: (2025)
di: Shen, Jocelyn, et al.
Pubblicazione: (2025)
Words Like Knives: Backstory-Personalized Modeling and Detection of Violent Communication
di: Shen, Jocelyn, et al.
Pubblicazione: (2025)
di: Shen, Jocelyn, et al.
Pubblicazione: (2025)
Multi-Player Zero-Sum Markov Games with Networked Separable Interactions
di: Park, Chanwoo, et al.
Pubblicazione: (2023)
di: Park, Chanwoo, et al.
Pubblicazione: (2023)
Interpretable Geometry Sensitivity for Inverse Design of Integrated Photonics
di: Park, Junho, et al.
Pubblicazione: (2025)
di: Park, Junho, et al.
Pubblicazione: (2025)
Beyond Line-Level Filtering for the Pretraining Corpora of LLMs
di: Park, Chanwoo, et al.
Pubblicazione: (2025)
di: Park, Chanwoo, et al.
Pubblicazione: (2025)
VGenST-Bench: A Benchmark for Spatio-Temporal Reasoning via Active Video Synthesis
di: Park, Jinho, et al.
Pubblicazione: (2026)
di: Park, Jinho, et al.
Pubblicazione: (2026)
A Learning Framework for Diverse Legged Robot Locomotion Using Barrier-Based Style Rewards
di: Kim, Gijeong, et al.
Pubblicazione: (2024)
di: Kim, Gijeong, et al.
Pubblicazione: (2024)
The Hidden Puppet Master: Predicting Human Belief Change in Manipulative LLM Dialogues
di: Shen, Jocelyn, et al.
Pubblicazione: (2026)
di: Shen, Jocelyn, et al.
Pubblicazione: (2026)
DynaFlow: Dynamics-embedded Flow Matching for Physically Consistent Motion Generation from State-only Demonstrations
di: Lee, Sowoo, et al.
Pubblicazione: (2025)
di: Lee, Sowoo, et al.
Pubblicazione: (2025)
A Modular Residual Learning Framework to Enhance Model-Based Approach for Robust Locomotion
di: Kim, Min-Gyu, et al.
Pubblicazione: (2025)
di: Kim, Min-Gyu, et al.
Pubblicazione: (2025)
Reasoning-Based Approach with Chain-of-Thought for Alzheimer's Detection Using Speech and Large Language Models
di: Park, Chanwoo, et al.
Pubblicazione: (2025)
di: Park, Chanwoo, et al.
Pubblicazione: (2025)
Dynamically-Consistent Trajectory Optimization for Legged Robots via Contact Point Decomposition
di: Kim, Sangmin, et al.
Pubblicazione: (2025)
di: Kim, Sangmin, et al.
Pubblicazione: (2025)
An ℒ∞/2 Control for Networked Control Systems with Delays: The Differential Linear Matrix Inequality Approach
di: Hae Yeon Park, et al.
Pubblicazione: (2026)
di: Hae Yeon Park, et al.
Pubblicazione: (2026)
Site4Drug: Predicting Drug-Binding Target Sites with an AI Agent
di: Kim, Taehan, et al.
Pubblicazione: (2026)
di: Kim, Taehan, et al.
Pubblicazione: (2026)
Constructed Response Paragraph Jigsaw Puzzle Test for Measuring Structure Building Ability
di: Hwimin Kim, et al.
Pubblicazione: (2026)
di: Hwimin Kim, et al.
Pubblicazione: (2026)
Online Friction Coefficient Identification for Legged Robots on Slippery Terrain Using Smoothed Contact Gradients
di: Kim, Hajun, et al.
Pubblicazione: (2025)
di: Kim, Hajun, et al.
Pubblicazione: (2025)
Natural Functional Gradients for Smooth Trajectory Optimization
di: Park, Kisang, et al.
Pubblicazione: (2026)
di: Park, Kisang, et al.
Pubblicazione: (2026)
Thunder-LLM: Efficiently Adapting LLMs to Korean with Minimal Resources
di: Kim, Jinpyo, et al.
Pubblicazione: (2025)
di: Kim, Jinpyo, et al.
Pubblicazione: (2025)
A Bag of Tricks for Few-Shot Class-Incremental Learning
di: Roy, Shuvendu, et al.
Pubblicazione: (2024)
di: Roy, Shuvendu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
InvThink: Premortem Reasoning for Safer Language Models
di: Kim, Yubin, et al.
Pubblicazione: (2025) -
Health-LLM: Large Language Models for Health Prediction via Wearable Sensor Data
di: Kim, Yubin, et al.
Pubblicazione: (2024) -
VocalAgent: Large Language Models for Vocal Health Diagnostics with Safety-Aware Evaluation
di: Kim, Yubin, et al.
Pubblicazione: (2025) -
Tiered Agentic Oversight: A Hierarchical Multi-Agent System for Healthcare Safety
di: Kim, Yubin, et al.
Pubblicazione: (2025) -
MDAgents: An Adaptive Collaboration of LLMs for Medical Decision-Making
di: Kim, Yubin, et al.
Pubblicazione: (2024)