Measuring Reasoning Trace Legibility: Can Those Who Understand Teach?
Fuente:
arXiv
Salvato in:
| Autori principali: | Roytburg, Dani, Sridhar, Shreya, Ippolito, Daphne |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MAS-Orchestra: Understanding and Improving Multi-Agent Reasoning Through Holistic Orchestration and Controlled Benchmarks
di: Ke, Zixuan, et al.
Pubblicazione: (2026)
di: Ke, Zixuan, et al.
Pubblicazione: (2026)
ReasonMed: A 370K Multi-Agent Generated Dataset for Advancing Medical Reasoning
di: Sun, Yu, et al.
Pubblicazione: (2025)
di: Sun, Yu, et al.
Pubblicazione: (2025)
"Teammates, Am I Clear?": Analysing Legible Behaviours in Teams
di: Faria, Miguel, et al.
Pubblicazione: (2025)
di: Faria, Miguel, et al.
Pubblicazione: (2025)
Weak-Link Optimization for Multi-Agent Reasoning and Collaboration
di: Bian, Haoyu, et al.
Pubblicazione: (2026)
di: Bian, Haoyu, et al.
Pubblicazione: (2026)
Building and Measuring Trust between Large Language Models
di: Buyl, Maarten, et al.
Pubblicazione: (2025)
di: Buyl, Maarten, et al.
Pubblicazione: (2025)
MAS-ProVe: Understanding the Process Verification of Multi-Agent Systems
di: Venkataramani, Vishal, et al.
Pubblicazione: (2026)
di: Venkataramani, Vishal, et al.
Pubblicazione: (2026)
Too Polite to Disagree: Understanding Sycophancy Propagation in Multi-Agent Systems
di: Kasprova, Vira, et al.
Pubblicazione: (2026)
di: Kasprova, Vira, et al.
Pubblicazione: (2026)
CulturePark: Boosting Cross-cultural Understanding in Large Language Models
di: Li, Cheng, et al.
Pubblicazione: (2024)
di: Li, Cheng, et al.
Pubblicazione: (2024)
QUACK: Questioning, Understanding, and Auditing Communicated Knowledge in Multimodal Social Deduction Agents
di: Yuan, Ye, et al.
Pubblicazione: (2026)
di: Yuan, Ye, et al.
Pubblicazione: (2026)
Talk Isn't Always Cheap: Understanding Failure Modes in Multi-Agent Debate
di: Wynn, Andrea, et al.
Pubblicazione: (2025)
di: Wynn, Andrea, et al.
Pubblicazione: (2025)
CONSCIENTIA: Can LLM Agents Learn to Strategize? Emergent Deception and Trust in a Multi-Agent NYC Simulation
di: Sinha, Aarush, et al.
Pubblicazione: (2026)
di: Sinha, Aarush, et al.
Pubblicazione: (2026)
From Debate to Deliberation: Structured Collective Reasoning with Typed Epistemic Acts
di: Prakash, Sunil
Pubblicazione: (2026)
di: Prakash, Sunil
Pubblicazione: (2026)
Beyond Static Tools: Test-Time Tool Evolution for Scientific Reasoning
di: Lu, Jiaxuan, et al.
Pubblicazione: (2026)
di: Lu, Jiaxuan, et al.
Pubblicazione: (2026)
Systematic Failures in Collective Reasoning under Distributed Information in Multi-Agent LLMs
di: Li, Yuxuan, et al.
Pubblicazione: (2025)
di: Li, Yuxuan, et al.
Pubblicazione: (2025)
SciAgent: A Unified Multi-Agent System for Generalistic Scientific Reasoning
di: Li, Xuchen, et al.
Pubblicazione: (2025)
di: Li, Xuchen, et al.
Pubblicazione: (2025)
STAR-PólyaMath: Multi-Agent Reasoning under Persistent Meta-Strategic Supervision
di: Wu, Jiaao, et al.
Pubblicazione: (2026)
di: Wu, Jiaao, et al.
Pubblicazione: (2026)
From Assumptions to Actions: Turning LLM Reasoning into Uncertainty-Aware Planning for Embodied Agents
di: Seo, SeungWon, et al.
Pubblicazione: (2026)
di: Seo, SeungWon, et al.
Pubblicazione: (2026)
LegalGraphRAG: Multi-Agent Graph Retrieval-Augmented Generation for Reliable Legal Reasoning
di: Chen, Zerui, et al.
Pubblicazione: (2026)
di: Chen, Zerui, et al.
Pubblicazione: (2026)
Social Reasoning in Machines: Investigating Collective Truth-Seeking Dynamics in Large Language Model Debate
di: Pecher, Tom
Pubblicazione: (2026)
di: Pecher, Tom
Pubblicazione: (2026)
MARBLE: A Multi-Agent Rule-Based LLM Reasoning Engine for Accident Severity Prediction
di: Qasim, Kaleem Ullah, et al.
Pubblicazione: (2025)
di: Qasim, Kaleem Ullah, et al.
Pubblicazione: (2025)
G2CP: A Graph-Grounded Communication Protocol for Verifiable and Efficient Multi-Agent Reasoning
di: Khaled, Karim Ben, et al.
Pubblicazione: (2026)
di: Khaled, Karim Ben, et al.
Pubblicazione: (2026)
Geode: A Zero-shot Geospatial Question-Answering Agent with Explicit Reasoning and Precise Spatio-Temporal Retrieval
di: Gupta, Devashish Vikas, et al.
Pubblicazione: (2024)
di: Gupta, Devashish Vikas, et al.
Pubblicazione: (2024)
DataSage: Multi-agent Collaboration for Insight Discovery with External Knowledge Retrieval, Multi-role Debating, and Multi-path Reasoning
di: Liu, Xiaochuan, et al.
Pubblicazione: (2025)
di: Liu, Xiaochuan, et al.
Pubblicazione: (2025)
Who Gets the Reward, Who Gets the Blame? Evaluation-Aligned Training Signals for Multi-LLM Agents
di: Yang, Chih-Hsuan, et al.
Pubblicazione: (2025)
di: Yang, Chih-Hsuan, et al.
Pubblicazione: (2025)
Can LLMs Write Faithfully? An Agent-Based Evaluation of LLM-generated Islamic Content
di: Mushtaq, Abdullah, et al.
Pubblicazione: (2025)
di: Mushtaq, Abdullah, et al.
Pubblicazione: (2025)
Multi-agent Undercover Gaming: Hallucination Removal via Counterfactual Test for Multimodal Reasoning
di: Liang, Dayong, et al.
Pubblicazione: (2025)
di: Liang, Dayong, et al.
Pubblicazione: (2025)
A Picture Is Worth a Graph: A Blueprint Debate Paradigm for Multimodal Reasoning
di: Zheng, Changmeng, et al.
Pubblicazione: (2024)
di: Zheng, Changmeng, et al.
Pubblicazione: (2024)
Can We Predict Before Executing Machine Learning Agents?
di: Zheng, Jingsheng, et al.
Pubblicazione: (2026)
di: Zheng, Jingsheng, et al.
Pubblicazione: (2026)
LLM Agents in Interaction: Measuring Personality Consistency and Linguistic Alignment in Interacting Populations of Large Language Models
di: Frisch, Ivar, et al.
Pubblicazione: (2024)
di: Frisch, Ivar, et al.
Pubblicazione: (2024)
TeachMaster: Generative Teaching via Code
di: Wang, Yuheng, et al.
Pubblicazione: (2025)
di: Wang, Yuheng, et al.
Pubblicazione: (2025)
LLMs Can Simulate Standardized Patients via Agent Coevolution
di: Du, Zhuoyun, et al.
Pubblicazione: (2024)
di: Du, Zhuoyun, et al.
Pubblicazione: (2024)
ScamAgents: How AI Agents Can Simulate Human-Level Scam Calls
di: Badhe, Sanket
Pubblicazione: (2025)
di: Badhe, Sanket
Pubblicazione: (2025)
Adaptive Memory Admission Control for LLM Agents
di: Zhang, Guilin, et al.
Pubblicazione: (2026)
di: Zhang, Guilin, et al.
Pubblicazione: (2026)
LLM-as-RNN: A Recurrent Language Model for Memory Updates and Sequence Prediction
di: Lu, Yuxing, et al.
Pubblicazione: (2026)
di: Lu, Yuxing, et al.
Pubblicazione: (2026)
MiRAGE: A Multiagent Framework for Generating Multimodal Multihop Question-Answer Dataset for RAG Evaluation
di: Sahu, Chandan Kumar, et al.
Pubblicazione: (2026)
di: Sahu, Chandan Kumar, et al.
Pubblicazione: (2026)
Lying with Truths: Open-Channel Multi-Agent Collusion for Belief Manipulation via Generative Montage
di: Hu, Jinwei, et al.
Pubblicazione: (2026)
di: Hu, Jinwei, et al.
Pubblicazione: (2026)
Social Dynamics as Critical Vulnerabilities that Undermine Objective Decision-Making in LLM Collectives
di: Ko, Changgeon, et al.
Pubblicazione: (2026)
di: Ko, Changgeon, et al.
Pubblicazione: (2026)
Moira: Language-driven Hierarchical Reinforcement Learning for Pair Trading
di: Giannouris, Polydoros, et al.
Pubblicazione: (2026)
di: Giannouris, Polydoros, et al.
Pubblicazione: (2026)
CANTANTE: Optimizing Agentic Systems via Contrastive Credit Attribution
di: Zehle, Tom
Pubblicazione: (2026)
di: Zehle, Tom
Pubblicazione: (2026)
Colosseum: Auditing Collusion in Cooperative Multi-Agent Systems
di: Nakamura, Mason, et al.
Pubblicazione: (2026)
di: Nakamura, Mason, et al.
Pubblicazione: (2026)
Documenti analoghi
-
MAS-Orchestra: Understanding and Improving Multi-Agent Reasoning Through Holistic Orchestration and Controlled Benchmarks
di: Ke, Zixuan, et al.
Pubblicazione: (2026) -
ReasonMed: A 370K Multi-Agent Generated Dataset for Advancing Medical Reasoning
di: Sun, Yu, et al.
Pubblicazione: (2025) -
"Teammates, Am I Clear?": Analysing Legible Behaviours in Teams
di: Faria, Miguel, et al.
Pubblicazione: (2025) -
Weak-Link Optimization for Multi-Agent Reasoning and Collaboration
di: Bian, Haoyu, et al.
Pubblicazione: (2026) -
Building and Measuring Trust between Large Language Models
di: Buyl, Maarten, et al.
Pubblicazione: (2025)