Sparks of Cooperative Reasoning: LLMs as Strategic Hanabi Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ramesh, Mahesh, Jayakumar, Kaousheik, Ramkumar, Aswinkumar, Thodima, Pavan, Rege, Aniket, Vlatakis-Gkaragkounis, Emmanouil-Vasileios |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
No Coin Left Behind: Maximizing Strategic Surplus Against No-Regret Dynamics
par: Su, Yiheng, et autres
Publié: (2026)
par: Su, Yiheng, et autres
Publié: (2026)
MABViT -- Modified Attention Block Enhances Vision Transformers
par: Ramesh, Mahesh, et autres
Publié: (2023)
par: Ramesh, Mahesh, et autres
Publié: (2023)
Solving Neural Min-Max Games: The Role of Architecture, Initialization & Dynamics
par: Patel, Deep, et autres
Publié: (2025)
par: Patel, Deep, et autres
Publié: (2025)
Prudent-Banker: No Extra Fees for Baseline Safety in Adversarial Bandits With and Without Delays
par: Hu, Ting, et autres
Publié: (2026)
par: Hu, Ting, et autres
Publié: (2026)
Learning Safely Without Knowing the World:COMPASS-Hedge
par: Hu, Ting, et autres
Publié: (2026)
par: Hu, Ting, et autres
Publié: (2026)
Breaking $1/ε$ Barrier in Quantum Zero-Sum Games: Generalizing Metric Subregularity for Spectraplexes
par: Su, Yiheng, et autres
Publié: (2025)
par: Su, Yiheng, et autres
Publié: (2025)
Building Robust and Scalable Multilingual ASR for Indian Languages
par: Gangwar, Arjun, et autres
Publié: (2025)
par: Gangwar, Arjun, et autres
Publié: (2025)
Solving Zero-Sum Convex Markov Games
par: Kalogiannis, Fivos, et autres
Publié: (2025)
par: Kalogiannis, Fivos, et autres
Publié: (2025)
Shuffling the Data, Stretching the Step-size: Sharper Bias in constant step-size SGD
par: Emmanouilidis, Konstantinos, et autres
Publié: (2026)
par: Emmanouilidis, Konstantinos, et autres
Publié: (2026)
Algorithms and Complexity for Computing Nash Equilibria in Adversarial Team Games
par: Anagnostides, Ioannis, et autres
Publié: (2023)
par: Anagnostides, Ioannis, et autres
Publié: (2023)
Last-Iterate Convergence of Adaptive Riemannian Gradient Descent for Equilibrium Computation
par: Cai, Yang, et autres
Publié: (2023)
par: Cai, Yang, et autres
Publié: (2023)
Armada: Memory-Efficient Distributed Training of Large-Scale Graph Neural Networks
par: Waleffe, Roger, et autres
Publié: (2025)
par: Waleffe, Roger, et autres
Publié: (2025)
A Quadratic Speedup in Finding Nash Equilibria of Quantum Zero-Sum Games
par: Vasconcelos, Francisca, et autres
Publié: (2023)
par: Vasconcelos, Francisca, et autres
Publié: (2023)
Contracting with a Learning Agent
par: Guruganesh, Guru, et autres
Publié: (2024)
par: Guruganesh, Guru, et autres
Publié: (2024)
LLM-Hanabi: Evaluating Multi-Agent Gameplays with Theory-of-Mind and Rationale Inference in Imperfect Information Collaboration Game
par: Liang, Fangzhou, et autres
Publié: (2025)
par: Liang, Fangzhou, et autres
Publié: (2025)
RiddleBench: A New Generative Reasoning Benchmark for LLMs
par: Halder, Deepon, et autres
Publié: (2025)
par: Halder, Deepon, et autres
Publié: (2025)
Cooperate to Compete: Strategic Coordination in Multi-Agent Conquest
par: O'Neill, Abigail, et autres
Publié: (2026)
par: O'Neill, Abigail, et autres
Publié: (2026)
Shakespearean Sparks: The Dance of Hallucination and Creativity in LLMs' Decoding Layers
par: He, Zicong, et autres
Publié: (2025)
par: He, Zicong, et autres
Publié: (2025)
Cooperative Strategic Planning Enhances Reasoning Capabilities in Large Language Models
par: Wang, Danqing, et autres
Publié: (2024)
par: Wang, Danqing, et autres
Publié: (2024)
Multi-Turn Puzzles: Evaluating Interactive Reasoning and Strategic Dialogue in LLMs
par: Badola, Kartikeya, et autres
Publié: (2025)
par: Badola, Kartikeya, et autres
Publié: (2025)
From Building Blocks to Planning: Multi-Step Spatial Reasoning in LLMs with Reinforcement Learning
par: Tahmasbi, Amir, et autres
Publié: (2025)
par: Tahmasbi, Amir, et autres
Publié: (2025)
Spark: Strategic Policy-Aware Exploration via Dynamic Branching for Long-Horizon Agentic Learning
par: Wu, Jinyang, et autres
Publié: (2026)
par: Wu, Jinyang, et autres
Publié: (2026)
EPO: Explicit Policy Optimization for Strategic Reasoning in LLMs via Reinforcement Learning
par: Liu, Xiaoqian, et autres
Publié: (2025)
par: Liu, Xiaoqian, et autres
Publié: (2025)
CycleDistill: Bootstrapping Machine Translation using LLMs with Cyclical Distillation
par: Halder, Deepon, et autres
Publié: (2025)
par: Halder, Deepon, et autres
Publié: (2025)
CryptoLLM: Unleashing the Power of Prompted LLMs for SmartQnA and Classification of Crypto Posts
par: Deroy, Aniket, et autres
Publié: (2024)
par: Deroy, Aniket, et autres
Publié: (2024)
Improving Clinical Diagnosis with Counterfactual Multi-Agent Reasoning
par: You, Zhiwen, et autres
Publié: (2026)
par: You, Zhiwen, et autres
Publié: (2026)
Enhancing Language Agent Strategic Reasoning through Self-Play in Adversarial Games
par: Zhang, Yikai, et autres
Publié: (2025)
par: Zhang, Yikai, et autres
Publié: (2025)
Sparks of Tabular Reasoning via Text2SQL Reinforcement Learning
par: Stoisser, Josefa Lia, et autres
Publié: (2025)
par: Stoisser, Josefa Lia, et autres
Publié: (2025)
GameBench: Evaluating Strategic Reasoning Abilities of LLM Agents
par: Costarelli, Anthony, et autres
Publié: (2024)
par: Costarelli, Anthony, et autres
Publié: (2024)
EvoSpark: Endogenous Interactive Agent Societies for Unified Long-Horizon Narrative Evolution
par: He, Shiyu, et autres
Publié: (2026)
par: He, Shiyu, et autres
Publié: (2026)
ReSpark: Leveraging Previous Data Reports as References to Generate New Reports with LLMs
par: Tian, Yuan, et autres
Publié: (2025)
par: Tian, Yuan, et autres
Publié: (2025)
YouTube Comments Decoded: Leveraging LLMs for Low Resource Language Classification
par: Deroy, Aniket, et autres
Publié: (2024)
par: Deroy, Aniket, et autres
Publié: (2024)
Reinforcement Learning for Hanabi
par: Cohen, Nina, et autres
Publié: (2025)
par: Cohen, Nina, et autres
Publié: (2025)
SparkRA: A Retrieval-Augmented Knowledge Service System Based on Spark Large Language Model
par: Wu, Dayong, et autres
Publié: (2024)
par: Wu, Dayong, et autres
Publié: (2024)
CHBench: A Cognitive Hierarchy Benchmark for Evaluating Strategic Reasoning Capability of LLMs
par: Liu, Hongtao, et autres
Publié: (2025)
par: Liu, Hongtao, et autres
Publié: (2025)
Strategic Chain-of-Thought: Guiding Accurate Reasoning in LLMs through Strategy Elicitation
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
MMOU: A Massive Multi-Task Omni Understanding and Reasoning Benchmark for Long and Complex Real-World Videos
par: Goel, Arushi, et autres
Publié: (2026)
par: Goel, Arushi, et autres
Publié: (2026)
Losses that Cook: Topological Optimal Transport for Structured Recipe Generation
par: Ottoborgo, Mattia, et autres
Publié: (2026)
par: Ottoborgo, Mattia, et autres
Publié: (2026)
ADVOSYNTH: A Synthetic Multi-Advocate Dataset for Speaker Identification in Courtroom Scenarios
par: Deroy, Aniket
Publié: (2026)
par: Deroy, Aniket
Publié: (2026)
Synthesizing the Virtual Advocate: A Multi-Persona Speech Generation Framework for Diverse Linguistic Jurisdictions in Indic Languages
par: Deroy, Aniket
Publié: (2026)
par: Deroy, Aniket
Publié: (2026)
Documents similaires
-
No Coin Left Behind: Maximizing Strategic Surplus Against No-Regret Dynamics
par: Su, Yiheng, et autres
Publié: (2026) -
MABViT -- Modified Attention Block Enhances Vision Transformers
par: Ramesh, Mahesh, et autres
Publié: (2023) -
Solving Neural Min-Max Games: The Role of Architecture, Initialization & Dynamics
par: Patel, Deep, et autres
Publié: (2025) -
Prudent-Banker: No Extra Fees for Baseline Safety in Adversarial Bandits With and Without Delays
par: Hu, Ting, et autres
Publié: (2026) -
Learning Safely Without Knowing the World:COMPASS-Hedge
par: Hu, Ting, et autres
Publié: (2026)