How Far Are LLMs from Professional Poker Players? Revisiting Game-Theoretic Reasoning with Agentic Tool Use
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lin, Minhua, Dai, Enyan, Liu, Hui, Tang, Xianfeng, Yan, Yuliang, Dai, Zhenwei, Zeng, Jingying, Zhang, Zhiwei, Wang, Fali, Gao, Hongcheng, Luo, Chen, Zhang, Xiang, He, Qi, Wang, Suhang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Rethinking Graph Backdoor Attacks: A Distribution-Preserving Perspective
par: Zhang, Zhiwei, et autres
Publié: (2024)
par: Zhang, Zhiwei, et autres
Publié: (2024)
PreGIP: Watermarking the Pretraining of Graph Neural Networks for Deep Intellectual Property Protection
par: Dai, Enyan, et autres
Publié: (2024)
par: Dai, Enyan, et autres
Publié: (2024)
How Far are LLMs from Real Search? A Comprehensive Study on Efficiency, Completeness, and Inherent Capabilities
par: Lin, Minhua, et autres
Publié: (2025)
par: Lin, Minhua, et autres
Publié: (2025)
Robustness Inspired Graph Backdoor Defense
par: Zhang, Zhiwei, et autres
Publié: (2024)
par: Zhang, Zhiwei, et autres
Publié: (2024)
Are You Using Reliable Graph Prompts? Trojan Prompt Attacks on Graph Neural Networks
par: Lin, Minhua, et autres
Publié: (2024)
par: Lin, Minhua, et autres
Publié: (2024)
Bradley-Terry and Multi-Objective Reward Modeling Are Complementary
par: Zhang, Zhiwei, et autres
Publié: (2025)
par: Zhang, Zhiwei, et autres
Publié: (2025)
AgentTTS: Large Language Model Agent for Test-time Compute-optimal Scaling Strategy in Complex Tasks
par: Wang, Fali, et autres
Publié: (2025)
par: Wang, Fali, et autres
Publié: (2025)
Position: Agentic Evolution is the Path to Evolving LLMs
par: Lin, Minhua, et autres
Publié: (2026)
par: Lin, Minhua, et autres
Publié: (2026)
Stealing Training Graphs from Graph Neural Networks
par: Lin, Minhua, et autres
Publié: (2024)
par: Lin, Minhua, et autres
Publié: (2024)
Image Corruption-Inspired Membership Inference Attacks against Large Vision-Language Models
par: Wu, Zongyu, et autres
Publié: (2025)
par: Wu, Zongyu, et autres
Publié: (2025)
Unlocking the Power of Multi-Agent LLM for Reasoning: From Lazy Agents to Deliberation
par: Zhang, Zhiwei, et autres
Publié: (2025)
par: Zhang, Zhiwei, et autres
Publié: (2025)
PokerBench: Training Large Language Models to become Professional Poker Players
par: Zhuang, Richard, et autres
Publié: (2025)
par: Zhuang, Richard, et autres
Publié: (2025)
TRAJECT-Bench:A Trajectory-Aware Benchmark for Evaluating Agentic Tool Use
par: He, Pengfei, et autres
Publié: (2025)
par: He, Pengfei, et autres
Publié: (2025)
Learning Fair Models without Sensitive Attributes: A Generative Approach
par: Zhu, Huaisheng, et autres
Publié: (2022)
par: Zhu, Huaisheng, et autres
Publié: (2022)
MemMA: Coordinating the Memory Cycle through Multi-Agent Reasoning and In-Situ Self-Evolution
par: Lin, Minhua, et autres
Publié: (2026)
par: Lin, Minhua, et autres
Publié: (2026)
DuFFin: A Dual-Level Fingerprinting Framework for LLMs IP Protection
par: Yan, Yuliang, et autres
Publié: (2025)
par: Yan, Yuliang, et autres
Publié: (2025)
Shape-aware Graph Spectral Learning
par: Xu, Junjie, et autres
Publié: (2023)
par: Xu, Junjie, et autres
Publié: (2023)
How Explanations Leak the Decision Logic: Stealing Graph Neural Networks via Explanation Alignment
par: Ma, Bin, et autres
Publié: (2025)
par: Ma, Bin, et autres
Publié: (2025)
Adaptive Test-Time Reasoning via Reward-Guided Dual-Phase Search
par: Cui, Yingqian, et autres
Publié: (2025)
par: Cui, Yingqian, et autres
Publié: (2025)
LanP: Rethinking the Impact of Language Priors in Large Vision-Language Models
par: Wu, Zongyu, et autres
Publié: (2025)
par: Wu, Zongyu, et autres
Publié: (2025)
Distribution Consistency based Self-Training for Graph Neural Networks with Sparse Labels
par: Wang, Fali, et autres
Publié: (2024)
par: Wang, Fali, et autres
Publié: (2024)
SCL-GNN: Towards Generalizable Graph Neural Networks via Spurious Correlation Learning
par: Zhang, Yuxiang, et autres
Publié: (2026)
par: Zhang, Yuxiang, et autres
Publié: (2026)
Catastrophic Failure of LLM Unlearning via Quantization
par: Zhang, Zhiwei, et autres
Publié: (2024)
par: Zhang, Zhiwei, et autres
Publié: (2024)
GraphSkill: Documentation-Guided Hierarchical Retrieval-Augmented Coding for Complex Graph Reasoning
par: Wang, Fali, et autres
Publié: (2026)
par: Wang, Fali, et autres
Publié: (2026)
Generalizing Test-time Compute-optimal Scaling as an Optimizable Graph
par: Wang, Fali, et autres
Publié: (2025)
par: Wang, Fali, et autres
Publié: (2025)
HC-GST: Heterophily-aware Distribution Consistency based Graph Self-training
par: Wang, Fali, et autres
Publié: (2024)
par: Wang, Fali, et autres
Publié: (2024)
A General Framework to Enhance Fine-tuning-based LLM Unlearning
par: Ren, Jie, et autres
Publié: (2025)
par: Ren, Jie, et autres
Publié: (2025)
BioMol-MQA: A Multi-Modal Question Answering Dataset For LLM Reasoning Over Bio-Molecular Interactions
par: Sengupta, Saptarshi, et autres
Publié: (2025)
par: Sengupta, Saptarshi, et autres
Publié: (2025)
Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models
par: Cui, Yingqian, et autres
Publié: (2025)
par: Cui, Yingqian, et autres
Publié: (2025)
A Comprehensive Survey on Reinforcement Learning-based Agentic Search: Foundations, Roles, Optimizations, Evaluations, and Applications
par: Lin, Minhua, et autres
Publié: (2025)
par: Lin, Minhua, et autres
Publié: (2025)
A Comprehensive Survey of Small Language Models in the Era of Large Language Models: Techniques, Enhancements, Applications, Collaboration with LLMs, and Trustworthiness
par: Wang, Fali, et autres
Publié: (2024)
par: Wang, Fali, et autres
Publié: (2024)
PokerSkill: LLMs Can Play Expert-Level Poker without Training or Solvers
par: Li, Boning, et autres
Publié: (2026)
par: Li, Boning, et autres
Publié: (2026)
Poisoning the Inner Prediction Logic of Graph Neural Networks for Clean-Label Backdoor Attacks
par: Zhang, Yuxiang, et autres
Publié: (2026)
par: Zhang, Yuxiang, et autres
Publié: (2026)
LiSA: Leveraging Link Recommender to Attack Graph Neural Networks via Subgraph Injection
par: Zhang, Wenlun, et autres
Publié: (2025)
par: Zhang, Wenlun, et autres
Publié: (2025)
Route to Rome Attack: Directing LLM Routers to Expensive Models via Adversarial Suffix Optimization
par: Tang, Haochun, et autres
Publié: (2026)
par: Tang, Haochun, et autres
Publié: (2026)
General Protein Pretraining or Domain-Specific Designs? Benchmarking Protein Modeling on Realistic Applications
par: Yan, Shuo, et autres
Publié: (2025)
par: Yan, Shuo, et autres
Publié: (2025)
Playing the Player: A Heuristic Framework for Adaptive Poker AI
par: Paterson, Andrew, et autres
Publié: (2025)
par: Paterson, Andrew, et autres
Publié: (2025)
To trust or not to trust: Attention-based Trust Management for LLM Multi-Agent Systems
par: He, Pengfei, et autres
Publié: (2025)
par: He, Pengfei, et autres
Publié: (2025)
Cite Before You Speak: Enhancing Context-Response Grounding in E-commerce Conversational LLM-Agents
par: Zeng, Jingying, et autres
Publié: (2025)
par: Zeng, Jingying, et autres
Publié: (2025)
Instruction-Driven Game Engine: A Poker Case Study
par: Wu, Hongqiu, et autres
Publié: (2024)
par: Wu, Hongqiu, et autres
Publié: (2024)
Documents similaires
-
Rethinking Graph Backdoor Attacks: A Distribution-Preserving Perspective
par: Zhang, Zhiwei, et autres
Publié: (2024) -
PreGIP: Watermarking the Pretraining of Graph Neural Networks for Deep Intellectual Property Protection
par: Dai, Enyan, et autres
Publié: (2024) -
How Far are LLMs from Real Search? A Comprehensive Study on Efficiency, Completeness, and Inherent Capabilities
par: Lin, Minhua, et autres
Publié: (2025) -
Robustness Inspired Graph Backdoor Defense
par: Zhang, Zhiwei, et autres
Publié: (2024) -
Are You Using Reliable Graph Prompts? Trojan Prompt Attacks on Graph Neural Networks
par: Lin, Minhua, et autres
Publié: (2024)