Can Large Language Models Master Complex Card Games?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Wei, Bie, Fuqing, Chen, Junzhe, Zhang, Dan, Huang, Shiyu, Kharlamov, Evgeny, Tang, Jie |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GuARD: Effective Anomaly Detection through a Text-Rich and Graph-Informed Language Model
par: Pang, Yunhe, et autres
Publié: (2024)
par: Pang, Yunhe, et autres
Publié: (2024)
Cards Against LLMs: Benchmarking Humor Alignment in Large Language Models
par: Fettach, Yousra, et autres
Publié: (2026)
par: Fettach, Yousra, et autres
Publié: (2026)
LLMArena: Assessing Capabilities of Large Language Models in Dynamic Multi-Agent Environments
par: Chen, Junzhe, et autres
Publié: (2024)
par: Chen, Junzhe, et autres
Publié: (2024)
Robust Knowledge Extraction from Large Language Models using Social Choice Theory
par: Potyka, Nico, et autres
Publié: (2023)
par: Potyka, Nico, et autres
Publié: (2023)
ICT: Image-Object Cross-Level Trusted Intervention for Mitigating Object Hallucination in Large Vision-Language Models
par: Chen, Junzhe, et autres
Publié: (2024)
par: Chen, Junzhe, et autres
Publié: (2024)
Can Large Language Models Understand Real-World Complex Instructions?
par: He, Qianyu, et autres
Publié: (2023)
par: He, Qianyu, et autres
Publié: (2023)
Quantity Matters: Towards Assessing and Mitigating Number Hallucination in Large Vision-Language Models
par: Zhang, Huixuan, et autres
Publié: (2024)
par: Zhang, Huixuan, et autres
Publié: (2024)
BenchmarkCards: Standardized Documentation for Large Language Model Benchmarks
par: Sokol, Anna, et autres
Publié: (2024)
par: Sokol, Anna, et autres
Publié: (2024)
Can Large Language Models Identify Authorship?
par: Huang, Baixiang, et autres
Publié: (2024)
par: Huang, Baixiang, et autres
Publié: (2024)
NutePrune: Efficient Progressive Pruning with Numerous Teachers for Large Language Models
par: Li, Shengrui, et autres
Publié: (2024)
par: Li, Shengrui, et autres
Publié: (2024)
Enhancing Commentary Strategies for Imperfect Information Card Games: A Study of Large Language Models in Guandan Commentary
par: Tao, Meiling, et autres
Publié: (2024)
par: Tao, Meiling, et autres
Publié: (2024)
AutoRE: Document-Level Relation Extraction with Large Language Models
par: Xue, Lilong, et autres
Publié: (2024)
par: Xue, Lilong, et autres
Publié: (2024)
BattleAgentBench: A Benchmark for Evaluating Cooperation and Competition Capabilities of Language Models in Multi-Agent Systems
par: Wang, Wei, et autres
Publié: (2024)
par: Wang, Wei, et autres
Publié: (2024)
OmniPlay: Benchmarking Omni-Modal Models on Omni-Modal Game Playing
par: Bie, Fuqing, et autres
Publié: (2025)
par: Bie, Fuqing, et autres
Publié: (2025)
Exploring Causal Effect of Social Bias on Faithfulness Hallucinations in Large Language Models
par: Zhang, Zhenliang, et autres
Publié: (2025)
par: Zhang, Zhenliang, et autres
Publié: (2025)
LogicGame: Benchmarking Rule-Based Reasoning Abilities of Large Language Models
par: Gui, Jiayi, et autres
Publié: (2024)
par: Gui, Jiayi, et autres
Publié: (2024)
Exploring and Evaluating Multimodal Knowledge Reasoning Consistency of Multimodal Large Language Models
par: Jia, Boyu, et autres
Publié: (2025)
par: Jia, Boyu, et autres
Publié: (2025)
A Dutch Financial Large Language Model
par: Noels, Sander, et autres
Publié: (2024)
par: Noels, Sander, et autres
Publié: (2024)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
par: Wang, Jingyuan, et autres
Publié: (2025)
par: Wang, Jingyuan, et autres
Publié: (2025)
Multi-Granularity Semantic Revision for Large Language Model Distillation
par: Liu, Xiaoyu, et autres
Publié: (2024)
par: Liu, Xiaoyu, et autres
Publié: (2024)
Can Perplexity Reflect Large Language Model's Ability in Long Text Understanding?
par: Hu, Yutong, et autres
Publié: (2024)
par: Hu, Yutong, et autres
Publié: (2024)
KVLink: Accelerating Large Language Models via Efficient KV Cache Reuse
par: Yang, Jingbo, et autres
Publié: (2025)
par: Yang, Jingbo, et autres
Publié: (2025)
Exploring Large Language Models for Word Games:Who is the Spy?
par: Wei, Chentian, et autres
Publié: (2025)
par: Wei, Chentian, et autres
Publié: (2025)
Can Large Language Models Capture Video Game Engagement?
par: Melhart, David, et autres
Publié: (2025)
par: Melhart, David, et autres
Publié: (2025)
Can Multimodal Large Language Model Think Analogically?
par: Guo, Diandian, et autres
Publié: (2024)
par: Guo, Diandian, et autres
Publié: (2024)
Evaluating Accounting Reasoning Capabilities of Large Language Models
par: Zhou, Jie, et autres
Publié: (2026)
par: Zhou, Jie, et autres
Publié: (2026)
Persuasion with Large Language Models: A Survey of Empirical Evidence, Study Methodologies, and Ethical Implications
par: Noels, Sander, et autres
Publié: (2024)
par: Noels, Sander, et autres
Publié: (2024)
Can Large Language Models Understand Internet Buzzwords Through User-Generated Content
par: Huang, Chen, et autres
Publié: (2025)
par: Huang, Chen, et autres
Publié: (2025)
DetectBench: Can Large Language Model Detect and Piece Together Implicit Evidence?
par: Gu, Zhouhong, et autres
Publié: (2024)
par: Gu, Zhouhong, et autres
Publié: (2024)
EIFBENCH: Extremely Complex Instruction Following Benchmark for Large Language Models
par: Zou, Tao, et autres
Publié: (2025)
par: Zou, Tao, et autres
Publié: (2025)
A Learning Rate Path Switching Training Paradigm for Version Updates of Large Language Models
par: Wang, Zhihao, et autres
Publié: (2024)
par: Wang, Zhihao, et autres
Publié: (2024)
MASTER: Enhancing Large Language Model via Multi-Agent Simulated Teaching
par: Yue, Liang, et autres
Publié: (2025)
par: Yue, Liang, et autres
Publié: (2025)
AMONGAGENTS: Evaluating Large Language Models in the Interactive Text-Based Social Deduction Game
par: Chi, Yizhou, et autres
Publié: (2024)
par: Chi, Yizhou, et autres
Publié: (2024)
Cardiverse: Harnessing LLMs for Novel Card Game Prototyping
par: Li, Danrui, et autres
Publié: (2025)
par: Li, Danrui, et autres
Publié: (2025)
BLINK: Multimodal Large Language Models Can See but Not Perceive
par: Fu, Xingyu, et autres
Publié: (2024)
par: Fu, Xingyu, et autres
Publié: (2024)
Instruction-Following Pruning for Large Language Models
par: Hou, Bairu, et autres
Publié: (2025)
par: Hou, Bairu, et autres
Publié: (2025)
Can Large Language Models Function as Qualified Pediatricians? A Systematic Evaluation in Real-World Clinical Contexts
par: Zhu, Siyu, et autres
Publié: (2025)
par: Zhu, Siyu, et autres
Publié: (2025)
A Comprehensive Survey on Evaluating Large Language Model Applications in the Medical Industry
par: Huang, Yining, et autres
Publié: (2024)
par: Huang, Yining, et autres
Publié: (2024)
Building and Measuring Trust between Large Language Models
par: Buyl, Maarten, et autres
Publié: (2025)
par: Buyl, Maarten, et autres
Publié: (2025)
Surgical Action Planning with Large Language Models
par: Xu, Mengya, et autres
Publié: (2025)
par: Xu, Mengya, et autres
Publié: (2025)
Documents similaires
-
GuARD: Effective Anomaly Detection through a Text-Rich and Graph-Informed Language Model
par: Pang, Yunhe, et autres
Publié: (2024) -
Cards Against LLMs: Benchmarking Humor Alignment in Large Language Models
par: Fettach, Yousra, et autres
Publié: (2026) -
LLMArena: Assessing Capabilities of Large Language Models in Dynamic Multi-Agent Environments
par: Chen, Junzhe, et autres
Publié: (2024) -
Robust Knowledge Extraction from Large Language Models using Social Choice Theory
par: Potyka, Nico, et autres
Publié: (2023) -
ICT: Image-Object Cross-Level Trusted Intervention for Mitigating Object Hallucination in Large Vision-Language Models
par: Chen, Junzhe, et autres
Publié: (2024)