Can Large Language Models Master Complex Card Games?
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Wei, Bie, Fuqing, Chen, Junzhe, Zhang, Dan, Huang, Shiyu, Kharlamov, Evgeny, Tang, Jie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GuARD: Effective Anomaly Detection through a Text-Rich and Graph-Informed Language Model
di: Pang, Yunhe, et al.
Pubblicazione: (2024)
di: Pang, Yunhe, et al.
Pubblicazione: (2024)
Cards Against LLMs: Benchmarking Humor Alignment in Large Language Models
di: Fettach, Yousra, et al.
Pubblicazione: (2026)
di: Fettach, Yousra, et al.
Pubblicazione: (2026)
LLMArena: Assessing Capabilities of Large Language Models in Dynamic Multi-Agent Environments
di: Chen, Junzhe, et al.
Pubblicazione: (2024)
di: Chen, Junzhe, et al.
Pubblicazione: (2024)
Robust Knowledge Extraction from Large Language Models using Social Choice Theory
di: Potyka, Nico, et al.
Pubblicazione: (2023)
di: Potyka, Nico, et al.
Pubblicazione: (2023)
ICT: Image-Object Cross-Level Trusted Intervention for Mitigating Object Hallucination in Large Vision-Language Models
di: Chen, Junzhe, et al.
Pubblicazione: (2024)
di: Chen, Junzhe, et al.
Pubblicazione: (2024)
Can Large Language Models Understand Real-World Complex Instructions?
di: He, Qianyu, et al.
Pubblicazione: (2023)
di: He, Qianyu, et al.
Pubblicazione: (2023)
Quantity Matters: Towards Assessing and Mitigating Number Hallucination in Large Vision-Language Models
di: Zhang, Huixuan, et al.
Pubblicazione: (2024)
di: Zhang, Huixuan, et al.
Pubblicazione: (2024)
BenchmarkCards: Standardized Documentation for Large Language Model Benchmarks
di: Sokol, Anna, et al.
Pubblicazione: (2024)
di: Sokol, Anna, et al.
Pubblicazione: (2024)
Can Large Language Models Identify Authorship?
di: Huang, Baixiang, et al.
Pubblicazione: (2024)
di: Huang, Baixiang, et al.
Pubblicazione: (2024)
Enhancing Commentary Strategies for Imperfect Information Card Games: A Study of Large Language Models in Guandan Commentary
di: Tao, Meiling, et al.
Pubblicazione: (2024)
di: Tao, Meiling, et al.
Pubblicazione: (2024)
NutePrune: Efficient Progressive Pruning with Numerous Teachers for Large Language Models
di: Li, Shengrui, et al.
Pubblicazione: (2024)
di: Li, Shengrui, et al.
Pubblicazione: (2024)
AutoRE: Document-Level Relation Extraction with Large Language Models
di: Xue, Lilong, et al.
Pubblicazione: (2024)
di: Xue, Lilong, et al.
Pubblicazione: (2024)
BattleAgentBench: A Benchmark for Evaluating Cooperation and Competition Capabilities of Language Models in Multi-Agent Systems
di: Wang, Wei, et al.
Pubblicazione: (2024)
di: Wang, Wei, et al.
Pubblicazione: (2024)
OmniPlay: Benchmarking Omni-Modal Models on Omni-Modal Game Playing
di: Bie, Fuqing, et al.
Pubblicazione: (2025)
di: Bie, Fuqing, et al.
Pubblicazione: (2025)
Exploring Causal Effect of Social Bias on Faithfulness Hallucinations in Large Language Models
di: Zhang, Zhenliang, et al.
Pubblicazione: (2025)
di: Zhang, Zhenliang, et al.
Pubblicazione: (2025)
LogicGame: Benchmarking Rule-Based Reasoning Abilities of Large Language Models
di: Gui, Jiayi, et al.
Pubblicazione: (2024)
di: Gui, Jiayi, et al.
Pubblicazione: (2024)
Exploring and Evaluating Multimodal Knowledge Reasoning Consistency of Multimodal Large Language Models
di: Jia, Boyu, et al.
Pubblicazione: (2025)
di: Jia, Boyu, et al.
Pubblicazione: (2025)
A Dutch Financial Large Language Model
di: Noels, Sander, et al.
Pubblicazione: (2024)
di: Noels, Sander, et al.
Pubblicazione: (2024)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
di: Wang, Jingyuan, et al.
Pubblicazione: (2025)
di: Wang, Jingyuan, et al.
Pubblicazione: (2025)
Multi-Granularity Semantic Revision for Large Language Model Distillation
di: Liu, Xiaoyu, et al.
Pubblicazione: (2024)
di: Liu, Xiaoyu, et al.
Pubblicazione: (2024)
Can Perplexity Reflect Large Language Model's Ability in Long Text Understanding?
di: Hu, Yutong, et al.
Pubblicazione: (2024)
di: Hu, Yutong, et al.
Pubblicazione: (2024)
KVLink: Accelerating Large Language Models via Efficient KV Cache Reuse
di: Yang, Jingbo, et al.
Pubblicazione: (2025)
di: Yang, Jingbo, et al.
Pubblicazione: (2025)
Exploring Large Language Models for Word Games:Who is the Spy?
di: Wei, Chentian, et al.
Pubblicazione: (2025)
di: Wei, Chentian, et al.
Pubblicazione: (2025)
Can Large Language Models Capture Video Game Engagement?
di: Melhart, David, et al.
Pubblicazione: (2025)
di: Melhart, David, et al.
Pubblicazione: (2025)
Can Multimodal Large Language Model Think Analogically?
di: Guo, Diandian, et al.
Pubblicazione: (2024)
di: Guo, Diandian, et al.
Pubblicazione: (2024)
Evaluating Accounting Reasoning Capabilities of Large Language Models
di: Zhou, Jie, et al.
Pubblicazione: (2026)
di: Zhou, Jie, et al.
Pubblicazione: (2026)
Persuasion with Large Language Models: A Survey of Empirical Evidence, Study Methodologies, and Ethical Implications
di: Noels, Sander, et al.
Pubblicazione: (2024)
di: Noels, Sander, et al.
Pubblicazione: (2024)
Can Large Language Models Understand Internet Buzzwords Through User-Generated Content
di: Huang, Chen, et al.
Pubblicazione: (2025)
di: Huang, Chen, et al.
Pubblicazione: (2025)
DetectBench: Can Large Language Model Detect and Piece Together Implicit Evidence?
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
EIFBENCH: Extremely Complex Instruction Following Benchmark for Large Language Models
di: Zou, Tao, et al.
Pubblicazione: (2025)
di: Zou, Tao, et al.
Pubblicazione: (2025)
A Learning Rate Path Switching Training Paradigm for Version Updates of Large Language Models
di: Wang, Zhihao, et al.
Pubblicazione: (2024)
di: Wang, Zhihao, et al.
Pubblicazione: (2024)
MASTER: Enhancing Large Language Model via Multi-Agent Simulated Teaching
di: Yue, Liang, et al.
Pubblicazione: (2025)
di: Yue, Liang, et al.
Pubblicazione: (2025)
AMONGAGENTS: Evaluating Large Language Models in the Interactive Text-Based Social Deduction Game
di: Chi, Yizhou, et al.
Pubblicazione: (2024)
di: Chi, Yizhou, et al.
Pubblicazione: (2024)
Cardiverse: Harnessing LLMs for Novel Card Game Prototyping
di: Li, Danrui, et al.
Pubblicazione: (2025)
di: Li, Danrui, et al.
Pubblicazione: (2025)
BLINK: Multimodal Large Language Models Can See but Not Perceive
di: Fu, Xingyu, et al.
Pubblicazione: (2024)
di: Fu, Xingyu, et al.
Pubblicazione: (2024)
Instruction-Following Pruning for Large Language Models
di: Hou, Bairu, et al.
Pubblicazione: (2025)
di: Hou, Bairu, et al.
Pubblicazione: (2025)
Can Large Language Models Function as Qualified Pediatricians? A Systematic Evaluation in Real-World Clinical Contexts
di: Zhu, Siyu, et al.
Pubblicazione: (2025)
di: Zhu, Siyu, et al.
Pubblicazione: (2025)
A Comprehensive Survey on Evaluating Large Language Model Applications in the Medical Industry
di: Huang, Yining, et al.
Pubblicazione: (2024)
di: Huang, Yining, et al.
Pubblicazione: (2024)
Surgical Action Planning with Large Language Models
di: Xu, Mengya, et al.
Pubblicazione: (2025)
di: Xu, Mengya, et al.
Pubblicazione: (2025)
Building and Measuring Trust between Large Language Models
di: Buyl, Maarten, et al.
Pubblicazione: (2025)
di: Buyl, Maarten, et al.
Pubblicazione: (2025)
Documenti analoghi
-
GuARD: Effective Anomaly Detection through a Text-Rich and Graph-Informed Language Model
di: Pang, Yunhe, et al.
Pubblicazione: (2024) -
Cards Against LLMs: Benchmarking Humor Alignment in Large Language Models
di: Fettach, Yousra, et al.
Pubblicazione: (2026) -
LLMArena: Assessing Capabilities of Large Language Models in Dynamic Multi-Agent Environments
di: Chen, Junzhe, et al.
Pubblicazione: (2024) -
Robust Knowledge Extraction from Large Language Models using Social Choice Theory
di: Potyka, Nico, et al.
Pubblicazione: (2023) -
ICT: Image-Object Cross-Level Trusted Intervention for Mitigating Object Hallucination in Large Vision-Language Models
di: Chen, Junzhe, et al.
Pubblicazione: (2024)