Probing Large Language Models in Reasoning and Translating Complex Linguistic Puzzles
Fuente:
arXiv
Salvato in:
| Autori principali: | Lin, Zheng-Lin, Shih, Yu-Fei, Hsieh, Shu-Kai |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reasoning Over the Glyphs: Evaluation of LLM's Decipherment of Rare Scripts
di: Shih, Yu-Fei, et al.
Pubblicazione: (2025)
di: Shih, Yu-Fei, et al.
Pubblicazione: (2025)
AutoLogi: Automated Generation of Logic Puzzles for Evaluating Reasoning Abilities of Large Language Models
di: Zhu, Qin, et al.
Pubblicazione: (2025)
di: Zhu, Qin, et al.
Pubblicazione: (2025)
TangramPuzzle: Evaluating Multimodal Large Language Models with Compositional Spatial Reasoning
di: Liu, Daixian, et al.
Pubblicazione: (2026)
di: Liu, Daixian, et al.
Pubblicazione: (2026)
LingBench++: A Linguistically-Informed Benchmark and Reasoning Framework for Multi-Step and Cross-Cultural Inference with LLMs
di: Lian, Da-Chen, et al.
Pubblicazione: (2025)
di: Lian, Da-Chen, et al.
Pubblicazione: (2025)
LINGOLY: A Benchmark of Olympiad-Level Linguistic Reasoning Puzzles in Low-Resource and Extinct Languages
di: Bean, Andrew M., et al.
Pubblicazione: (2024)
di: Bean, Andrew M., et al.
Pubblicazione: (2024)
Enigmata: Scaling Logical Reasoning in Large Language Models with Synthetic Verifiable Puzzles
di: Chen, Jiangjie, et al.
Pubblicazione: (2025)
di: Chen, Jiangjie, et al.
Pubblicazione: (2025)
Inductive Linguistic Reasoning with Large Language Models
di: Ramji, Raghav, et al.
Pubblicazione: (2024)
di: Ramji, Raghav, et al.
Pubblicazione: (2024)
Puzzle Solving using Reasoning of Large Language Models: A Survey
di: Giadikiaroglou, Panagiotis, et al.
Pubblicazione: (2024)
di: Giadikiaroglou, Panagiotis, et al.
Pubblicazione: (2024)
Decomposed Prompting: Probing Multilingual Linguistic Structure Knowledge in Large Language Models
di: Nie, Ercong, et al.
Pubblicazione: (2024)
di: Nie, Ercong, et al.
Pubblicazione: (2024)
Do LLMs Know What Is Private Internally? Probing and Steering Contextual Privacy Norms in Large Language Model Representations
di: Wang, Haoran, et al.
Pubblicazione: (2026)
di: Wang, Haoran, et al.
Pubblicazione: (2026)
Can LLMs Generate and Solve Linguistic Olympiad Puzzles?
di: Majmudar, Neh, et al.
Pubblicazione: (2025)
di: Majmudar, Neh, et al.
Pubblicazione: (2025)
Converging to a Lingua Franca: Evolution of Linguistic Regions and Semantics Alignment in Multilingual Large Language Models
di: Zeng, Hongchuan, et al.
Pubblicazione: (2024)
di: Zeng, Hongchuan, et al.
Pubblicazione: (2024)
Exchange of Perspective Prompting Enhances Reasoning in Large Language Models
di: Sun, Lin, et al.
Pubblicazione: (2025)
di: Sun, Lin, et al.
Pubblicazione: (2025)
PuzzlePlex: Benchmarking Foundation Models on Reasoning and Planning with Puzzles
di: Long, Yitao, et al.
Pubblicazione: (2025)
di: Long, Yitao, et al.
Pubblicazione: (2025)
AdamMeme: Adaptively Probe the Reasoning Capacity of Multimodal Large Language Models on Harmfulness
di: Chen, Zixin, et al.
Pubblicazione: (2025)
di: Chen, Zixin, et al.
Pubblicazione: (2025)
LLaMAX: Scaling Linguistic Horizons of LLM by Enhancing Translation Capabilities Beyond 100 Languages
di: Lu, Yinquan, et al.
Pubblicazione: (2024)
di: Lu, Yinquan, et al.
Pubblicazione: (2024)
How Chinese are Chinese Language Models? The Puzzling Lack of Language Policy in China's LLMs
di: Wen-Yi, Andrea W, et al.
Pubblicazione: (2024)
di: Wen-Yi, Andrea W, et al.
Pubblicazione: (2024)
UNVEILING: What Makes Linguistics Olympiad Puzzles Tricky for LLMs?
di: Choudhary, Mukund, et al.
Pubblicazione: (2025)
di: Choudhary, Mukund, et al.
Pubblicazione: (2025)
Generative Evaluation of Complex Reasoning in Large Language Models
di: Lin, Haowei, et al.
Pubblicazione: (2025)
di: Lin, Haowei, et al.
Pubblicazione: (2025)
Translate With Care: Addressing Gender Bias, Neutrality, and Reasoning in Large Language Model Translations
di: Zahraei, Pardis Sadat, et al.
Pubblicazione: (2025)
di: Zahraei, Pardis Sadat, et al.
Pubblicazione: (2025)
Bridging the Linguistic Divide: A Survey on Leveraging Large Language Models for Machine Translation
di: Gain, Baban, et al.
Pubblicazione: (2025)
di: Gain, Baban, et al.
Pubblicazione: (2025)
Linguistic Minimal Pairs Elicit Linguistic Similarity in Large Language Models
di: Zhou, Xinyu, et al.
Pubblicazione: (2024)
di: Zhou, Xinyu, et al.
Pubblicazione: (2024)
Pixology: Probing the Linguistic and Visual Capabilities of Pixel-based Language Models
di: Tatariya, Kushal, et al.
Pubblicazione: (2024)
di: Tatariya, Kushal, et al.
Pubblicazione: (2024)
On Memorization of Large Language Models in Logical Reasoning
di: Xie, Chulin, et al.
Pubblicazione: (2024)
di: Xie, Chulin, et al.
Pubblicazione: (2024)
Prompt-Induced Linguistic Fingerprints for LLM-Generated Fake News Detection
di: Wang, Chi, et al.
Pubblicazione: (2025)
di: Wang, Chi, et al.
Pubblicazione: (2025)
Targeted Linguistic Analysis of Sign Language Models with Minimal Translation Pairs
di: Karabüklü, Serpil, et al.
Pubblicazione: (2026)
di: Karabüklü, Serpil, et al.
Pubblicazione: (2026)
Revisiting Anthropomorphic Reflection Markers in Large Language Model Reasoning
di: Yu, Yahan, et al.
Pubblicazione: (2026)
di: Yu, Yahan, et al.
Pubblicazione: (2026)
Jigsaw Puzzles: Splitting Harmful Questions to Jailbreak Large Language Models
di: Yang, Hao, et al.
Pubblicazione: (2024)
di: Yang, Hao, et al.
Pubblicazione: (2024)
OR-Bench: An Over-Refusal Benchmark for Large Language Models
di: Cui, Justin, et al.
Pubblicazione: (2024)
di: Cui, Justin, et al.
Pubblicazione: (2024)
MathRobust-LV: Evaluation of Large Language Models' Robustness to Linguistic Variations in Mathematical Reasoning
di: Kirtane, Neeraja, et al.
Pubblicazione: (2025)
di: Kirtane, Neeraja, et al.
Pubblicazione: (2025)
Probing Large Language Models for Scalar Adjective Lexical Semantics and Scalar Diversity Pragmatics
di: Lin, Fangru, et al.
Pubblicazione: (2024)
di: Lin, Fangru, et al.
Pubblicazione: (2024)
A Large Language Model Based Method for Complex Logical Reasoning over Knowledge Graphs
di: Zhang, Ziyan, et al.
Pubblicazione: (2025)
di: Zhang, Ziyan, et al.
Pubblicazione: (2025)
Linguistic Intelligence in Large Language Models for Telecommunications
di: Ahmed, Tasnim, et al.
Pubblicazione: (2024)
di: Ahmed, Tasnim, et al.
Pubblicazione: (2024)
Unveiling Linguistic Regions in Large Language Models
di: Zhang, Zhihao, et al.
Pubblicazione: (2024)
di: Zhang, Zhihao, et al.
Pubblicazione: (2024)
Benchmarking Linguistic Diversity of Large Language Models
di: Guo, Yanzhu, et al.
Pubblicazione: (2024)
di: Guo, Yanzhu, et al.
Pubblicazione: (2024)
Probing Neural Topology of Large Language Models
di: Zheng, Yu, et al.
Pubblicazione: (2025)
di: Zheng, Yu, et al.
Pubblicazione: (2025)
Can Large Language Models Identify Authorship?
di: Huang, Baixiang, et al.
Pubblicazione: (2024)
di: Huang, Baixiang, et al.
Pubblicazione: (2024)
IdealGPT: Iteratively Decomposing Vision and Language Reasoning via Large Language Models
di: You, Haoxuan, et al.
Pubblicazione: (2023)
di: You, Haoxuan, et al.
Pubblicazione: (2023)
Thought Propagation: An Analogical Approach to Complex Reasoning with Large Language Models
di: Yu, Junchi, et al.
Pubblicazione: (2023)
di: Yu, Junchi, et al.
Pubblicazione: (2023)
Parrot Mind: Towards Explaining the Complex Task Reasoning of Pretrained Large Language Models with Template-Content Structure
di: Yang, Haotong, et al.
Pubblicazione: (2023)
di: Yang, Haotong, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Reasoning Over the Glyphs: Evaluation of LLM's Decipherment of Rare Scripts
di: Shih, Yu-Fei, et al.
Pubblicazione: (2025) -
AutoLogi: Automated Generation of Logic Puzzles for Evaluating Reasoning Abilities of Large Language Models
di: Zhu, Qin, et al.
Pubblicazione: (2025) -
TangramPuzzle: Evaluating Multimodal Large Language Models with Compositional Spatial Reasoning
di: Liu, Daixian, et al.
Pubblicazione: (2026) -
LingBench++: A Linguistically-Informed Benchmark and Reasoning Framework for Multi-Step and Cross-Cultural Inference with LLMs
di: Lian, Da-Chen, et al.
Pubblicazione: (2025) -
LINGOLY: A Benchmark of Olympiad-Level Linguistic Reasoning Puzzles in Low-Resource and Extinct Languages
di: Bean, Andrew M., et al.
Pubblicazione: (2024)