Salvato in:
| Autori principali: | Yang, Changbing, Ma, Franklin, Shi, Freda, Zhu, Jian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2511.00343 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
How Tokenization Limits Phonological Knowledge Representation in Language Models and How to Improve Them
di: Liao, Disen, et al.
Pubblicazione: (2026)
di: Liao, Disen, et al.
Pubblicazione: (2026)
LingBench++: A Linguistically-Informed Benchmark and Reasoning Framework for Multi-Step and Cross-Cultural Inference with LLMs
di: Lian, Da-Chen, et al.
Pubblicazione: (2025)
di: Lian, Da-Chen, et al.
Pubblicazione: (2025)
Learning Beyond Limits: Multitask Learning and Synthetic Data for Low-Resource Canonical Morpheme Segmentation
di: Yang, Changbing, et al.
Pubblicazione: (2025)
di: Yang, Changbing, et al.
Pubblicazione: (2025)
Learning Language Structures through Grounding
di: Shi, Freda
Pubblicazione: (2024)
di: Shi, Freda
Pubblicazione: (2024)
The taste of IPA: Towards open-vocabulary keyword spotting and forced alignment in any language
di: Zhu, Jian, et al.
Pubblicazione: (2023)
di: Zhu, Jian, et al.
Pubblicazione: (2023)
Distribution Prompting: Understanding the Expressivity of Language Models Through the Next-Token Distributions They Can Produce
di: Wang, Haojin, et al.
Pubblicazione: (2025)
di: Wang, Haojin, et al.
Pubblicazione: (2025)
LingML: Linguistic-Informed Machine Learning for Enhanced Fake News Detection
di: Singh, Jasraj, et al.
Pubblicazione: (2024)
di: Singh, Jasraj, et al.
Pubblicazione: (2024)
modeLing: A Novel Dataset for Testing Linguistic Reasoning in Language Models
di: Chi, Nathan A., et al.
Pubblicazione: (2024)
di: Chi, Nathan A., et al.
Pubblicazione: (2024)
GEM: A Gym for Agentic LLMs
di: Liu, Zichen, et al.
Pubblicazione: (2025)
di: Liu, Zichen, et al.
Pubblicazione: (2025)
LingVarBench: Benchmarking LLMs on Entity Recognitions and Linguistic Verbalization Patterns in Phone-Call Transcripts
di: Mohammadi, Seyedali, et al.
Pubblicazione: (2025)
di: Mohammadi, Seyedali, et al.
Pubblicazione: (2025)
Logical forms complement probability in understanding language model (and human) performance
di: Wang, Yixuan, et al.
Pubblicazione: (2025)
di: Wang, Yixuan, et al.
Pubblicazione: (2025)
LingGen: Scalable Multi-Attribute Linguistic Control via Power-Law Masking
di: Elgaar, Mohamed, et al.
Pubblicazione: (2024)
di: Elgaar, Mohamed, et al.
Pubblicazione: (2024)
Multiple Sources are Better Than One: Incorporating External Knowledge in Low-Resource Glossing
di: Yang, Changbing, et al.
Pubblicazione: (2024)
di: Yang, Changbing, et al.
Pubblicazione: (2024)
Embedded Translations for Low-resource Automated Glossing
di: Yang, Changbing, et al.
Pubblicazione: (2024)
di: Yang, Changbing, et al.
Pubblicazione: (2024)
LLMs for Relational Reasoning: How Far are We?
di: Li, Zhiming, et al.
Pubblicazione: (2024)
di: Li, Zhiming, et al.
Pubblicazione: (2024)
How Far Can LLMs Improve from Experience? Measuring Test-Time Learning Ability in LLMs with Human Comparison
di: Wang, Jiayin, et al.
Pubblicazione: (2025)
di: Wang, Jiayin, et al.
Pubblicazione: (2025)
Model Editing for LLMs4Code: How Far are We?
di: Li, Xiaopeng, et al.
Pubblicazione: (2024)
di: Li, Xiaopeng, et al.
Pubblicazione: (2024)
Large Language Models for Predictive Analysis: How Far Are They?
di: Chen, Qin, et al.
Pubblicazione: (2025)
di: Chen, Qin, et al.
Pubblicazione: (2025)
Blessing of Multilinguality: A Systematic Analysis of Multilingual In-Context Learning
di: Tu, Yilei, et al.
Pubblicazione: (2025)
di: Tu, Yilei, et al.
Pubblicazione: (2025)
How LLMs Might Think
di: Gottlieb, Joseph, et al.
Pubblicazione: (2026)
di: Gottlieb, Joseph, et al.
Pubblicazione: (2026)
Do Vision-Language Models Represent Space and How? Evaluating Spatial Frame of Reference Under Ambiguities
di: Zhang, Zheyuan, et al.
Pubblicazione: (2024)
di: Zhang, Zheyuan, et al.
Pubblicazione: (2024)
How Far Are We From AGI: Are LLMs All We Need?
di: Feng, Tao, et al.
Pubblicazione: (2024)
di: Feng, Tao, et al.
Pubblicazione: (2024)
How Far Are We? Systematic Evaluation of LLMs vs. Human Experts in Mathematical Contest in Modeling
di: Liu, Yuhang, et al.
Pubblicazione: (2026)
di: Liu, Yuhang, et al.
Pubblicazione: (2026)
How Far Are LLMs from Believable AI? A Benchmark for Evaluating the Believability of Human Behavior Simulation
di: Xiao, Yang, et al.
Pubblicazione: (2023)
di: Xiao, Yang, et al.
Pubblicazione: (2023)
Structured Tree Alignment for Evaluation of (Speech) Constituency Parsing
di: Shi, Freda, et al.
Pubblicazione: (2024)
di: Shi, Freda, et al.
Pubblicazione: (2024)
PersonaGym: Evaluating Persona Agents and LLMs
di: Samuel, Vinay, et al.
Pubblicazione: (2024)
di: Samuel, Vinay, et al.
Pubblicazione: (2024)
Real Images, Worse Judgments: Evaluating Vision-Language Models on Concreteness and Imagery
di: Jiang, Yifan, et al.
Pubblicazione: (2026)
di: Jiang, Yifan, et al.
Pubblicazione: (2026)
Developing multilingual speech synthesis system for Ojibwe, Mi'kmaq, and Maliseet
di: Wang, Shenran, et al.
Pubblicazione: (2025)
di: Wang, Shenran, et al.
Pubblicazione: (2025)
Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs
di: Chen, Xingyu, et al.
Pubblicazione: (2024)
di: Chen, Xingyu, et al.
Pubblicazione: (2024)
AraLingBench A Human-Annotated Benchmark for Evaluating Arabic Linguistic Capabilities of Large Language Models
di: Zbeeb, Mohammad, et al.
Pubblicazione: (2025)
di: Zbeeb, Mohammad, et al.
Pubblicazione: (2025)
From Seeing to Thinking: Decoupling Perception and Reasoning Improves Post-Training of Vision-Language Models
di: Wu, Juncheng, et al.
Pubblicazione: (2026)
di: Wu, Juncheng, et al.
Pubblicazione: (2026)
Why LLMs Cannot Think and How to Fix It
di: Jahrens, Marius, et al.
Pubblicazione: (2025)
di: Jahrens, Marius, et al.
Pubblicazione: (2025)
PixelWorld: How Far Are We from Perceiving Everything as Pixels?
di: Lyu, Zhiheng, et al.
Pubblicazione: (2025)
di: Lyu, Zhiheng, et al.
Pubblicazione: (2025)
EcoGym: Evaluating LLMs for Long-Horizon Plan-and-Execute in Interactive Economies
di: Hu, Xavier, et al.
Pubblicazione: (2026)
di: Hu, Xavier, et al.
Pubblicazione: (2026)
Rewarding How Models Think Pedagogically: Integrating Pedagogical Reasoning and Thinking Rewards for LLMs in Education
di: Lee, Unggi, et al.
Pubblicazione: (2026)
di: Lee, Unggi, et al.
Pubblicazione: (2026)
Thinking to Recall: How Reasoning Unlocks Parametric Knowledge in LLMs
di: Gekhman, Zorik, et al.
Pubblicazione: (2026)
di: Gekhman, Zorik, et al.
Pubblicazione: (2026)
How Far Are We from Genuinely Useful Deep Research Agents?
di: Zhang, Dingling, et al.
Pubblicazione: (2025)
di: Zhang, Dingling, et al.
Pubblicazione: (2025)
How Far Are We on the Decision-Making of LLMs? Evaluating LLMs' Gaming Ability in Multi-Agent Environments
di: Huang, Jen-tse, et al.
Pubblicazione: (2024)
di: Huang, Jen-tse, et al.
Pubblicazione: (2024)
MotiveBench: How Far Are We From Human-Like Motivational Reasoning in Large Language Models?
di: Yong, Xixian, et al.
Pubblicazione: (2025)
di: Yong, Xixian, et al.
Pubblicazione: (2025)
BatonVoice: An Operationalist Framework for Enhancing Controllable Speech Synthesis with Linguistic Intelligence from LLMs
di: Wang, Yue, et al.
Pubblicazione: (2025)
di: Wang, Yue, et al.
Pubblicazione: (2025)
Documenti analoghi
-
How Tokenization Limits Phonological Knowledge Representation in Language Models and How to Improve Them
di: Liao, Disen, et al.
Pubblicazione: (2026) -
LingBench++: A Linguistically-Informed Benchmark and Reasoning Framework for Multi-Step and Cross-Cultural Inference with LLMs
di: Lian, Da-Chen, et al.
Pubblicazione: (2025) -
Learning Beyond Limits: Multitask Learning and Synthetic Data for Low-Resource Canonical Morpheme Segmentation
di: Yang, Changbing, et al.
Pubblicazione: (2025) -
Learning Language Structures through Grounding
di: Shi, Freda
Pubblicazione: (2024) -
The taste of IPA: Towards open-vocabulary keyword spotting and forced alignment in any language
di: Zhu, Jian, et al.
Pubblicazione: (2023)