Counting Ability of Large Language Models and Impact of Tokenization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Xiang, Cao, Juntai, You, Chenyu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Tokenization Constraints in LLMs: A Study of Symbolic and Arithmetic Reasoning Limits
par: Zhang, Xiang, et autres
Publié: (2025)
par: Zhang, Xiang, et autres
Publié: (2025)
Every Token Counts: Generalizing 16M Ultra-Long Context in Large Language Models
par: Hu, Xiang, et autres
Publié: (2025)
par: Hu, Xiang, et autres
Publié: (2025)
On the Decision-Making Abilities in Role-Playing using Large Language Models
par: Shen, Chenglei, et autres
Publié: (2024)
par: Shen, Chenglei, et autres
Publié: (2024)
PersonaLLM: Investigating the Ability of Large Language Models to Express Personality Traits
par: Jiang, Hang, et autres
Publié: (2023)
par: Jiang, Hang, et autres
Publié: (2023)
Reflection Pretraining Enables Token-Level Self-Correction in Biological Sequence Models
par: Zhang, Xiang, et autres
Publié: (2025)
par: Zhang, Xiang, et autres
Publié: (2025)
Editing Factual Knowledge and Explanatory Ability of Medical Large Language Models
par: Xu, Derong, et autres
Publié: (2024)
par: Xu, Derong, et autres
Publié: (2024)
Eliciting Causal Abilities in Large Language Models for Reasoning Tasks
par: Wang, Yajing, et autres
Publié: (2024)
par: Wang, Yajing, et autres
Publié: (2024)
Large Language Models have Intrinsic Self-Correction Ability
par: Liu, Dancheng, et autres
Publié: (2024)
par: Liu, Dancheng, et autres
Publié: (2024)
Investigating Large Language Models' Linguistic Abilities for Text Preprocessing
par: Braga, Marco, et autres
Publié: (2025)
par: Braga, Marco, et autres
Publié: (2025)
A Closer Look at the Self-Verification Abilities of Large Language Models in Logical Reasoning
par: Hong, Ruixin, et autres
Publié: (2023)
par: Hong, Ruixin, et autres
Publié: (2023)
One Token Is Enough: Improving Diffusion Language Models with a Sink Token
par: Zhang, Zihou, et autres
Publié: (2026)
par: Zhang, Zihou, et autres
Publié: (2026)
Emergent Abilities of Large Language Models under Continued Pretraining for Language Adaptation
par: Elhady, Ahmed, et autres
Publié: (2025)
par: Elhady, Ahmed, et autres
Publié: (2025)
Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization
par: Wang, Dixuan, et autres
Publié: (2024)
par: Wang, Dixuan, et autres
Publié: (2024)
Same Task, More Tokens: the Impact of Input Length on the Reasoning Performance of Large Language Models
par: Levy, Mosh, et autres
Publié: (2024)
par: Levy, Mosh, et autres
Publié: (2024)
A Survey on Enhancing Causal Reasoning Ability of Large Language Models
par: Li, Xin, et autres
Publié: (2025)
par: Li, Xin, et autres
Publié: (2025)
Towards Reasoning Ability of Small Language Models
par: Srivastava, Gaurav, et autres
Publié: (2025)
par: Srivastava, Gaurav, et autres
Publié: (2025)
Exploring the Reasoning Abilities of Multimodal Large Language Models (MLLMs): A Comprehensive Survey on Emerging Trends in Multimodal Reasoning
par: Wang, Yiqi, et autres
Publié: (2024)
par: Wang, Yiqi, et autres
Publié: (2024)
RoleLLM: Benchmarking, Eliciting, and Enhancing Role-Playing Abilities of Large Language Models
par: Wang, Zekun Moore, et autres
Publié: (2023)
par: Wang, Zekun Moore, et autres
Publié: (2023)
Deception Abilities Emerged in Large Language Models
par: Hagendorff, Thilo
Publié: (2023)
par: Hagendorff, Thilo
Publié: (2023)
Memory Retrieval and Consolidation in Large Language Models through Function Tokens
par: Zhang, Shaohua, et autres
Publié: (2025)
par: Zhang, Shaohua, et autres
Publié: (2025)
TEAL: Tokenize and Embed ALL for Multi-modal Large Language Models
par: Yang, Zhen, et autres
Publié: (2023)
par: Yang, Zhen, et autres
Publié: (2023)
Code-driven Number Sequence Calculation: Enhancing the inductive Reasoning Abilities of Large Language Models
par: Chen, Kedi, et autres
Publié: (2025)
par: Chen, Kedi, et autres
Publié: (2025)
Toward Graph-Tokenizing Large Language Models with Reconstructive Graph Instruction Tuning
par: Zhang, Zhongjian, et autres
Publié: (2026)
par: Zhang, Zhongjian, et autres
Publié: (2026)
FinDABench: Benchmarking Financial Data Analysis Ability of Large Language Models
par: Liu, Shu, et autres
Publié: (2024)
par: Liu, Shu, et autres
Publié: (2024)
InFoBench: Evaluating Instruction Following Ability in Large Language Models
par: Qin, Yiwei, et autres
Publié: (2024)
par: Qin, Yiwei, et autres
Publié: (2024)
LogicGame: Benchmarking Rule-Based Reasoning Abilities of Large Language Models
par: Gui, Jiayi, et autres
Publié: (2024)
par: Gui, Jiayi, et autres
Publié: (2024)
Ensembling Large Language Models to Characterize Affective Dynamics in Student-AI Tutor Dialogues
par: Zhang, Chenyu, et autres
Publié: (2025)
par: Zhang, Chenyu, et autres
Publié: (2025)
Psychological Counseling Ability of Large Language Models
par: Peng, Fangyu, et autres
Publié: (2025)
par: Peng, Fangyu, et autres
Publié: (2025)
Do We Need Distinct Representations for Every Speech Token? Unveiling and Exploiting Redundancy in Large Speech Language Models
par: Xiang, Bajian, et autres
Publié: (2026)
par: Xiang, Bajian, et autres
Publié: (2026)
Exposing Numeracy Gaps: A Benchmark to Evaluate Fundamental Numerical Abilities in Large Language Models
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
IDEA: Enhancing the Rule Learning Ability of Large Language Model Agent through Induction, Deduction, and Abduction
par: He, Kaiyu, et autres
Publié: (2024)
par: He, Kaiyu, et autres
Publié: (2024)
Reasoning Can Hurt the Inductive Abilities of Large Language Models
par: Jin, Haibo, et autres
Publié: (2025)
par: Jin, Haibo, et autres
Publié: (2025)
Self-Evolving Critique Abilities in Large Language Models
par: Tang, Zhengyang, et autres
Publié: (2025)
par: Tang, Zhengyang, et autres
Publié: (2025)
Emergent Abilities in Large Language Models: A Survey
par: Berti, Leonardo, et autres
Publié: (2025)
par: Berti, Leonardo, et autres
Publié: (2025)
When Every Token Counts: Optimal Segmentation for Low-Resource Language Models
par: Raj, Bharath, et autres
Publié: (2024)
par: Raj, Bharath, et autres
Publié: (2024)
Full-ECE: A Metric For Token-level Calibration on Large Language Models
par: Liu, Han, et autres
Publié: (2024)
par: Liu, Han, et autres
Publié: (2024)
Orca: Enhancing Role-Playing Abilities of Large Language Models by Integrating Personality Traits
par: Huang, Yuxuan
Publié: (2024)
par: Huang, Yuxuan
Publié: (2024)
Embedding Self-Correction as an Inherent Ability in Large Language Models for Enhanced Mathematical Reasoning
par: Gao, Kuofeng, et autres
Publié: (2024)
par: Gao, Kuofeng, et autres
Publié: (2024)
LogicBench: Towards Systematic Evaluation of Logical Reasoning Ability of Large Language Models
par: Parmar, Mihir, et autres
Publié: (2024)
par: Parmar, Mihir, et autres
Publié: (2024)
U-shaped and Inverted-U Scaling behind Emergent Abilities of Large Language Models
par: Wu, Tung-Yu, et autres
Publié: (2024)
par: Wu, Tung-Yu, et autres
Publié: (2024)
Documents similaires
-
Tokenization Constraints in LLMs: A Study of Symbolic and Arithmetic Reasoning Limits
par: Zhang, Xiang, et autres
Publié: (2025) -
Every Token Counts: Generalizing 16M Ultra-Long Context in Large Language Models
par: Hu, Xiang, et autres
Publié: (2025) -
On the Decision-Making Abilities in Role-Playing using Large Language Models
par: Shen, Chenglei, et autres
Publié: (2024) -
PersonaLLM: Investigating the Ability of Large Language Models to Express Personality Traits
par: Jiang, Hang, et autres
Publié: (2023) -
Reflection Pretraining Enables Token-Level Self-Correction in Biological Sequence Models
par: Zhang, Xiang, et autres
Publié: (2025)