Thinking Tokens for Language Modeling
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Herel, David, Mikolov, Tomas |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Collapse of Self-trained Language Models
von: Herel, David, et al.
Veröffentlicht: (2024)
von: Herel, David, et al.
Veröffentlicht: (2024)
Time Awareness in Large Language Models: Benchmarking Fact Recall Across Time
von: Herel, David, et al.
Veröffentlicht: (2024)
von: Herel, David, et al.
Veröffentlicht: (2024)
Large Language Models: A Survey
von: Minaee, Shervin, et al.
Veröffentlicht: (2024)
von: Minaee, Shervin, et al.
Veröffentlicht: (2024)
Think before you speak: Training Language Models With Pause Tokens
von: Goyal, Sachin, et al.
Veröffentlicht: (2023)
von: Goyal, Sachin, et al.
Veröffentlicht: (2023)
Rethinking Thinking Tokens: Understanding Why They Underperform in Practice
von: Vennam, Sreeram, et al.
Veröffentlicht: (2024)
von: Vennam, Sreeram, et al.
Veröffentlicht: (2024)
Do Thinking Tokens Help or Trap? Towards More Efficient Large Reasoning Model
von: Ding, Bowen, et al.
Veröffentlicht: (2025)
von: Ding, Bowen, et al.
Veröffentlicht: (2025)
Thinking About Thinking: Evaluating Reasoning in Post-Trained Language Models
von: Singla, Pratham, et al.
Veröffentlicht: (2025)
von: Singla, Pratham, et al.
Veröffentlicht: (2025)
Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization
von: Wang, Dixuan, et al.
Veröffentlicht: (2024)
von: Wang, Dixuan, et al.
Veröffentlicht: (2024)
Accelerating Multilingual Language Model for Excessively Tokenized Languages
von: Hong, Jimin, et al.
Veröffentlicht: (2024)
von: Hong, Jimin, et al.
Veröffentlicht: (2024)
SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling
von: Liu, Dong, et al.
Veröffentlicht: (2025)
von: Liu, Dong, et al.
Veröffentlicht: (2025)
One Token Is Enough: Improving Diffusion Language Models with a Sink Token
von: Zhang, Zihou, et al.
Veröffentlicht: (2026)
von: Zhang, Zihou, et al.
Veröffentlicht: (2026)
From Language Models over Tokens to Language Models over Characters
von: Vieira, Tim, et al.
Veröffentlicht: (2024)
von: Vieira, Tim, et al.
Veröffentlicht: (2024)
Cognitive Decision Routing in Large Language Models: When to Think Fast, When to Think Slow
von: Du, Y., et al.
Veröffentlicht: (2025)
von: Du, Y., et al.
Veröffentlicht: (2025)
Dynamic Thinking-Token Selection for Efficient Reasoning in Large Reasoning Models
von: Guo, Zhenyuan, et al.
Veröffentlicht: (2026)
von: Guo, Zhenyuan, et al.
Veröffentlicht: (2026)
InvThink: Premortem Reasoning for Safer Language Models
von: Kim, Yubin, et al.
Veröffentlicht: (2025)
von: Kim, Yubin, et al.
Veröffentlicht: (2025)
Demystifying Reasoning Dynamics with Mutual Information: Thinking Tokens are Information Peaks in LLM Reasoning
von: Qian, Chen, et al.
Veröffentlicht: (2025)
von: Qian, Chen, et al.
Veröffentlicht: (2025)
Targeted Remasking: Replacing Token Editing with Token-to-Mask Refinement in Discrete Diffusion Language Models
von: Yao, Lin
Veröffentlicht: (2026)
von: Yao, Lin
Veröffentlicht: (2026)
Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models
von: Cho, Gyeongje, et al.
Veröffentlicht: (2025)
von: Cho, Gyeongje, et al.
Veröffentlicht: (2025)
Token Signature: Predicting Chain-of-Thought Gains with Token Decoding Feature in Large Language Models
von: Liu, Peijie, et al.
Veröffentlicht: (2025)
von: Liu, Peijie, et al.
Veröffentlicht: (2025)
Dual Debiasing: Remove Stereotypes and Keep Factual Gender for Fair Language Modeling and Translation
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2025)
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2025)
Counting Ability of Large Language Models and Impact of Tokenization
von: Zhang, Xiang, et al.
Veröffentlicht: (2024)
von: Zhang, Xiang, et al.
Veröffentlicht: (2024)
Missed Connections: Lateral Thinking Puzzles for Large Language Models
von: Todd, Graham, et al.
Veröffentlicht: (2024)
von: Todd, Graham, et al.
Veröffentlicht: (2024)
The Cost of Thinking: Increased Jailbreak Risk in Large Language Models
von: Yang, Fan
Veröffentlicht: (2025)
von: Yang, Fan
Veröffentlicht: (2025)
Multi-Persona Thinking for Bias Mitigation in Large Language Models
von: Chen, Yuxing, et al.
Veröffentlicht: (2026)
von: Chen, Yuxing, et al.
Veröffentlicht: (2026)
Chronological Thinking in Full-Duplex Spoken Dialogue Language Models
von: Wu, Donghang, et al.
Veröffentlicht: (2025)
von: Wu, Donghang, et al.
Veröffentlicht: (2025)
THiNK: Can Large Language Models Think-aloud?
von: Yu, Yongan, et al.
Veröffentlicht: (2025)
von: Yu, Yongan, et al.
Veröffentlicht: (2025)
Think$^{2}$: Grounded Metacognitive Reasoning in Large Language Models
von: Elenjical, Abraham Paul, et al.
Veröffentlicht: (2026)
von: Elenjical, Abraham Paul, et al.
Veröffentlicht: (2026)
Adapting Language Models via Token Translation
von: Feng, Zhili, et al.
Veröffentlicht: (2024)
von: Feng, Zhili, et al.
Veröffentlicht: (2024)
AdapThink: Adaptive Thinking Preferences for Reasoning Language Model
von: Wan, Xu, et al.
Veröffentlicht: (2025)
von: Wan, Xu, et al.
Veröffentlicht: (2025)
Beyond English-Centric LLMs: What Language Do Multilingual Language Models Think in?
von: Zhong, Chengzhi, et al.
Veröffentlicht: (2024)
von: Zhong, Chengzhi, et al.
Veröffentlicht: (2024)
Evaluating Tokenizer Performance of Large Language Models Across Official Indian Languages
von: Tamang, S., et al.
Veröffentlicht: (2024)
von: Tamang, S., et al.
Veröffentlicht: (2024)
Enhancing Creativity in Large Language Models through Associative Thinking Strategies
von: Mehrotra, Pronita, et al.
Veröffentlicht: (2024)
von: Mehrotra, Pronita, et al.
Veröffentlicht: (2024)
Fast-Slow-Thinking: Complex Task Solving with Large Language Models
von: Sun, Yiliu, et al.
Veröffentlicht: (2025)
von: Sun, Yiliu, et al.
Veröffentlicht: (2025)
Think in Sentences: Explicit Sentence Boundaries Enhance Language Model's Capabilities
von: Liu, Zhichen, et al.
Veröffentlicht: (2026)
von: Liu, Zhichen, et al.
Veröffentlicht: (2026)
Incentivizing Dual Process Thinking for Efficient Large Language Model Reasoning
von: Cheng, Xiaoxue, et al.
Veröffentlicht: (2025)
von: Cheng, Xiaoxue, et al.
Veröffentlicht: (2025)
On the Fallacy of Global Token Perplexity in Spoken Language Model Evaluation
von: Hsu, Chan-Jan, et al.
Veröffentlicht: (2026)
von: Hsu, Chan-Jan, et al.
Veröffentlicht: (2026)
Pre-Training Curriculum for Multi-Token Prediction in Language Models
von: Aynetdinov, Ansar, et al.
Veröffentlicht: (2025)
von: Aynetdinov, Ansar, et al.
Veröffentlicht: (2025)
Contextual Reinforcement in Multimodal Token Compression for Large Language Models
von: Piero, Naderdel, et al.
Veröffentlicht: (2025)
von: Piero, Naderdel, et al.
Veröffentlicht: (2025)
From Tokens to Lattices: Emergent Lattice Structures in Language Models
von: Xiong, Bo, et al.
Veröffentlicht: (2025)
von: Xiong, Bo, et al.
Veröffentlicht: (2025)
Saliency-driven Dynamic Token Pruning for Large Language Models
von: Tao, Yao, et al.
Veröffentlicht: (2025)
von: Tao, Yao, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Collapse of Self-trained Language Models
von: Herel, David, et al.
Veröffentlicht: (2024) -
Time Awareness in Large Language Models: Benchmarking Fact Recall Across Time
von: Herel, David, et al.
Veröffentlicht: (2024) -
Large Language Models: A Survey
von: Minaee, Shervin, et al.
Veröffentlicht: (2024) -
Think before you speak: Training Language Models With Pause Tokens
von: Goyal, Sachin, et al.
Veröffentlicht: (2023) -
Rethinking Thinking Tokens: Understanding Why They Underperform in Practice
von: Vennam, Sreeram, et al.
Veröffentlicht: (2024)