Disentangling Reasoning Tokens and Boilerplate Tokens For Language Model Fine-tuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Ye, Ziang, Zhang, Zhenru, Zhang, Yang, Ma, Jianxin, Lin, Junyang, Feng, Fuli |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Preference-grounded Token-level Guidance for Language Model Fine-tuning
di: Yang, Shentao, et al.
Pubblicazione: (2023)
di: Yang, Shentao, et al.
Pubblicazione: (2023)
IGD: Token Decisiveness Modeling via Information Gain in LLMs for Personalized Recommendation
di: Lin, Zijie, et al.
Pubblicazione: (2025)
di: Lin, Zijie, et al.
Pubblicazione: (2025)
Token-level Data Selection for Safe LLM Fine-tuning
di: Li, Yanping, et al.
Pubblicazione: (2026)
di: Li, Yanping, et al.
Pubblicazione: (2026)
Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning
di: Wang, Shenzhi, et al.
Pubblicazione: (2025)
di: Wang, Shenzhi, et al.
Pubblicazione: (2025)
Problematic Tokens: Tokenizer Bias in Large Language Models
di: Yang, Jin, et al.
Pubblicazione: (2024)
di: Yang, Jin, et al.
Pubblicazione: (2024)
Explainable Token-level Noise Filtering for LLM Fine-tuning Datasets
di: Yang, Yuchen, et al.
Pubblicazione: (2026)
di: Yang, Yuchen, et al.
Pubblicazione: (2026)
Enhancing Large Language Model Reasoning via Selective Critical Token Fine-Tuning
di: Ruan, Zhiwen, et al.
Pubblicazione: (2025)
di: Ruan, Zhiwen, et al.
Pubblicazione: (2025)
LeMo: Enabling LEss Token Involvement for MOre Context Fine-tuning
di: Wang, Tuowei, et al.
Pubblicazione: (2025)
di: Wang, Tuowei, et al.
Pubblicazione: (2025)
The Lessons of Developing Process Reward Models in Mathematical Reasoning
di: Zhang, Zhenru, et al.
Pubblicazione: (2025)
di: Zhang, Zhenru, et al.
Pubblicazione: (2025)
ByteScience: Bridging Unstructured Scientific Literature and Structured Data with Auto Fine-tuned Large Language Model in Token Granularity
di: Xie, Tong, et al.
Pubblicazione: (2024)
di: Xie, Tong, et al.
Pubblicazione: (2024)
Large Language Model as Token Compressor and Decompressor
di: Li, Wenbing, et al.
Pubblicazione: (2026)
di: Li, Wenbing, et al.
Pubblicazione: (2026)
START: Self-taught Reasoner with Tools
di: Li, Chengpeng, et al.
Pubblicazione: (2025)
di: Li, Chengpeng, et al.
Pubblicazione: (2025)
Rethinking Tokenization: Crafting Better Tokenizers for Large Language Models
di: Yang, Jinbiao
Pubblicazione: (2024)
di: Yang, Jinbiao
Pubblicazione: (2024)
FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing
di: Li, Zekai, et al.
Pubblicazione: (2024)
di: Li, Zekai, et al.
Pubblicazione: (2024)
Few Tokens, Big Leverage: Preserving Safety Alignment by Constraining Safety Tokens during Fine-tuning
di: Wang, Guoli, et al.
Pubblicazione: (2026)
di: Wang, Guoli, et al.
Pubblicazione: (2026)
Can Perplexity Predict Fine-tuning Performance? An Investigation of Tokenization Effects on Sequential Language Models for Nepali
di: Luitel, Nishant, et al.
Pubblicazione: (2024)
di: Luitel, Nishant, et al.
Pubblicazione: (2024)
Beyond Token-Level Policy Gradients for Complex Reasoning with Large Language Models
di: Xu, Mufan, et al.
Pubblicazione: (2026)
di: Xu, Mufan, et al.
Pubblicazione: (2026)
LiteToken: Removing Intermediate Merge Residues From BPE Tokenizers
di: Sun, Yike, et al.
Pubblicazione: (2026)
di: Sun, Yike, et al.
Pubblicazione: (2026)
Winning the Pruning Gamble: A Unified Approach to Joint Sample and Token Pruning for Efficient Supervised Fine-Tuning
di: Wang, Shaobo, et al.
Pubblicazione: (2025)
di: Wang, Shaobo, et al.
Pubblicazione: (2025)
Guiding Language Model Reasoning with Planning Tokens
di: Wang, Xinyi, et al.
Pubblicazione: (2023)
di: Wang, Xinyi, et al.
Pubblicazione: (2023)
Kanade: A Simple Disentangled Tokenizer for Spoken Language Modeling
di: Huang, Zhijie, et al.
Pubblicazione: (2026)
di: Huang, Zhijie, et al.
Pubblicazione: (2026)
Reasoning Bias of Next Token Prediction Training
di: Lin, Pengxiao, et al.
Pubblicazione: (2025)
di: Lin, Pengxiao, et al.
Pubblicazione: (2025)
ProcessBench: Identifying Process Errors in Mathematical Reasoning
di: Zheng, Chujie, et al.
Pubblicazione: (2024)
di: Zheng, Chujie, et al.
Pubblicazione: (2024)
Rethinking Personalization in Large Language Models at the Token Level
di: Zhang, Chenheng, et al.
Pubblicazione: (2026)
di: Zhang, Chenheng, et al.
Pubblicazione: (2026)
SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models
di: Zhang, Xin, et al.
Pubblicazione: (2023)
di: Zhang, Xin, et al.
Pubblicazione: (2023)
Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning
di: Su, DiJia, et al.
Pubblicazione: (2025)
di: Su, DiJia, et al.
Pubblicazione: (2025)
Analyzing the Effects of Supervised Fine-Tuning on Model Knowledge from Token and Parameter Levels
di: Ye, Junjie, et al.
Pubblicazione: (2025)
di: Ye, Junjie, et al.
Pubblicazione: (2025)
Mitigating Gradient Inversion Risks in Language Models via Token Obfuscation
di: Feng, Xinguo, et al.
Pubblicazione: (2026)
di: Feng, Xinguo, et al.
Pubblicazione: (2026)
Targeted Remasking: Replacing Token Editing with Token-to-Mask Refinement in Discrete Diffusion Language Models
di: Yao, Lin
Pubblicazione: (2026)
di: Yao, Lin
Pubblicazione: (2026)
VisualTrap: A Stealthy Backdoor Attack on GUI Agents via Visual Grounding Manipulation
di: Ye, Ziang, et al.
Pubblicazione: (2025)
di: Ye, Ziang, et al.
Pubblicazione: (2025)
Not All Tokens Matter: Towards Efficient LLM Reasoning via Token Significance in Reinforcement Learning
di: Liu, Hanbing, et al.
Pubblicazione: (2025)
di: Liu, Hanbing, et al.
Pubblicazione: (2025)
One Token Is Enough: Improving Diffusion Language Models with a Sink Token
di: Zhang, Zihou, et al.
Pubblicazione: (2026)
di: Zhang, Zihou, et al.
Pubblicazione: (2026)
Memory Retrieval and Consolidation in Large Language Models through Function Tokens
di: Zhang, Shaohua, et al.
Pubblicazione: (2025)
di: Zhang, Shaohua, et al.
Pubblicazione: (2025)
HellaSwag-Pro: A Large-Scale Bilingual Benchmark for Evaluating the Robustness of LLMs in Commonsense Reasoning
di: Li, Xiaoyuan, et al.
Pubblicazione: (2025)
di: Li, Xiaoyuan, et al.
Pubblicazione: (2025)
Persona-judge: Personalized Alignment of Large Language Models via Token-level Self-judgment
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
di: Zhang, Xiaotian, et al.
Pubblicazione: (2025)
Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization
di: Wang, Dixuan, et al.
Pubblicazione: (2024)
di: Wang, Dixuan, et al.
Pubblicazione: (2024)
Factorized RVQ-GAN For Disentangled Speech Tokenization
di: Khurana, Sameer, et al.
Pubblicazione: (2025)
di: Khurana, Sameer, et al.
Pubblicazione: (2025)
TokenSeek: Memory Efficient Fine Tuning via Instance-Aware Token Ditching
di: Zeng, Runjia, et al.
Pubblicazione: (2026)
di: Zeng, Runjia, et al.
Pubblicazione: (2026)
Unveiling Language-Specific Features in Large Language Models via Sparse Autoencoders
di: Deng, Boyi, et al.
Pubblicazione: (2025)
di: Deng, Boyi, et al.
Pubblicazione: (2025)
ExLM: Rethinking the Impact of [MASK] Tokens in Masked Language Models
di: Zheng, Kangjie, et al.
Pubblicazione: (2025)
di: Zheng, Kangjie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Preference-grounded Token-level Guidance for Language Model Fine-tuning
di: Yang, Shentao, et al.
Pubblicazione: (2023) -
IGD: Token Decisiveness Modeling via Information Gain in LLMs for Personalized Recommendation
di: Lin, Zijie, et al.
Pubblicazione: (2025) -
Token-level Data Selection for Safe LLM Fine-tuning
di: Li, Yanping, et al.
Pubblicazione: (2026) -
Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning
di: Wang, Shenzhi, et al.
Pubblicazione: (2025) -
Problematic Tokens: Tokenizer Bias in Large Language Models
di: Yang, Jin, et al.
Pubblicazione: (2024)