Batching BPE Tokenization Merges
Fuente:
arXiv
Salvato in:
| Autore principale: | Morgan, Alexander P. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Rethinking Tokenization for Rich Morphology: The Dominance of Unigram over BPE and Morphological Alignment
di: Vemula, Saketh Reddy, et al.
Pubblicazione: (2025)
di: Vemula, Saketh Reddy, et al.
Pubblicazione: (2025)
GPUTOK: GPU Accelerated Byte Level BPE Tokenization
di: Kadamba, Venu Gopal, et al.
Pubblicazione: (2026)
di: Kadamba, Venu Gopal, et al.
Pubblicazione: (2026)
MorphBPE: A Morpho-Aware Tokenizer Bridging Linguistic Complexity for Efficient LLM Training Across Morphologies
di: Asgari, Ehsaneddin, et al.
Pubblicazione: (2025)
di: Asgari, Ehsaneddin, et al.
Pubblicazione: (2025)
LiteToken: Removing Intermediate Merge Residues From BPE Tokenizers
di: Sun, Yike, et al.
Pubblicazione: (2026)
di: Sun, Yike, et al.
Pubblicazione: (2026)
TETRIS: Optimal Draft Token Selection for Batch Speculative Decoding
di: Wu, Zhaoxuan, et al.
Pubblicazione: (2025)
di: Wu, Zhaoxuan, et al.
Pubblicazione: (2025)
Towards Nepali-language LLMs: Efficient GPT training with a Nepali BPE tokenizer
di: Shrestha, Adarsha, et al.
Pubblicazione: (2025)
di: Shrestha, Adarsha, et al.
Pubblicazione: (2025)
BlockBPE: Parallel BPE Tokenization
di: You, Amos
Pubblicazione: (2025)
di: You, Amos
Pubblicazione: (2025)
Compressing Sequences in the Latent Embedding Space: $K$-Token Merging for Large Language Models
di: Xu, Zihao, et al.
Pubblicazione: (2026)
di: Xu, Zihao, et al.
Pubblicazione: (2026)
BatchLLM: Optimizing Large Batched LLM Inference with Global Prefix Sharing and Throughput-oriented Token Batching
di: Zheng, Zhen, et al.
Pubblicazione: (2024)
di: Zheng, Zhen, et al.
Pubblicazione: (2024)
Multiplex Thinking: Reasoning via Token-wise Branch-and-Merge
di: Tang, Yao, et al.
Pubblicazione: (2026)
di: Tang, Yao, et al.
Pubblicazione: (2026)
Extrapolation Merging: Keep Improving With Extrapolation and Merging
di: Lin, Yiguan, et al.
Pubblicazione: (2025)
di: Lin, Yiguan, et al.
Pubblicazione: (2025)
Power Scheduler: A Batch Size and Token Number Agnostic Learning Rate Scheduler
di: Shen, Yikang, et al.
Pubblicazione: (2024)
di: Shen, Yikang, et al.
Pubblicazione: (2024)
SuperMerge: An Approach For Gradient-Based Model Merging
di: Yang, Haoyu, et al.
Pubblicazione: (2024)
di: Yang, Haoyu, et al.
Pubblicazione: (2024)
MrT5: Dynamic Token Merging for Efficient Byte-level Language Models
di: Kallini, Julie, et al.
Pubblicazione: (2024)
di: Kallini, Julie, et al.
Pubblicazione: (2024)
Transport and Merge: Cross-Architecture Merging for Large Language Models
di: Cui, Chenhang, et al.
Pubblicazione: (2026)
di: Cui, Chenhang, et al.
Pubblicazione: (2026)
MergeME: Model Merging Techniques for Homogeneous and Heterogeneous MoEs
di: Zhou, Yuhang, et al.
Pubblicazione: (2025)
di: Zhou, Yuhang, et al.
Pubblicazione: (2025)
SE-Merging: A Self-Enhanced Approach for Dynamic Model Merging
di: Chen, Zijun, et al.
Pubblicazione: (2025)
di: Chen, Zijun, et al.
Pubblicazione: (2025)
AIM: Adaptive Inference of Multi-Modal LLMs via Token Merging and Pruning
di: Zhong, Yiwu, et al.
Pubblicazione: (2024)
di: Zhong, Yiwu, et al.
Pubblicazione: (2024)
Sens-Merging: Sensitivity-Guided Parameter Balancing for Merging Large Language Models
di: Liu, Shuqi, et al.
Pubblicazione: (2025)
di: Liu, Shuqi, et al.
Pubblicazione: (2025)
Batch Speculative Decoding Done Right
di: Zhang, Ranran Haoran, et al.
Pubblicazione: (2025)
di: Zhang, Ranran Haoran, et al.
Pubblicazione: (2025)
Pruning via Merging: Compressing LLMs via Manifold Alignment Based Layer Merging
di: Liu, Deyuan, et al.
Pubblicazione: (2024)
di: Liu, Deyuan, et al.
Pubblicazione: (2024)
LLaVA-PruMerge: Adaptive Token Reduction for Efficient Large Multimodal Models
di: Shang, Yuzhang, et al.
Pubblicazione: (2024)
di: Shang, Yuzhang, et al.
Pubblicazione: (2024)
LoRE-Merging: Exploring Low-Rank Estimation For Large Language Model Merging
di: Liu, Zehua, et al.
Pubblicazione: (2025)
di: Liu, Zehua, et al.
Pubblicazione: (2025)
LED-Merging: Mitigating Safety-Utility Conflicts in Model Merging with Location-Election-Disjoint
di: Ma, Qianli, et al.
Pubblicazione: (2025)
di: Ma, Qianli, et al.
Pubblicazione: (2025)
AdaMergeX: Cross-Lingual Transfer with Large Language Models via Adaptive Adapter Merging
di: Zhao, Yiran, et al.
Pubblicazione: (2024)
di: Zhao, Yiran, et al.
Pubblicazione: (2024)
RCP-Merging: Merging Long Chain-of-Thought Models with Domain-Specific Models by Considering Reasoning Capability as Prior
di: Yang, Junyao, et al.
Pubblicazione: (2025)
di: Yang, Junyao, et al.
Pubblicazione: (2025)
Channel Merging: Preserving Specialization for Merged Experts
di: Zhang, Mingyang, et al.
Pubblicazione: (2024)
di: Zhang, Mingyang, et al.
Pubblicazione: (2024)
Reasoning Pattern Alignment Merging for Adaptive Reasoning
di: Zhong, Zhaofeng, et al.
Pubblicazione: (2026)
di: Zhong, Zhaofeng, et al.
Pubblicazione: (2026)
Activation-Informed Merging of Large Language Models
di: Nobari, Amin Heyrani, et al.
Pubblicazione: (2025)
di: Nobari, Amin Heyrani, et al.
Pubblicazione: (2025)
Merge to Mix: Mixing Datasets via Model Merging
di: Tao, Zhixu Silvia, et al.
Pubblicazione: (2025)
di: Tao, Zhixu Silvia, et al.
Pubblicazione: (2025)
The Token Tax: Systematic Bias in Multilingual Tokenization
di: Lundin, Jessica M., et al.
Pubblicazione: (2025)
di: Lundin, Jessica M., et al.
Pubblicazione: (2025)
Constructing a BPE Tokenization DFA
di: Berglund, Martin, et al.
Pubblicazione: (2024)
di: Berglund, Martin, et al.
Pubblicazione: (2024)
Batch Aggregation: An Approach to Enhance Text Classification with Correlated Augmented Data
di: Hui, Charco, et al.
Pubblicazione: (2025)
di: Hui, Charco, et al.
Pubblicazione: (2025)
Unlocking the Potential of Model Merging for Low-Resource Languages
di: Tao, Mingxu, et al.
Pubblicazione: (2024)
di: Tao, Mingxu, et al.
Pubblicazione: (2024)
HM3: Heterogeneous Multi-Class Model Merging
di: Hackmann, Stefan
Pubblicazione: (2024)
di: Hackmann, Stefan
Pubblicazione: (2024)
Merging Improves Self-Critique Against Jailbreak Attacks
di: Gallego, Victor
Pubblicazione: (2024)
di: Gallego, Victor
Pubblicazione: (2024)
State over Tokens: Characterizing the Role of Reasoning Tokens
di: Levy, Mosh, et al.
Pubblicazione: (2025)
di: Levy, Mosh, et al.
Pubblicazione: (2025)
Twin-Merging: Dynamic Integration of Modular Expertise in Model Merging
di: Lu, Zhenyi, et al.
Pubblicazione: (2024)
di: Lu, Zhenyi, et al.
Pubblicazione: (2024)
Optimal Brain Iterative Merging: Mitigating Interference in LLM Merging
di: Wang, Zhixiang, et al.
Pubblicazione: (2025)
di: Wang, Zhixiang, et al.
Pubblicazione: (2025)
Byte BPE Tokenization as an Inverse string Homomorphism
di: Geng, Saibo, et al.
Pubblicazione: (2024)
di: Geng, Saibo, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Rethinking Tokenization for Rich Morphology: The Dominance of Unigram over BPE and Morphological Alignment
di: Vemula, Saketh Reddy, et al.
Pubblicazione: (2025) -
GPUTOK: GPU Accelerated Byte Level BPE Tokenization
di: Kadamba, Venu Gopal, et al.
Pubblicazione: (2026) -
MorphBPE: A Morpho-Aware Tokenizer Bridging Linguistic Complexity for Efficient LLM Training Across Morphologies
di: Asgari, Ehsaneddin, et al.
Pubblicazione: (2025) -
LiteToken: Removing Intermediate Merge Residues From BPE Tokenizers
di: Sun, Yike, et al.
Pubblicazione: (2026) -
TETRIS: Optimal Draft Token Selection for Batch Speculative Decoding
di: Wu, Zhaoxuan, et al.
Pubblicazione: (2025)