Enregistré dans:
| Auteurs principaux: | Dong, Dong, Su, Weijie |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2511.20849 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Law of Next-Token Prediction in Large Language Models
par: He, Hangfeng, et autres
Publié: (2024)
par: He, Hangfeng, et autres
Publié: (2024)
DLER: Doing Length pEnalty Right - Incentivizing More Intelligence per Token via Reinforcement Learning
par: Liu, Shih-Yang, et autres
Publié: (2025)
par: Liu, Shih-Yang, et autres
Publié: (2025)
Multiplex Thinking: Reasoning via Token-wise Branch-and-Merge
par: Tang, Yao, et autres
Publié: (2026)
par: Tang, Yao, et autres
Publié: (2026)
Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning
par: Su, DiJia, et autres
Publié: (2025)
par: Su, DiJia, et autres
Publié: (2025)
Reward Collapse in Aligning Large Language Models
par: Song, Ziang, et autres
Publié: (2023)
par: Song, Ziang, et autres
Publié: (2023)
On the Optimal Reasoning Length for RL-Trained Language Models
par: Nohara, Daisuke, et autres
Publié: (2026)
par: Nohara, Daisuke, et autres
Publié: (2026)
TokenSelect: Efficient Long-Context Inference and Length Extrapolation for LLMs via Dynamic Token-Level KV Cache Selection
par: Wu, Wei, et autres
Publié: (2024)
par: Wu, Wei, et autres
Publié: (2024)
Adaptive Layer Selection for Layer-Wise Token Pruning in LLM Inference
par: Taniguchi, Rei, et autres
Publié: (2026)
par: Taniguchi, Rei, et autres
Publié: (2026)
Confidence Regularized Masked Language Modeling using Text Length
par: Ji, Seunghyun, et autres
Publié: (2025)
par: Ji, Seunghyun, et autres
Publié: (2025)
Understanding and Mitigating Tokenization Bias in Language Models
par: Phan, Buu, et autres
Publié: (2024)
par: Phan, Buu, et autres
Publié: (2024)
Guiding Language Model Reasoning with Planning Tokens
par: Wang, Xinyi, et autres
Publié: (2023)
par: Wang, Xinyi, et autres
Publié: (2023)
Adapting Language Models via Token Translation
par: Feng, Zhili, et autres
Publié: (2024)
par: Feng, Zhili, et autres
Publié: (2024)
Counterfactual Token Generation in Large Language Models
par: Chatzi, Ivi, et autres
Publié: (2024)
par: Chatzi, Ivi, et autres
Publié: (2024)
LaSeR: Reinforcement Learning with Last-Token Self-Rewarding
par: Yang, Wenkai, et autres
Publié: (2025)
par: Yang, Wenkai, et autres
Publié: (2025)
An Overview of Large Language Models for Statisticians
par: Ji, Wenlong, et autres
Publié: (2025)
par: Ji, Wenlong, et autres
Publié: (2025)
APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts
par: Dong, Honghua, et autres
Publié: (2024)
par: Dong, Honghua, et autres
Publié: (2024)
On the Expressiveness and Length Generalization of Selective State-Space Models on Regular Languages
par: Terzić, Aleksandar, et autres
Publié: (2024)
par: Terzić, Aleksandar, et autres
Publié: (2024)
Revisiting Graph-Tokenizing Large Language Models: A Systematic Evaluation of Graph Token Understanding
par: Zhang, Zhongjian, et autres
Publié: (2026)
par: Zhang, Zhongjian, et autres
Publié: (2026)
Probabilistic Token Alignment for Large Language Model Fusion
par: Zeng, Runjia, et autres
Publié: (2025)
par: Zeng, Runjia, et autres
Publié: (2025)
Specialised or Generic? Tokenization Choices for Radiology Language Models
par: Warr, Hermione, et autres
Publié: (2025)
par: Warr, Hermione, et autres
Publié: (2025)
Compositional Steering of Large Language Models with Steering Tokens
par: Radevski, Gorjan, et autres
Publié: (2026)
par: Radevski, Gorjan, et autres
Publié: (2026)
Token-Efficient Leverage Learning in Large Language Models
par: Zeng, Yuanhao, et autres
Publié: (2024)
par: Zeng, Yuanhao, et autres
Publié: (2024)
Language Model Cascades: Token-level uncertainty and beyond
par: Gupta, Neha, et autres
Publié: (2024)
par: Gupta, Neha, et autres
Publié: (2024)
Cautious Next Token Prediction
par: Wang, Yizhou, et autres
Publié: (2025)
par: Wang, Yizhou, et autres
Publié: (2025)
Does Visual Rendering Bypass Tokenization? Investigating Script-Tokenizer Misalignment in Pixel-Based Language Models
par: Susanto, Lucky, et autres
Publié: (2026)
par: Susanto, Lucky, et autres
Publié: (2026)
Context-Aware Initialization for Reducing Generative Path Length in Diffusion Language Models
par: Miao, Tongyuan, et autres
Publié: (2025)
par: Miao, Tongyuan, et autres
Publié: (2025)
Softplus Attention with Re-weighting Boosts Length Extrapolation in Large Language Models
par: Gao, Bo, et autres
Publié: (2025)
par: Gao, Bo, et autres
Publié: (2025)
Inconsistent Tokenizations Cause Language Models to be Perplexed by Japanese Grammar
par: Gambardella, Andrew, et autres
Publié: (2025)
par: Gambardella, Andrew, et autres
Publié: (2025)
Evaluation of Large Language Models via Coupled Token Generation
par: Benz, Nina Corvelo, et autres
Publié: (2025)
par: Benz, Nina Corvelo, et autres
Publié: (2025)
Scalable Token-Level Hallucination Detection in Large Language Models
par: Min, Rui, et autres
Publié: (2026)
par: Min, Rui, et autres
Publié: (2026)
How Important Is Tokenization in French Medical Masked Language Models?
par: Labrak, Yanis, et autres
Publié: (2024)
par: Labrak, Yanis, et autres
Publié: (2024)
Multiscale Byte Language Models -- A Hierarchical Architecture for Causal Million-Length Sequence Modeling
par: Egli, Eric, et autres
Publié: (2025)
par: Egli, Eric, et autres
Publié: (2025)
Understanding Emergent Abilities of Language Models from the Loss Perspective
par: Du, Zhengxiao, et autres
Publié: (2024)
par: Du, Zhengxiao, et autres
Publié: (2024)
TLPO: Token-Level Policy Optimization for Mitigating Language Confusion in Large Language Models
par: Choo, Jinho, et autres
Publié: (2026)
par: Choo, Jinho, et autres
Publié: (2026)
Training Large Language Models To Reason In Parallel With Global Forking Tokens
par: Jia, Sheng, et autres
Publié: (2025)
par: Jia, Sheng, et autres
Publié: (2025)
SupraTok: Cross-Boundary Tokenization for Enhanced Language Model Performance
par: Tănase, Andrei-Valentin, et autres
Publié: (2025)
par: Tănase, Andrei-Valentin, et autres
Publié: (2025)
Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models
par: Kongmanee, Jaturong
Publié: (2025)
par: Kongmanee, Jaturong
Publié: (2025)
Semantic Token Clustering for Efficient Uncertainty Quantification in Large Language Models
par: Cao, Qi, et autres
Publié: (2026)
par: Cao, Qi, et autres
Publié: (2026)
xVal: A Continuous Numerical Tokenization for Scientific Language Models
par: Golkar, Siavash, et autres
Publié: (2023)
par: Golkar, Siavash, et autres
Publié: (2023)
LangTopo: Aligning Language Descriptions of Graphs with Tokenized Topological Modeling
par: Guan, Zhong, et autres
Publié: (2024)
par: Guan, Zhong, et autres
Publié: (2024)
Documents similaires
-
A Law of Next-Token Prediction in Large Language Models
par: He, Hangfeng, et autres
Publié: (2024) -
DLER: Doing Length pEnalty Right - Incentivizing More Intelligence per Token via Reinforcement Learning
par: Liu, Shih-Yang, et autres
Publié: (2025) -
Multiplex Thinking: Reasoning via Token-wise Branch-and-Merge
par: Tang, Yao, et autres
Publié: (2026) -
Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning
par: Su, DiJia, et autres
Publié: (2025) -
Reward Collapse in Aligning Large Language Models
par: Song, Ziang, et autres
Publié: (2023)