Enregistré dans:
| Auteurs principaux: | Singh, Aaditya K., Strouse, DJ |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2402.14903 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HARP: A challenging human-annotated math reasoning benchmark
par: Yue, Albert S., et autres
Publié: (2024)
par: Yue, Albert S., et autres
Publié: (2024)
COMPACT: Common-token Optimized Model Pruning Across Channels and Tokens
par: Kwek, Eugene, et autres
Publié: (2025)
par: Kwek, Eugene, et autres
Publié: (2025)
Where is the signal in tokenization space?
par: Geh, Renato Lui, et autres
Publié: (2024)
par: Geh, Renato Lui, et autres
Publié: (2024)
Do LLMs Encode Functional Importance of Reasoning Tokens?
par: Singh, Janvijay, et autres
Publié: (2026)
par: Singh, Janvijay, et autres
Publié: (2026)
Interpretable Next-token Prediction via the Generalized Induction Head
par: Kim, Eunji, et autres
Publié: (2024)
par: Kim, Eunji, et autres
Publié: (2024)
On multi-token prediction for efficient LLM inference
par: Mehra, Somesh, et autres
Publié: (2025)
par: Mehra, Somesh, et autres
Publié: (2025)
The broader spectrum of in-context learning
par: Lampinen, Andrew Kyle, et autres
Publié: (2024)
par: Lampinen, Andrew Kyle, et autres
Publié: (2024)
You only need 4 extra tokens: Synergistic Test-time Adaptation for LLMs
par: Xu, Yijie, et autres
Publié: (2025)
par: Xu, Yijie, et autres
Publié: (2025)
The pitfalls of next-token prediction
par: Bachmann, Gregor, et autres
Publié: (2024)
par: Bachmann, Gregor, et autres
Publié: (2024)
Looking beyond the next token
par: Thankaraj, Abitha, et autres
Publié: (2025)
par: Thankaraj, Abitha, et autres
Publié: (2025)
Do language models plan ahead for future tokens?
par: Wu, Wilson, et autres
Publié: (2024)
par: Wu, Wilson, et autres
Publié: (2024)
Visualizing token importance for black-box language models
par: Rauba, Paulius, et autres
Publié: (2025)
par: Rauba, Paulius, et autres
Publié: (2025)
Domain-level metacognitive monitoring in frontier LLMs: A 33-model atlas
par: Cacioli, Jon-Paul
Publié: (2026)
par: Cacioli, Jon-Paul
Publié: (2026)
Toward a Theory of Tokenization in LLMs
par: Rajaraman, Nived, et autres
Publié: (2024)
par: Rajaraman, Nived, et autres
Publié: (2024)
Distinct Computations Emerge From Compositional Curricula in In-Context Learning
par: Lee, Jin Hwa, et autres
Publié: (2025)
par: Lee, Jin Hwa, et autres
Publié: (2025)
Byte-token Enhanced Language Models for Temporal Point Processes Analysis
par: Kong, Quyu, et autres
Publié: (2025)
par: Kong, Quyu, et autres
Publié: (2025)
Persuasion Tokens for Editing Factual Knowledge in LLMs
par: Youssef, Paul, et autres
Publié: (2026)
par: Youssef, Paul, et autres
Publié: (2026)
Silent Tokens, Loud Effects: Padding in LLMs
par: Himelstein, Rom, et autres
Publié: (2025)
par: Himelstein, Rom, et autres
Publié: (2025)
Shaping capabilities with token-level data filtering
par: Rathi, Neil, et autres
Publié: (2026)
par: Rathi, Neil, et autres
Publié: (2026)
Efficacy of Large Language Models in Systematic Reviews
par: Shah, Aaditya, et autres
Publié: (2024)
par: Shah, Aaditya, et autres
Publié: (2024)
Improving Self Consistency in LLMs through Probabilistic Tokenization
par: Sathe, Ashutosh, et autres
Publié: (2024)
par: Sathe, Ashutosh, et autres
Publié: (2024)
Scaling Transformer to 1M tokens and beyond with RMT
par: Bulatov, Aydar, et autres
Publié: (2023)
par: Bulatov, Aydar, et autres
Publié: (2023)
Implicit Geometry of Next-token Prediction: From Language Sparsity Patterns to Model Representations
par: Zhao, Yize, et autres
Publié: (2024)
par: Zhao, Yize, et autres
Publié: (2024)
Trained on Tokens, Calibrated on Concepts: The Emergence of Semantic Calibration in LLMs
par: Nakkiran, Preetum, et autres
Publié: (2025)
par: Nakkiran, Preetum, et autres
Publié: (2025)
LitLLMs, LLMs for Literature Review: Are we there yet?
par: Agarwal, Shubham, et autres
Publié: (2024)
par: Agarwal, Shubham, et autres
Publié: (2024)
Learning to Route LLMs with Confidence Tokens
par: Chuang, Yu-Neng, et autres
Publié: (2024)
par: Chuang, Yu-Neng, et autres
Publié: (2024)
Language models are better than humans at next-token prediction
par: Shlegeris, Buck, et autres
Publié: (2022)
par: Shlegeris, Buck, et autres
Publié: (2022)
Low-Bit Quantization Favors Undertrained LLMs: Scaling Laws for Quantized LLMs with 100T Training Tokens
par: Ouyang, Xu, et autres
Publié: (2024)
par: Ouyang, Xu, et autres
Publié: (2024)
Parallel Token Prediction for Language Models
par: Draxler, Felix, et autres
Publié: (2025)
par: Draxler, Felix, et autres
Publié: (2025)
AtteSTNet -- An attention and subword tokenization based approach for code-switched text hate speech detection
par: Shingi, Geet, et autres
Publié: (2021)
par: Shingi, Geet, et autres
Publié: (2021)
Hypertokens: Holographic Associative Memory in Tokenized LLMs
par: Augeri, Christopher James
Publié: (2025)
par: Augeri, Christopher James
Publié: (2025)
Towards Linguistically-Aware and Language-Independent Tokenization for Large Language Models (LLMs)
par: Rahman, Abrar, et autres
Publié: (2024)
par: Rahman, Abrar, et autres
Publié: (2024)
Token Buncher: Shielding LLMs from Harmful Reinforcement Learning Fine-Tuning
par: Feng, Weitao, et autres
Publié: (2025)
par: Feng, Weitao, et autres
Publié: (2025)
On Next-Token Prediction in LLMs: How End Goals Determine the Consistency of Decoding Algorithms
par: Trauger, Jacob, et autres
Publié: (2025)
par: Trauger, Jacob, et autres
Publié: (2025)
All or None: Identifiable Linear Properties of Next-token Predictors in Language Modeling
par: Marconato, Emanuele, et autres
Publié: (2024)
par: Marconato, Emanuele, et autres
Publié: (2024)
Essential-Web v1.0: 24T tokens of organized web data
par: AI, Essential, et autres
Publié: (2025)
par: AI, Essential, et autres
Publié: (2025)
Towards Compositionality in Concept Learning
par: Stein, Adam, et autres
Publié: (2024)
par: Stein, Adam, et autres
Publié: (2024)
Trans-Tokenization and Cross-lingual Vocabulary Transfers: Language Adaptation of LLMs for Low-Resource NLP
par: Remy, François, et autres
Publié: (2024)
par: Remy, François, et autres
Publié: (2024)
Beyond Early-Token Bias: Model-Specific and Language-Specific Position Effects in Multilingual LLMs
par: Menschikov, Mikhail, et autres
Publié: (2025)
par: Menschikov, Mikhail, et autres
Publié: (2025)
CAOTE: KV Cache Selection for LLMs via Attention Output Error-Based Token Eviction
par: Goel, Raghavv, et autres
Publié: (2025)
par: Goel, Raghavv, et autres
Publié: (2025)
Documents similaires
-
HARP: A challenging human-annotated math reasoning benchmark
par: Yue, Albert S., et autres
Publié: (2024) -
COMPACT: Common-token Optimized Model Pruning Across Channels and Tokens
par: Kwek, Eugene, et autres
Publié: (2025) -
Where is the signal in tokenization space?
par: Geh, Renato Lui, et autres
Publié: (2024) -
Do LLMs Encode Functional Importance of Reasoning Tokens?
par: Singh, Janvijay, et autres
Publié: (2026) -
Interpretable Next-token Prediction via the Generalized Induction Head
par: Kim, Eunji, et autres
Publié: (2024)