Adapting Language Models via Token Translation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Feng, Zhili, Marwah, Tanya, Fusi, Nicolo, Alvarez-Melis, David, Mackey, Lester |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Tag-LLM: Repurposing General-Purpose LLMs for Specialized Domains
par: Shen, Junhong, et autres
Publié: (2024)
par: Shen, Junhong, et autres
Publié: (2024)
IGDA: Interactive Graph Discovery through Large Language Model Agents
par: Havrilla, Alex, et autres
Publié: (2025)
par: Havrilla, Alex, et autres
Publié: (2025)
Self-Taught Optimizer (STOP): Recursively Self-Improving Code Generation
par: Zelikman, Eric, et autres
Publié: (2023)
par: Zelikman, Eric, et autres
Publié: (2023)
Lugha-Llama: Adapting Large Language Models for African Languages
par: Buzaaba, Happy, et autres
Publié: (2025)
par: Buzaaba, Happy, et autres
Publié: (2025)
Sequence-level Large Language Model Training with Contrastive Preference Optimization
par: Feng, Zhili, et autres
Publié: (2025)
par: Feng, Zhili, et autres
Publié: (2025)
Evaluation of Large Language Models via Coupled Token Generation
par: Benz, Nina Corvelo, et autres
Publié: (2025)
par: Benz, Nina Corvelo, et autres
Publié: (2025)
Existing Large Language Model Unlearning Evaluations Are Inconclusive
par: Feng, Zhili, et autres
Publié: (2025)
par: Feng, Zhili, et autres
Publié: (2025)
TransformLLM: Adapting Large Language Models via LLM-Transformed Reading Comprehension Text
par: Arbel, Iftach, et autres
Publié: (2024)
par: Arbel, Iftach, et autres
Publié: (2024)
Length-MAX Tokenizer for Language Models
par: Dong, Dong, et autres
Publié: (2025)
par: Dong, Dong, et autres
Publié: (2025)
RE-Adapt: Reverse Engineered Adaptation of Large Language Models
par: Fleshman, William, et autres
Publié: (2024)
par: Fleshman, William, et autres
Publié: (2024)
Domain-Adapted Small Language Models for Reliable Clinical Triage
par: Aljohani, Manar, et autres
Publié: (2026)
par: Aljohani, Manar, et autres
Publié: (2026)
Can Interpretation Predict Behavior on Unseen Data?
par: Li, Victoria R., et autres
Publié: (2025)
par: Li, Victoria R., et autres
Publié: (2025)
AdaptThink: Reasoning Models Can Learn When to Think
par: Zhang, Jiajie, et autres
Publié: (2025)
par: Zhang, Jiajie, et autres
Publié: (2025)
CodePDE: An Inference Framework for LLM-driven PDE Solver Generation
par: Li, Shanda, et autres
Publié: (2025)
par: Li, Shanda, et autres
Publié: (2025)
BBox-Adapter: Lightweight Adapting for Black-Box Large Language Models
par: Sun, Haotian, et autres
Publié: (2024)
par: Sun, Haotian, et autres
Publié: (2024)
Understanding and Mitigating Tokenization Bias in Language Models
par: Phan, Buu, et autres
Publié: (2024)
par: Phan, Buu, et autres
Publié: (2024)
Counterfactual Token Generation in Large Language Models
par: Chatzi, Ivi, et autres
Publié: (2024)
par: Chatzi, Ivi, et autres
Publié: (2024)
Do Retrieval-Augmented Language Models Adapt to Varying User Needs?
par: Wu, Peilin, et autres
Publié: (2025)
par: Wu, Peilin, et autres
Publié: (2025)
Fact-Checking the Output of Large Language Models via Token-Level Uncertainty Quantification
par: Fadeeva, Ekaterina, et autres
Publié: (2024)
par: Fadeeva, Ekaterina, et autres
Publié: (2024)
Guiding Language Model Reasoning with Planning Tokens
par: Wang, Xinyi, et autres
Publié: (2023)
par: Wang, Xinyi, et autres
Publié: (2023)
Synthesizing and Adapting Error Correction Data for Mobile Large Language Model Applications
par: Zhang, Yanxiang, et autres
Publié: (2025)
par: Zhang, Yanxiang, et autres
Publié: (2025)
Adapt-Pruner: Adaptive Structural Pruning for Efficient Small Language Model Training
par: Pan, Rui, et autres
Publié: (2025)
par: Pan, Rui, et autres
Publié: (2025)
ReALM: Reference Resolution As Language Modeling
par: Moniz, Joel Ruben Antony, et autres
Publié: (2024)
par: Moniz, Joel Ruben Antony, et autres
Publié: (2024)
Revisiting Graph-Tokenizing Large Language Models: A Systematic Evaluation of Graph Token Understanding
par: Zhang, Zhongjian, et autres
Publié: (2026)
par: Zhang, Zhongjian, et autres
Publié: (2026)
Token-Efficient Leverage Learning in Large Language Models
par: Zeng, Yuanhao, et autres
Publié: (2024)
par: Zeng, Yuanhao, et autres
Publié: (2024)
Language Model Cascades: Token-level uncertainty and beyond
par: Gupta, Neha, et autres
Publié: (2024)
par: Gupta, Neha, et autres
Publié: (2024)
Compositional Steering of Large Language Models with Steering Tokens
par: Radevski, Gorjan, et autres
Publié: (2026)
par: Radevski, Gorjan, et autres
Publié: (2026)
Probabilistic Token Alignment for Large Language Model Fusion
par: Zeng, Runjia, et autres
Publié: (2025)
par: Zeng, Runjia, et autres
Publié: (2025)
Specialised or Generic? Tokenization Choices for Radiology Language Models
par: Warr, Hermione, et autres
Publié: (2025)
par: Warr, Hermione, et autres
Publié: (2025)
Does Visual Rendering Bypass Tokenization? Investigating Script-Tokenizer Misalignment in Pixel-Based Language Models
par: Susanto, Lucky, et autres
Publié: (2026)
par: Susanto, Lucky, et autres
Publié: (2026)
Evaluating Gender Bias Transfer between Pre-trained and Prompt-Adapted Language Models
par: Mackraz, Natalie, et autres
Publié: (2024)
par: Mackraz, Natalie, et autres
Publié: (2024)
Lossless Token Sequence Compression via Meta-Tokens
par: Harvill, John, et autres
Publié: (2025)
par: Harvill, John, et autres
Publié: (2025)
A Law of Next-Token Prediction in Large Language Models
par: He, Hangfeng, et autres
Publié: (2024)
par: He, Hangfeng, et autres
Publié: (2024)
How Important Is Tokenization in French Medical Masked Language Models?
par: Labrak, Yanis, et autres
Publié: (2024)
par: Labrak, Yanis, et autres
Publié: (2024)
Scalable Token-Level Hallucination Detection in Large Language Models
par: Min, Rui, et autres
Publié: (2026)
par: Min, Rui, et autres
Publié: (2026)
Inconsistent Tokenizations Cause Language Models to be Perplexed by Japanese Grammar
par: Gambardella, Andrew, et autres
Publié: (2025)
par: Gambardella, Andrew, et autres
Publié: (2025)
Aligning Pre-trained Models for Spoken Language Translation
par: Sedláček, Šimon, et autres
Publié: (2024)
par: Sedláček, Šimon, et autres
Publié: (2024)
Steering Large Language Models for Machine Translation Personalization
par: Scalena, Daniel, et autres
Publié: (2025)
par: Scalena, Daniel, et autres
Publié: (2025)
Rational Metareasoning for Large Language Models
par: De Sabbata, C. Nicolò, et autres
Publié: (2024)
par: De Sabbata, C. Nicolò, et autres
Publié: (2024)
Towards Adapting Open-Source Large Language Models for Expert-Level Clinical Note Generation
par: Wang, Hanyin, et autres
Publié: (2024)
par: Wang, Hanyin, et autres
Publié: (2024)
Documents similaires
-
Tag-LLM: Repurposing General-Purpose LLMs for Specialized Domains
par: Shen, Junhong, et autres
Publié: (2024) -
IGDA: Interactive Graph Discovery through Large Language Model Agents
par: Havrilla, Alex, et autres
Publié: (2025) -
Self-Taught Optimizer (STOP): Recursively Self-Improving Code Generation
par: Zelikman, Eric, et autres
Publié: (2023) -
Lugha-Llama: Adapting Large Language Models for African Languages
par: Buzaaba, Happy, et autres
Publié: (2025) -
Sequence-level Large Language Model Training with Contrastive Preference Optimization
par: Feng, Zhili, et autres
Publié: (2025)