Token-Efficient Leverage Learning in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zeng, Yuanhao, Wang, Min, Wang, Yihang, Shao, Yingxia |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DELIA: Diversity-Enhanced Learning for Instruction Adaptation in Large Language Models
por: Zeng, Yuanhao, et al.
Publicado: (2024)
por: Zeng, Yuanhao, et al.
Publicado: (2024)
Large Language Models Explore by Latent Distilling
por: Zeng, Yuanhao, et al.
Publicado: (2026)
por: Zeng, Yuanhao, et al.
Publicado: (2026)
Probabilistic Token Alignment for Large Language Model Fusion
por: Zeng, Runjia, et al.
Publicado: (2025)
por: Zeng, Runjia, et al.
Publicado: (2025)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
por: Shao, Chenze, et al.
Publicado: (2024)
por: Shao, Chenze, et al.
Publicado: (2024)
Scalable Token-Level Hallucination Detection in Large Language Models
por: Min, Rui, et al.
Publicado: (2026)
por: Min, Rui, et al.
Publicado: (2026)
EfficientQAT: Efficient Quantization-Aware Training for Large Language Models
por: Chen, Mengzhao, et al.
Publicado: (2024)
por: Chen, Mengzhao, et al.
Publicado: (2024)
Semantic Token Clustering for Efficient Uncertainty Quantification in Large Language Models
por: Cao, Qi, et al.
Publicado: (2026)
por: Cao, Qi, et al.
Publicado: (2026)
Learning Dynamics in Continual Pre-Training for Large Language Models
por: Wang, Xingjin, et al.
Publicado: (2025)
por: Wang, Xingjin, et al.
Publicado: (2025)
Revisiting Graph-Tokenizing Large Language Models: A Systematic Evaluation of Graph Token Understanding
por: Zhang, Zhongjian, et al.
Publicado: (2026)
por: Zhang, Zhongjian, et al.
Publicado: (2026)
Training Large Language Models To Reason In Parallel With Global Forking Tokens
por: Jia, Sheng, et al.
Publicado: (2025)
por: Jia, Sheng, et al.
Publicado: (2025)
Large Language Models Struggle in Token-Level Clinical Named Entity Recognition
por: Lu, Qiuhao, et al.
Publicado: (2024)
por: Lu, Qiuhao, et al.
Publicado: (2024)
TokUR: Token-Level Uncertainty Estimation for Large Language Model Reasoning
por: Zhang, Tunyu, et al.
Publicado: (2025)
por: Zhang, Tunyu, et al.
Publicado: (2025)
CITER: Collaborative Inference for Efficient Large Language Model Decoding with Token-Level Routing
por: Zheng, Wenhao, et al.
Publicado: (2025)
por: Zheng, Wenhao, et al.
Publicado: (2025)
Counterfactual Token Generation in Large Language Models
por: Chatzi, Ivi, et al.
Publicado: (2024)
por: Chatzi, Ivi, et al.
Publicado: (2024)
Federated Learning-Enabled Hybrid Language Models for Communication-Efficient Token Transmission
por: Solat, Faranaksadat, et al.
Publicado: (2025)
por: Solat, Faranaksadat, et al.
Publicado: (2025)
Leveraging Large Language Models for Web Scraping
por: Ahluwalia, Aman, et al.
Publicado: (2024)
por: Ahluwalia, Aman, et al.
Publicado: (2024)
Leveraging Group Relative Policy Optimization to Advance Large Language Models in Traditional Chinese Medicine
por: Xie, Jiacheng, et al.
Publicado: (2025)
por: Xie, Jiacheng, et al.
Publicado: (2025)
Guiding Language Model Reasoning with Planning Tokens
por: Wang, Xinyi, et al.
Publicado: (2023)
por: Wang, Xinyi, et al.
Publicado: (2023)
Compositional Steering of Large Language Models with Steering Tokens
por: Radevski, Gorjan, et al.
Publicado: (2026)
por: Radevski, Gorjan, et al.
Publicado: (2026)
Crafting Efficient Fine-Tuning Strategies for Large Language Models
por: Oliver, Michael, et al.
Publicado: (2024)
por: Oliver, Michael, et al.
Publicado: (2024)
A Law of Next-Token Prediction in Large Language Models
por: He, Hangfeng, et al.
Publicado: (2024)
por: He, Hangfeng, et al.
Publicado: (2024)
Evaluation of Large Language Models via Coupled Token Generation
por: Benz, Nina Corvelo, et al.
Publicado: (2025)
por: Benz, Nina Corvelo, et al.
Publicado: (2025)
Dynamic Thinking-Token Selection for Efficient Reasoning in Large Reasoning Models
por: Guo, Zhenyuan, et al.
Publicado: (2026)
por: Guo, Zhenyuan, et al.
Publicado: (2026)
Leveraging Zero-Shot Prompting for Efficient Language Model Distillation
por: Vöge, Lukas, et al.
Publicado: (2024)
por: Vöge, Lukas, et al.
Publicado: (2024)
Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models
por: Bello, Femi, et al.
Publicado: (2025)
por: Bello, Femi, et al.
Publicado: (2025)
Continual Learning of Large Language Models: A Comprehensive Survey
por: Shi, Haizhou, et al.
Publicado: (2024)
por: Shi, Haizhou, et al.
Publicado: (2024)
Reinforcement Learning for Reasoning in Large Language Models with One Training Example
por: Wang, Yiping, et al.
Publicado: (2025)
por: Wang, Yiping, et al.
Publicado: (2025)
Enhancing Chemical Reaction and Retrosynthesis Prediction with Large Language Model and Dual-task Learning
por: Lin, Xuan, et al.
Publicado: (2025)
por: Lin, Xuan, et al.
Publicado: (2025)
SpaceByte: Towards Deleting Tokenization from Large Language Modeling
por: Slagle, Kevin
Publicado: (2024)
por: Slagle, Kevin
Publicado: (2024)
TLPO: Token-Level Policy Optimization for Mitigating Language Confusion in Large Language Models
por: Choo, Jinho, et al.
Publicado: (2026)
por: Choo, Jinho, et al.
Publicado: (2026)
Learn To be Efficient: Build Structured Sparsity in Large Language Models
por: Zheng, Haizhong, et al.
Publicado: (2024)
por: Zheng, Haizhong, et al.
Publicado: (2024)
FeDeRA:Efficient Fine-tuning of Language Models in Federated Learning Leveraging Weight Decomposition
por: Yan, Yuxuan, et al.
Publicado: (2024)
por: Yan, Yuxuan, et al.
Publicado: (2024)
Luna-2: Scalable Single-Token Evaluation with Small Language Models
por: Goel, Vatsal, et al.
Publicado: (2026)
por: Goel, Vatsal, et al.
Publicado: (2026)
PLMM: Personal Large Language Models on Mobile Devices
por: Gong, Yuanhao
Publicado: (2023)
por: Gong, Yuanhao
Publicado: (2023)
EfficientLLM: Efficiency in Large Language Models
por: Yuan, Zhengqing, et al.
Publicado: (2025)
por: Yuan, Zhengqing, et al.
Publicado: (2025)
MrT5: Dynamic Token Merging for Efficient Byte-level Language Models
por: Kallini, Julie, et al.
Publicado: (2024)
por: Kallini, Julie, et al.
Publicado: (2024)
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
por: Xu, Peng, et al.
Publicado: (2024)
por: Xu, Peng, et al.
Publicado: (2024)
UniMoT: Unified Molecule-Text Language Model with Discrete Token Representation
por: Guo, Shuhan, et al.
Publicado: (2024)
por: Guo, Shuhan, et al.
Publicado: (2024)
Revealing Behavioral Plasticity in Large Language Models: A Token-Conditional Perspective
por: Mao, Liyuan, et al.
Publicado: (2026)
por: Mao, Liyuan, et al.
Publicado: (2026)
Stop Taking Tokenizers for Granted: They Are Core Design Decisions in Large Language Models
por: Alqahtani, Sawsan, et al.
Publicado: (2026)
por: Alqahtani, Sawsan, et al.
Publicado: (2026)
Ejemplares similares
-
DELIA: Diversity-Enhanced Learning for Instruction Adaptation in Large Language Models
por: Zeng, Yuanhao, et al.
Publicado: (2024) -
Large Language Models Explore by Latent Distilling
por: Zeng, Yuanhao, et al.
Publicado: (2026) -
Probabilistic Token Alignment for Large Language Model Fusion
por: Zeng, Runjia, et al.
Publicado: (2025) -
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
por: Shao, Chenze, et al.
Publicado: (2024) -
Scalable Token-Level Hallucination Detection in Large Language Models
por: Min, Rui, et al.
Publicado: (2026)