Fast Vocabulary Transfer for Language Model Compression
Fuente:
arXiv
Salvato in:
| Autori principali: | Gee, Leonidas, Zugarini, Andrea, Rigutini, Leonardo, Torroni, Paolo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multi-word Tokenization for Sequence Compression
di: Gee, Leonidas, et al.
Pubblicazione: (2024)
di: Gee, Leonidas, et al.
Pubblicazione: (2024)
Are Compressed Language Models Less Subgroup Robust?
di: Gee, Leonidas, et al.
Pubblicazione: (2024)
di: Gee, Leonidas, et al.
Pubblicazione: (2024)
An energy-based comparative analysis of common approaches to text classification in the Legal domain
di: Gultekin, Sinan, et al.
Pubblicazione: (2023)
di: Gultekin, Sinan, et al.
Pubblicazione: (2023)
Dynamic Few-Shot Learning for Knowledge Graph Question Answering
di: D'Abramo, Jacopo, et al.
Pubblicazione: (2024)
di: D'Abramo, Jacopo, et al.
Pubblicazione: (2024)
BUSTER: a "BUSiness Transaction Entity Recognition" dataset
di: Zugarini, Andrea, et al.
Pubblicazione: (2024)
di: Zugarini, Andrea, et al.
Pubblicazione: (2024)
Multilingual Training and Evaluation Resources for Vision-Language Models
di: Baiamonte, Daniela, et al.
Pubblicazione: (2026)
di: Baiamonte, Daniela, et al.
Pubblicazione: (2026)
Clue-Instruct: Text-Based Clue Generation for Educational Crossword Puzzles
di: Zugarini, Andrea, et al.
Pubblicazione: (2024)
di: Zugarini, Andrea, et al.
Pubblicazione: (2024)
TRI-DEP: A Trimodal Comparative Study for Depression Detection Using Speech, Text, and EEG
di: Nurfidausi, Annisaa Fitri, et al.
Pubblicazione: (2025)
di: Nurfidausi, Annisaa Fitri, et al.
Pubblicazione: (2025)
Data Augmentation and Transfer Learning Approaches Applied to Facial Expressions Recognition
di: Randellini, Enrico, et al.
Pubblicazione: (2024)
di: Randellini, Enrico, et al.
Pubblicazione: (2024)
Combining Transformers with Natural Language Explanations
di: Ruggeri, Federico, et al.
Pubblicazione: (2021)
di: Ruggeri, Federico, et al.
Pubblicazione: (2021)
Lossless Vocabulary Reduction for Auto-Regressive Language Models
di: Chijiwa, Daiki, et al.
Pubblicazione: (2025)
di: Chijiwa, Daiki, et al.
Pubblicazione: (2025)
Backward Lens: Projecting Language Model Gradients into the Vocabulary Space
di: Katz, Shahar, et al.
Pubblicazione: (2024)
di: Katz, Shahar, et al.
Pubblicazione: (2024)
VocabTailor: Dynamic Vocabulary Selection for Downstream Tasks in Small Language Models
di: Zhang, Hanling, et al.
Pubblicazione: (2025)
di: Zhang, Hanling, et al.
Pubblicazione: (2025)
On the Compressibility of Quantized Large Language Models
di: Mao, Yu, et al.
Pubblicazione: (2024)
di: Mao, Yu, et al.
Pubblicazione: (2024)
DynaSpec: Context-aware Dynamic Speculative Sampling for Large-Vocabulary Language Models
di: Zhang, Jinbin, et al.
Pubblicazione: (2025)
di: Zhang, Jinbin, et al.
Pubblicazione: (2025)
FR-Spec: Accelerating Large-Vocabulary Language Models via Frequency-Ranked Speculative Sampling
di: Zhao, Weilin, et al.
Pubblicazione: (2025)
di: Zhao, Weilin, et al.
Pubblicazione: (2025)
SLIMER-IT: Zero-Shot NER on Italian Language
di: Zamai, Andrew, et al.
Pubblicazione: (2024)
di: Zamai, Andrew, et al.
Pubblicazione: (2024)
Clustering-driven Memory Compression for On-device Large Language Models
di: Bohdal, Ondrej, et al.
Pubblicazione: (2026)
di: Bohdal, Ondrej, et al.
Pubblicazione: (2026)
In-context Autoencoder for Context Compression in a Large Language Model
di: Ge, Tao, et al.
Pubblicazione: (2023)
di: Ge, Tao, et al.
Pubblicazione: (2023)
Mercury: Ultra-Fast Language Models Based on Diffusion
di: Labs, Inception, et al.
Pubblicazione: (2025)
di: Labs, Inception, et al.
Pubblicazione: (2025)
Language Modeling Is Compression
di: Delétang, Grégoire, et al.
Pubblicazione: (2023)
di: Delétang, Grégoire, et al.
Pubblicazione: (2023)
Block Transformer: Global-to-Local Language Modeling for Fast Inference
di: Ho, Namgyu, et al.
Pubblicazione: (2024)
di: Ho, Namgyu, et al.
Pubblicazione: (2024)
Fast Large Language Model Collaborative Decoding via Speculation
di: Fu, Jiale, et al.
Pubblicazione: (2025)
di: Fu, Jiale, et al.
Pubblicazione: (2025)
Small Vocabularies, Big Gains: Pretraining and Tokenization in Time Series Models
di: Roger, Alexis, et al.
Pubblicazione: (2025)
di: Roger, Alexis, et al.
Pubblicazione: (2025)
Selection-p: Self-Supervised Task-Agnostic Prompt Compression for Faithfulness and Transferability
di: Chung, Tsz Ting, et al.
Pubblicazione: (2024)
di: Chung, Tsz Ting, et al.
Pubblicazione: (2024)
LLMC: Benchmarking Large Language Model Quantization with a Versatile Compression Toolkit
di: Gong, Ruihao, et al.
Pubblicazione: (2024)
di: Gong, Ruihao, et al.
Pubblicazione: (2024)
MiniCache: KV Cache Compression in Depth Dimension for Large Language Models
di: Liu, Akide, et al.
Pubblicazione: (2024)
di: Liu, Akide, et al.
Pubblicazione: (2024)
Transfer Learning of Tabular Data by Finetuning Large Language Models
di: Rabbani, Shourav B., et al.
Pubblicazione: (2025)
di: Rabbani, Shourav B., et al.
Pubblicazione: (2025)
Atlas-Alignment: Making Interpretability Transferable Across Language Models
di: Puri, Bruno, et al.
Pubblicazione: (2025)
di: Puri, Bruno, et al.
Pubblicazione: (2025)
FAS: Fast ANN-SNN Conversion for Spiking Large Language Models
di: Chen, Long, et al.
Pubblicazione: (2025)
di: Chen, Long, et al.
Pubblicazione: (2025)
When Models Examine Themselves: Vocabulary-Activation Correspondence in Self-Referential Processing
di: Dadfar, Zachary Pedram
Pubblicazione: (2026)
di: Dadfar, Zachary Pedram
Pubblicazione: (2026)
Emergent Abilities in Large Language Models: A Survey
di: Berti, Leonardo, et al.
Pubblicazione: (2025)
di: Berti, Leonardo, et al.
Pubblicazione: (2025)
Learning to Compress Prompt in Natural Language Formats
di: Chuang, Yu-Neng, et al.
Pubblicazione: (2024)
di: Chuang, Yu-Neng, et al.
Pubblicazione: (2024)
FineZip : Pushing the Limits of Large Language Models for Practical Lossless Text Compression
di: Mittu, Fazal, et al.
Pubblicazione: (2024)
di: Mittu, Fazal, et al.
Pubblicazione: (2024)
SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator
di: Chen, Guoxuan, et al.
Pubblicazione: (2024)
di: Chen, Guoxuan, et al.
Pubblicazione: (2024)
Analyzing the Evaluation of Cross-Lingual Knowledge Transfer in Multilingual Language Models
di: Rajaee, Sara, et al.
Pubblicazione: (2024)
di: Rajaee, Sara, et al.
Pubblicazione: (2024)
Large Scale Transfer Learning for Tabular Data via Language Modeling
di: Gardner, Josh, et al.
Pubblicazione: (2024)
di: Gardner, Josh, et al.
Pubblicazione: (2024)
Few-Shot Cross-Lingual Transfer for Prompting Large Language Models in Low-Resource Languages
di: Toukmaji, Christopher
Pubblicazione: (2024)
di: Toukmaji, Christopher
Pubblicazione: (2024)
System-1.x: Learning to Balance Fast and Slow Planning with Language Models
di: Saha, Swarnadeep, et al.
Pubblicazione: (2024)
di: Saha, Swarnadeep, et al.
Pubblicazione: (2024)
OccamLLM: Fast and Exact Language Model Arithmetic in a Single Step
di: Dugan, Owen, et al.
Pubblicazione: (2024)
di: Dugan, Owen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Multi-word Tokenization for Sequence Compression
di: Gee, Leonidas, et al.
Pubblicazione: (2024) -
Are Compressed Language Models Less Subgroup Robust?
di: Gee, Leonidas, et al.
Pubblicazione: (2024) -
An energy-based comparative analysis of common approaches to text classification in the Legal domain
di: Gultekin, Sinan, et al.
Pubblicazione: (2023) -
Dynamic Few-Shot Learning for Knowledge Graph Question Answering
di: D'Abramo, Jacopo, et al.
Pubblicazione: (2024) -
BUSTER: a "BUSiness Transaction Entity Recognition" dataset
di: Zugarini, Andrea, et al.
Pubblicazione: (2024)