An Empirical Comparison of Vocabulary Expansion and Initialization Approaches for Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mundra, Nandini, Kishore, Aditya Nanda, Dabre, Raj, Puduppully, Ratish, Kunchukuttan, Anoop, Khapra, Mitesh M. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
How Good is Zero-Shot MT Evaluation for Low Resource Indian Languages?
par: Singh, Anushka, et autres
Publié: (2024)
par: Singh, Anushka, et autres
Publié: (2024)
The Reasoning Lingua Franca: A Double-Edged Sword for Multilingual AI
par: Saji, Alan, et autres
Publié: (2025)
par: Saji, Alan, et autres
Publié: (2025)
RiddleBench: A New Generative Reasoning Benchmark for LLMs
par: Halder, Deepon, et autres
Publié: (2025)
par: Halder, Deepon, et autres
Publié: (2025)
IndicIFEval: A Benchmark for Verifiable Instruction-Following Evaluation in 14 Indic Languages
par: Jayakumar, Thanmay, et autres
Publié: (2026)
par: Jayakumar, Thanmay, et autres
Publié: (2026)
The Illusion of Generalization in Tabular Language Models
par: Gorla, Aditya, et autres
Publié: (2026)
par: Gorla, Aditya, et autres
Publié: (2026)
RomanSetu: Efficiently unlocking multilingual capabilities of Large Language Models via Romanization
par: Husain, Jaavid Aktar, et autres
Publié: (2024)
par: Husain, Jaavid Aktar, et autres
Publié: (2024)
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
par: Saji, Alan, et autres
Publié: (2025)
par: Saji, Alan, et autres
Publié: (2025)
Cross-Lingual Auto Evaluation for Assessing Multilingual LLMs
par: Doddapaneni, Sumanth, et autres
Publié: (2024)
par: Doddapaneni, Sumanth, et autres
Publié: (2024)
Airavata: Introducing Hindi Instruction-tuned LLM
par: Gala, Jay, et autres
Publié: (2024)
par: Gala, Jay, et autres
Publié: (2024)
IndicRAGSuite: Large-Scale Datasets and a Benchmark for Indian Language RAG Systems
par: Prasanjith, Pasunuti, et autres
Publié: (2025)
par: Prasanjith, Pasunuti, et autres
Publié: (2025)
Towards Building Large Scale Datasets and State-of-the-Art Automatic Speech Translation Systems for 14 Indian Languages
par: Sankar, Ashwin, et autres
Publié: (2024)
par: Sankar, Ashwin, et autres
Publié: (2024)
Enhancing Out-of-Vocabulary Performance of Indian TTS Systems for Practical Applications through Low-Effort Data Strategies
par: Anand, Srija, et autres
Publié: (2024)
par: Anand, Srija, et autres
Publié: (2024)
Rasa: Building Expressive Speech Synthesis Systems for Indian Languages in Low-resource Settings
par: Varadhan, Praveen Srinivasa, et autres
Publié: (2024)
par: Varadhan, Praveen Srinivasa, et autres
Publié: (2024)
Phir Hera Fairy: An English Fairytaler is a Strong Faker of Fluent Speech in Low-Resource Indian Languages
par: Varadhan, Praveen Srinivasa, et autres
Publié: (2025)
par: Varadhan, Praveen Srinivasa, et autres
Publié: (2025)
Chimera: State Space Models Beyond Sequences
par: Lahoti, Aakash, et autres
Publié: (2025)
par: Lahoti, Aakash, et autres
Publié: (2025)
Pralekha: Cross-Lingual Document Alignment for Indic Languages
par: Suryanarayanan, Sanjay, et autres
Publié: (2024)
par: Suryanarayanan, Sanjay, et autres
Publié: (2024)
Synthetic Data Generation and Joint Learning for Robust Code-Mixed Translation
par: Kartik, Kartik, et autres
Publié: (2024)
par: Kartik, Kartik, et autres
Publié: (2024)
IndicLLMSuite: A Blueprint for Creating Pre-training and Fine-Tuning Datasets for Indian Languages
par: Khan, Mohammed Safi Ur Rahman, et autres
Publié: (2024)
par: Khan, Mohammed Safi Ur Rahman, et autres
Publié: (2024)
The State Of TTS: A Case Study with Human Fooling Rates
par: Varadhan, Praveen Srinivasa, et autres
Publié: (2025)
par: Varadhan, Praveen Srinivasa, et autres
Publié: (2025)
NIRANTAR: Continual Learning with New Languages and Domains on Real-world Speech Data
par: Javed, Tahir, et autres
Publié: (2025)
par: Javed, Tahir, et autres
Publié: (2025)
VerityMath: Advancing Mathematical Reasoning by Self-Verification Through Unit Consistency
par: Han, Vernon Toh Yan, et autres
Publié: (2023)
par: Han, Vernon Toh Yan, et autres
Publié: (2023)
Empirical Comparison of Encoder-Based Language Models and Feature-Based Supervised Machine Learning Approaches to Automated Scoring of Long Essays
par: Wang, Kuo, et autres
Publié: (2026)
par: Wang, Kuo, et autres
Publié: (2026)
Explorations of Self-Repair in Language Models
par: Rushing, Cody, et autres
Publié: (2024)
par: Rushing, Cody, et autres
Publié: (2024)
Rule by Rule: Learning with Confidence through Vocabulary Expansion
par: Nössig, Albert, et autres
Publié: (2024)
par: Nössig, Albert, et autres
Publié: (2024)
Refusal Tokens: A Simple Way to Calibrate Refusals in Large Language Models
par: Jain, Neel, et autres
Publié: (2024)
par: Jain, Neel, et autres
Publié: (2024)
Cut Your Losses in Large-Vocabulary Language Models
par: Wijmans, Erik, et autres
Publié: (2024)
par: Wijmans, Erik, et autres
Publié: (2024)
Diffusion Guided Language Modeling
par: Lovelace, Justin, et autres
Publié: (2024)
par: Lovelace, Justin, et autres
Publié: (2024)
HYPEROFA: Expanding LLM Vocabulary to New Languages via Hypernetwork-Based Embedding Initialization
par: Özeren, Enes, et autres
Publié: (2025)
par: Özeren, Enes, et autres
Publié: (2025)
Grounded Token Initialization for New Vocabulary in LMs for Generative Recommendation
par: Chen, Daiwei, et autres
Publié: (2026)
par: Chen, Daiwei, et autres
Publié: (2026)
Towards Best Practices of Activation Patching in Language Models: Metrics and Methods
par: Zhang, Fred, et autres
Publié: (2023)
par: Zhang, Fred, et autres
Publié: (2023)
Towards Lightweight Reliability: Using Soft Prompts for Hallucination Mitigation in Large Language Models
par: Siddiqui, S M Tahmid, et autres
Publié: (2026)
par: Siddiqui, S M Tahmid, et autres
Publié: (2026)
Exploiting Vocabulary Frequency Imbalance in Language Model Pre-training
par: Chung, Woojin, et autres
Publié: (2025)
par: Chung, Woojin, et autres
Publié: (2025)
CPTQuant - A Novel Mixed Precision Post-Training Quantization Techniques for Large Language Models
par: Nanda, Amitash, et autres
Publié: (2024)
par: Nanda, Amitash, et autres
Publié: (2024)
On the Effectiveness of Large Language Models in Automating Categorization of Scientific Texts
par: Shahi, Gautam Kishore, et autres
Publié: (2025)
par: Shahi, Gautam Kishore, et autres
Publié: (2025)
Expansion Span: Combining Fading Memory and Retrieval in Hybrid State Space Models
par: Nunez, Elvis, et autres
Publié: (2024)
par: Nunez, Elvis, et autres
Publié: (2024)
Rate of Model Collapse in Recursive Training
par: Suresh, Ananda Theertha, et autres
Publié: (2024)
par: Suresh, Ananda Theertha, et autres
Publié: (2024)
An Empirical Comparison of Text Summarization: A Multi-Dimensional Evaluation of Large Language Models
par: Janakiraman, Anantharaman, et autres
Publié: (2025)
par: Janakiraman, Anantharaman, et autres
Publié: (2025)
Merging Language and Domain Specific Models: The Impact on Technical Vocabulary Acquisition
par: Rousset, Thibault, et autres
Publié: (2025)
par: Rousset, Thibault, et autres
Publié: (2025)
Fast Vocabulary Transfer for Language Model Compression
par: Gee, Leonidas, et autres
Publié: (2024)
par: Gee, Leonidas, et autres
Publié: (2024)
IndicVoices-R: Unlocking a Massive Multilingual Multi-speaker Speech Corpus for Scaling Indian TTS
par: Sankar, Ashwin, et autres
Publié: (2024)
par: Sankar, Ashwin, et autres
Publié: (2024)
Documents similaires
-
How Good is Zero-Shot MT Evaluation for Low Resource Indian Languages?
par: Singh, Anushka, et autres
Publié: (2024) -
The Reasoning Lingua Franca: A Double-Edged Sword for Multilingual AI
par: Saji, Alan, et autres
Publié: (2025) -
RiddleBench: A New Generative Reasoning Benchmark for LLMs
par: Halder, Deepon, et autres
Publié: (2025) -
IndicIFEval: A Benchmark for Verifiable Instruction-Following Evaluation in 14 Indic Languages
par: Jayakumar, Thanmay, et autres
Publié: (2026) -
The Illusion of Generalization in Tabular Language Models
par: Gorla, Aditya, et autres
Publié: (2026)