Adapting Small Language Models to Low-Resource Domains: A Case Study in Hindi Tourism QA
Fuente:
arXiv
Guardado en:
| Autores principales: | Majhi, Sandipan, Bhattacharya, Paheli |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Using Word Embeddings for Query Translation for Hindi to English Cross Language Information Retrieval
por: Paheli Bhattacharya
Publicado: (2016)
por: Paheli Bhattacharya
Publicado: (2016)
Low-Resource Counterspeech Generation for Indic Languages: The Case of Bengali and Hindi
por: Das, Mithun, et al.
Publicado: (2024)
por: Das, Mithun, et al.
Publicado: (2024)
Selective Shot Learning for Code Explanation
por: Bhattacharya, Paheli, et al.
Publicado: (2024)
por: Bhattacharya, Paheli, et al.
Publicado: (2024)
Leveraging the Cross-Domain & Cross-Linguistic Corpus for Low Resource NMT: A Case Study On Bhili-Hindi-English Parallel Corpus
por: Singh, Pooja, et al.
Publicado: (2025)
por: Singh, Pooja, et al.
Publicado: (2025)
Suvach -- Generated Hindi QA benchmark
por: Narayanan, Vaishak, et al.
Publicado: (2024)
por: Narayanan, Vaishak, et al.
Publicado: (2024)
Exploring Language Model Generalization in Low-Resource Extractive QA
por: Sengupta, Saptarshi, et al.
Publicado: (2024)
por: Sengupta, Saptarshi, et al.
Publicado: (2024)
HindiLLM: Large Language Model for Hindi
por: Chouhan, Sanjay, et al.
Publicado: (2024)
por: Chouhan, Sanjay, et al.
Publicado: (2024)
SemiAdapt and SemiLoRA: Efficient Domain Adaptation for Transformer-based Low-Resource Language Translation with a Case Study on Irish
por: McGiff, Josh, et al.
Publicado: (2025)
por: McGiff, Josh, et al.
Publicado: (2025)
Tourism Question Answer System in Indian Language using Domain-Adapted Foundation Models
por: Gatla, Praveen, et al.
Publicado: (2025)
por: Gatla, Praveen, et al.
Publicado: (2025)
Reformulating Domain Adaptation of Large Language Models as Adapt-Retrieve-Revise: A Case Study on Chinese Legal Domain
por: wan, Zhen, et al.
Publicado: (2023)
por: wan, Zhen, et al.
Publicado: (2023)
Evaluating and Adapting Large Language Models to Represent Folktales in Low-Resource Languages
por: Meaney, JA, et al.
Publicado: (2024)
por: Meaney, JA, et al.
Publicado: (2024)
Domain-Adapted Small Language Models for Reliable Clinical Triage
por: Aljohani, Manar, et al.
Publicado: (2026)
por: Aljohani, Manar, et al.
Publicado: (2026)
Building Efficient and Effective OpenQA Systems for Low-Resource Languages
por: Budur, Emrah, et al.
Publicado: (2024)
por: Budur, Emrah, et al.
Publicado: (2024)
Reconsidering SMT Over NMT for Closely Related Languages: A Case Study of Persian-Hindi Pair
por: Yousofi, Waisullah, et al.
Publicado: (2024)
por: Yousofi, Waisullah, et al.
Publicado: (2024)
Don't Adapt Small Language Models for Tools; Adapt Tool Schemas to the Models
por: Lee, Jonggeun, et al.
Publicado: (2025)
por: Lee, Jonggeun, et al.
Publicado: (2025)
Adapting Large Language Models to Low-Resource Tibetan: A Two-Stage Continual and Supervised Fine-Tuning Study
por: Chen, Lifeng, et al.
Publicado: (2025)
por: Chen, Lifeng, et al.
Publicado: (2025)
Less is More: Adapting Text Embeddings for Low-Resource Languages with Small Scale Noisy Synthetic Data
por: Navasardyan, Zaruhi, et al.
Publicado: (2026)
por: Navasardyan, Zaruhi, et al.
Publicado: (2026)
Adapting Large Language Models to a Low-Resource Agglutinative Language: A Comparative Study of LoRA and QLoRA for Bashkir
por: Arabov, Mullosharaf K., et al.
Publicado: (2026)
por: Arabov, Mullosharaf K., et al.
Publicado: (2026)
Atlas-Chat: Adapting Large Language Models for Low-Resource Moroccan Arabic Dialect
por: Shang, Guokan, et al.
Publicado: (2024)
por: Shang, Guokan, et al.
Publicado: (2024)
Adapting Definition Modeling for New Languages: A Case Study on Belarusian
por: Kazakouskaya, Daniela, et al.
Publicado: (2025)
por: Kazakouskaya, Daniela, et al.
Publicado: (2025)
Multimodal Large Language Models for Low-Resource Languages: A Case Study for Basque
por: Arana, Lukas, et al.
Publicado: (2025)
por: Arana, Lukas, et al.
Publicado: (2025)
Paramanu: Compact and Competitive Monolingual Language Models for Low-Resource Morphologically Rich Indian Languages
por: Niyogi, Mitodru, et al.
Publicado: (2024)
por: Niyogi, Mitodru, et al.
Publicado: (2024)
Quality or Quantity? On Data Scale and Diversity in Adapting Large Language Models for Low-Resource Translation
por: Iyer, Vivek, et al.
Publicado: (2024)
por: Iyer, Vivek, et al.
Publicado: (2024)
Is Small Language Model the Silver Bullet to Low-Resource Languages Machine Translation?
por: Song, Yewei, et al.
Publicado: (2025)
por: Song, Yewei, et al.
Publicado: (2025)
Formal Reasoning for Intelligent QA Systems: A Case Study in the Educational Domain
por: Bui, Tuan, et al.
Publicado: (2025)
por: Bui, Tuan, et al.
Publicado: (2025)
Learning to Adapt to Low-Resource Paraphrase Generation
por: Li, Zhigen, et al.
Publicado: (2024)
por: Li, Zhigen, et al.
Publicado: (2024)
LlamaTurk: Adapting Open-Source Generative Large Language Models for Low-Resource Language
por: Toraman, Cagri
Publicado: (2024)
por: Toraman, Cagri
Publicado: (2024)
Benchmarking Procedural Language Understanding for Low-Resource Languages: A Case Study on Turkish
por: Uzunoglu, Arda, et al.
Publicado: (2023)
por: Uzunoglu, Arda, et al.
Publicado: (2023)
LowCLIP: Adapting the CLIP Model Architecture for Low-Resource Languages in Multimodal Image Retrieval Task
por: Asgarov, Ali, et al.
Publicado: (2024)
por: Asgarov, Ali, et al.
Publicado: (2024)
Advantages of Domain Knowledge Injection for Legal Document Summarization: A Case Study on Summarizing Indian Court Judgments in English and Hindi
por: Datta, Debtanu, et al.
Publicado: (2026)
por: Datta, Debtanu, et al.
Publicado: (2026)
Understanding QA generation: Extracting Parametric and Contextual Knowledge with CQA for Low Resource Bangla Language
por: Azmary, Umme Abira, et al.
Publicado: (2026)
por: Azmary, Umme Abira, et al.
Publicado: (2026)
Small Models, Big Impact: Efficient Corpus and Graph-Based Adaptation of Small Multilingual Language Models for Low-Resource Languages
por: Gurgurov, Daniil, et al.
Publicado: (2025)
por: Gurgurov, Daniil, et al.
Publicado: (2025)
MARRO: Multi-headed Attention for Rhetorical Role Labeling in Legal Documents
por: Bambroo, Purbid, et al.
Publicado: (2025)
por: Bambroo, Purbid, et al.
Publicado: (2025)
Kakugo: Distillation of Low-Resource Languages into Small Language Models
por: Devine, Peter, et al.
Publicado: (2026)
por: Devine, Peter, et al.
Publicado: (2026)
Adapting Large Language Models to Domains via Reading Comprehension
por: Cheng, Daixuan, et al.
Publicado: (2023)
por: Cheng, Daixuan, et al.
Publicado: (2023)
RetinaQA: A Robust Knowledge Base Question Answering Model for both Answerable and Unanswerable Questions
por: Faldu, Prayushi, et al.
Publicado: (2024)
por: Faldu, Prayushi, et al.
Publicado: (2024)
Understanding In-Context Machine Translation for Low-Resource Languages: A Case Study on Manchu
por: Pei, Renhao, et al.
Publicado: (2025)
por: Pei, Renhao, et al.
Publicado: (2025)
Low-Resource NMT: A Case Study on the Written and Spoken Languages in Hong Kong
por: Mak, Hei Yi, et al.
Publicado: (2025)
por: Mak, Hei Yi, et al.
Publicado: (2025)
Hindi-BEIR : A Large Scale Retrieval Benchmark in Hindi
por: Acharya, Arkadeep, et al.
Publicado: (2024)
por: Acharya, Arkadeep, et al.
Publicado: (2024)
BhashaSetu: Cross-Lingual Knowledge Transfer from High-Resource to Extreme Low-Resource Languages
por: Maji, Subhadip, et al.
Publicado: (2026)
por: Maji, Subhadip, et al.
Publicado: (2026)
Ejemplares similares
-
Using Word Embeddings for Query Translation for Hindi to English Cross Language Information Retrieval
por: Paheli Bhattacharya
Publicado: (2016) -
Low-Resource Counterspeech Generation for Indic Languages: The Case of Bengali and Hindi
por: Das, Mithun, et al.
Publicado: (2024) -
Selective Shot Learning for Code Explanation
por: Bhattacharya, Paheli, et al.
Publicado: (2024) -
Leveraging the Cross-Domain & Cross-Linguistic Corpus for Low Resource NMT: A Case Study On Bhili-Hindi-English Parallel Corpus
por: Singh, Pooja, et al.
Publicado: (2025) -
Suvach -- Generated Hindi QA benchmark
por: Narayanan, Vaishak, et al.
Publicado: (2024)