Zero-shot cross-lingual transfer in instruction tuning of large language models
Fuente:
arXiv
Salvato in:
| Autori principali: | Chirkova, Nadezhda, Nikoulina, Vassilina |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Key ingredients for effective zero-shot cross-lingual knowledge transfer in generative tasks
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024)
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024)
Empirical study of pretrained multilingual language models for zero-shot cross-lingual knowledge transfer in generation
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2023)
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2023)
Investigating the potential of Sparse Mixtures-of-Experts for multi-domain neural machine translation
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024)
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024)
Retrieval-augmented generation in multilingual settings
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024)
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024)
Adapting Large Language Models for Multi-Domain Retrieval-Augmented-Generation
di: Misrahi, Alexandre, et al.
Pubblicazione: (2025)
di: Misrahi, Alexandre, et al.
Pubblicazione: (2025)
DiffLoRA: Differential Low-Rank Adapters for Large Language Models
di: Misrahi, Alexandre, et al.
Pubblicazione: (2025)
di: Misrahi, Alexandre, et al.
Pubblicazione: (2025)
Provence: efficient and robust context pruning for retrieval-augmented generation
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2025)
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2025)
Retrieval-Augmented LLM Agents: Learning to Learn from Experience
di: Ferraz, Thomas Palmeira, et al.
Pubblicazione: (2026)
di: Ferraz, Thomas Palmeira, et al.
Pubblicazione: (2026)
Reinforcement learning fine-tuning of language model for instruction following and math reasoning
di: Han, Yifu, et al.
Pubblicazione: (2025)
di: Han, Yifu, et al.
Pubblicazione: (2025)
BERGEN: A Benchmarking Library for Retrieval-Augmented Generation
di: Rau, David, et al.
Pubblicazione: (2024)
di: Rau, David, et al.
Pubblicazione: (2024)
FrenchToxicityPrompts: a Large Benchmark for Evaluating and Mitigating Toxicity in French Texts
di: Brun, Caroline, et al.
Pubblicazione: (2024)
di: Brun, Caroline, et al.
Pubblicazione: (2024)
LLM-as-a-qualitative-judge: automating error analysis in natural language generation
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2025)
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2025)
WizardLM: Empowering large pre-trained language models to follow complex instructions
di: Xu, Can, et al.
Pubblicazione: (2023)
di: Xu, Can, et al.
Pubblicazione: (2023)
Vocabulary shapes cross-lingual variation of word-order learnability in language models
di: Martins, Jonas Mayer, et al.
Pubblicazione: (2026)
di: Martins, Jonas Mayer, et al.
Pubblicazione: (2026)
Evaluating and explaining training strategies for zero-shot cross-lingual news sentiment analysis
di: Andrenšek, Luka, et al.
Pubblicazione: (2024)
di: Andrenšek, Luka, et al.
Pubblicazione: (2024)
Zero-shot data citation function classification using transformer-based large language models (LLMs)
di: Byers, Neil, et al.
Pubblicazione: (2025)
di: Byers, Neil, et al.
Pubblicazione: (2025)
How does fine-tuning improve sensorimotor representations in large language models?
di: Wu, Minghua, et al.
Pubblicazione: (2026)
di: Wu, Minghua, et al.
Pubblicazione: (2026)
Evolution of meta's llama models and parameter-efficient fine-tuning of large language models: a survey
di: Abdullah, Abdulhady Abas, et al.
Pubblicazione: (2025)
di: Abdullah, Abdulhady Abas, et al.
Pubblicazione: (2025)
Fine-tuning of lightweight large language models for sentiment classification on heterogeneous financial textual data
di: Amorin, Alvaro Paredes, et al.
Pubblicazione: (2025)
di: Amorin, Alvaro Paredes, et al.
Pubblicazione: (2025)
Zero-shot Cross-lingual Transfer Learning with Multiple Source and Target Languages for Information Extraction: Language Selection and Adversarial Training
di: Ngo, Nghia Trung, et al.
Pubblicazione: (2024)
di: Ngo, Nghia Trung, et al.
Pubblicazione: (2024)
Metaphor identification using large language models: A comparison of RAG, prompt engineering, and fine-tuning
di: Fuoli, Matteo, et al.
Pubblicazione: (2025)
di: Fuoli, Matteo, et al.
Pubblicazione: (2025)
XNLIeu: a dataset for cross-lingual NLI in Basque
di: Heredia, Maite, et al.
Pubblicazione: (2024)
di: Heredia, Maite, et al.
Pubblicazione: (2024)
Dissociating language and thought in large language models
di: Mahowald, Kyle, et al.
Pubblicazione: (2023)
di: Mahowald, Kyle, et al.
Pubblicazione: (2023)
Cross-lingual Few-shot Learning for Persian Sentiment Analysis with Incremental Adaptation
di: Majidi, Farideh, et al.
Pubblicazione: (2025)
di: Majidi, Farideh, et al.
Pubblicazione: (2025)
Argument Mining in Data Scarce Settings: Cross-lingual Transfer and Few-shot Techniques
di: Yeginbergen, Anar, et al.
Pubblicazione: (2024)
di: Yeginbergen, Anar, et al.
Pubblicazione: (2024)
On the attribution of confidence to large language models
di: Keeling, Geoff, et al.
Pubblicazione: (2024)
di: Keeling, Geoff, et al.
Pubblicazione: (2024)
Retrieval augmented generation based dynamic prompting for few-shot biomedical named entity recognition using large language models
di: Ge, Yao, et al.
Pubblicazione: (2025)
di: Ge, Yao, et al.
Pubblicazione: (2025)
Empowering Cross-lingual Abilities of Instruction-tuned Large Language Models by Translation-following demonstrations
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2023)
Mass-Editing Memory with Attention in Transformers: A cross-lingual exploration of knowledge
di: Tamayo, Daniel, et al.
Pubblicazione: (2025)
di: Tamayo, Daniel, et al.
Pubblicazione: (2025)
Fine-tuning large language models for domain adaptation: Exploration of training strategies, scaling, model merging and synergistic capabilities
di: Lu, Wei, et al.
Pubblicazione: (2024)
di: Lu, Wei, et al.
Pubblicazione: (2024)
Integrating gender inclusivity into large language models via instruction tuning
di: Wróblewska, Alina, et al.
Pubblicazione: (2025)
di: Wróblewska, Alina, et al.
Pubblicazione: (2025)
Multi-round jailbreak attack on large language models
di: Zhou, Yihua, et al.
Pubblicazione: (2024)
di: Zhou, Yihua, et al.
Pubblicazione: (2024)
The 20 questions game to distinguish large language models
di: Richardeau, Gurvan, et al.
Pubblicazione: (2024)
di: Richardeau, Gurvan, et al.
Pubblicazione: (2024)
Quantifying non deterministic drift in large language models
di: Nicholson, Claire
Pubblicazione: (2026)
di: Nicholson, Claire
Pubblicazione: (2026)
Can large language models build causal graphs?
di: Long, Stephanie, et al.
Pubblicazione: (2023)
di: Long, Stephanie, et al.
Pubblicazione: (2023)
Response: Emergent analogical reasoning in large language models
di: Hodel, Damian, et al.
Pubblicazione: (2023)
di: Hodel, Damian, et al.
Pubblicazione: (2023)
Representation in large language models
di: Yetman, Cameron
Pubblicazione: (2025)
di: Yetman, Cameron
Pubblicazione: (2025)
Failure of contextual invariance in large language models
di: Kumar, Sagar, et al.
Pubblicazione: (2026)
di: Kumar, Sagar, et al.
Pubblicazione: (2026)
A survey of textual cyber abuse detection using cutting-edge language models and large language models
di: Diaz-Garcia, Jose A., et al.
Pubblicazione: (2025)
di: Diaz-Garcia, Jose A., et al.
Pubblicazione: (2025)
Strong and weak alignment of large language models with human values
di: Khamassi, Mehdi, et al.
Pubblicazione: (2024)
di: Khamassi, Mehdi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Key ingredients for effective zero-shot cross-lingual knowledge transfer in generative tasks
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024) -
Empirical study of pretrained multilingual language models for zero-shot cross-lingual knowledge transfer in generation
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2023) -
Investigating the potential of Sparse Mixtures-of-Experts for multi-domain neural machine translation
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024) -
Retrieval-augmented generation in multilingual settings
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024) -
Adapting Large Language Models for Multi-Domain Retrieval-Augmented-Generation
di: Misrahi, Alexandre, et al.
Pubblicazione: (2025)