Improving Multilingual Instruction Finetuning via Linguistically Natural and Diverse Datasets
Fuente:
arXiv
Salvato in:
| Autori principali: | Indurthi, Sathish Reddy, Zhou, Wenxuan, Chollampatt, Shamil, Agrawal, Ravi, Song, Kaiqiang, Zhao, Lingxiao, Zhu, Chenguang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
WPO: Enhancing RLHF with Weighted Preference Optimization
di: Zhou, Wenxuan, et al.
Pubblicazione: (2024)
di: Zhou, Wenxuan, et al.
Pubblicazione: (2024)
Instructional Segment Embedding: Improving LLM Safety with Instruction Hierarchy
di: Wu, Tong, et al.
Pubblicazione: (2024)
di: Wu, Tong, et al.
Pubblicazione: (2024)
Aligning Multilingual Reasoning with Verifiable Semantics from a High-Resource Expert Model
di: Faisal, Fahim, et al.
Pubblicazione: (2025)
di: Faisal, Fahim, et al.
Pubblicazione: (2025)
Beyond Monolithic Rewards: A Hybrid and Multi-Aspect Reward Optimization for MLLM Alignment
di: Gulhane, Radha, et al.
Pubblicazione: (2025)
di: Gulhane, Radha, et al.
Pubblicazione: (2025)
TCIA: A Task-Centric Instruction Augmentation Method for Instruction Finetuning
di: Ma, Simin, et al.
Pubblicazione: (2025)
di: Ma, Simin, et al.
Pubblicazione: (2025)
Complex Logical Instruction Generation
di: Zhang, Mian, et al.
Pubblicazione: (2025)
di: Zhang, Mian, et al.
Pubblicazione: (2025)
Communication to Completion: Modeling Collaborative Workflows with Intelligent Multi-Agent Communication
di: Lu, Yiming, et al.
Pubblicazione: (2025)
di: Lu, Yiming, et al.
Pubblicazione: (2025)
Maya: An Instruction Finetuned Multilingual Multimodal Model
di: Alam, Nahid, et al.
Pubblicazione: (2024)
di: Alam, Nahid, et al.
Pubblicazione: (2024)
Eliciting the Translation Ability of Large Language Models via Multilingual Finetuning with Translation Instructions
di: Li, Jiahuan, et al.
Pubblicazione: (2023)
di: Li, Jiahuan, et al.
Pubblicazione: (2023)
M-DaQ: Retrieving Samples with Multilingual Diversity and Quality for Instruction Fine-Tuning Datasets
di: Zhao, Chunguang, et al.
Pubblicazione: (2025)
di: Zhao, Chunguang, et al.
Pubblicazione: (2025)
Aya Model: An Instruction Finetuned Open-Access Multilingual Language Model
di: Üstün, Ahmet, et al.
Pubblicazione: (2024)
di: Üstün, Ahmet, et al.
Pubblicazione: (2024)
LiveMCP-101: Stress Testing and Diagnosing MCP-enabled Agents on Challenging Queries
di: Yin, Ming, et al.
Pubblicazione: (2025)
di: Yin, Ming, et al.
Pubblicazione: (2025)
T-REG: Preference Optimization with Token-Level Reward Regularization
di: Zhou, Wenxuan, et al.
Pubblicazione: (2024)
di: Zhou, Wenxuan, et al.
Pubblicazione: (2024)
Efficient Reinforcement Finetuning via Adaptive Curriculum Learning
di: Shi, Taiwei, et al.
Pubblicazione: (2025)
di: Shi, Taiwei, et al.
Pubblicazione: (2025)
Improving Task Diversity in Label Efficient Supervised Finetuning of LLMs
di: Arabelly, Abhinav, et al.
Pubblicazione: (2025)
di: Arabelly, Abhinav, et al.
Pubblicazione: (2025)
A Measure for Transparent Comparison of Linguistic Diversity in Multilingual NLP Data Sets
di: Samardzic, Tanja, et al.
Pubblicazione: (2024)
di: Samardzic, Tanja, et al.
Pubblicazione: (2024)
Limited Linguistic Diversity in Embodied AI Datasets
di: Wanna, Selma, et al.
Pubblicazione: (2026)
di: Wanna, Selma, et al.
Pubblicazione: (2026)
Improving Multilingual Neural Machine Translation by Utilizing Semantic and Linguistic Features
di: Bu, Mengyu, et al.
Pubblicazione: (2024)
di: Bu, Mengyu, et al.
Pubblicazione: (2024)
Dynamically Allocated Interval-Based Generative Linguistic Steganography with Roulette Wheel
di: Wang, Yihao, et al.
Pubblicazione: (2024)
di: Wang, Yihao, et al.
Pubblicazione: (2024)
CU-ICU: Customizing Unsupervised Instruction-Finetuned Language Models for ICU Datasets via Text-to-Text Transfer Transformer
di: Panboonyuen, Teerapong
Pubblicazione: (2025)
di: Panboonyuen, Teerapong
Pubblicazione: (2025)
Linguistically-Informed Multilingual Instruction Tuning: Is There an Optimal Set of Languages to Tune?
di: Soykan, Gürkan, et al.
Pubblicazione: (2024)
di: Soykan, Gürkan, et al.
Pubblicazione: (2024)
Finetuning Language Models to Emit Linguistic Expressions of Uncertainty
di: Chaudhry, Arslan, et al.
Pubblicazione: (2024)
di: Chaudhry, Arslan, et al.
Pubblicazione: (2024)
Multi-IF: Benchmarking LLMs on Multi-Turn and Multilingual Instructions Following
di: He, Yun, et al.
Pubblicazione: (2024)
di: He, Yun, et al.
Pubblicazione: (2024)
The Hallucination Tax of Reinforcement Finetuning
di: Song, Linxin, et al.
Pubblicazione: (2025)
di: Song, Linxin, et al.
Pubblicazione: (2025)
SELF-GUIDE: Better Task-Specific Instruction Following via Self-Synthetic Finetuning
di: Zhao, Chenyang, et al.
Pubblicazione: (2024)
di: Zhao, Chenyang, et al.
Pubblicazione: (2024)
Efficient Multilingual ASR Finetuning via LoRA Language Experts
di: Li, Jiahong, et al.
Pubblicazione: (2025)
di: Li, Jiahong, et al.
Pubblicazione: (2025)
AirNav: A Large-Scale UAV Vision-and-Language Navigation Dataset with Natural and Diverse Instructions
di: Cai, Hengxing, et al.
Pubblicazione: (2026)
di: Cai, Hengxing, et al.
Pubblicazione: (2026)
Multilingual Prompting for Improving LLM Generation Diversity
di: Wang, Qihan, et al.
Pubblicazione: (2025)
di: Wang, Qihan, et al.
Pubblicazione: (2025)
MIDB: Multilingual Instruction Data Booster for Enhancing Cultural Equality in Multilingual Instruction Synthesis
di: Liu, Yilun, et al.
Pubblicazione: (2025)
di: Liu, Yilun, et al.
Pubblicazione: (2025)
Aya Dataset: An Open-Access Collection for Multilingual Instruction Tuning
di: Singh, Shivalika, et al.
Pubblicazione: (2024)
di: Singh, Shivalika, et al.
Pubblicazione: (2024)
ATLAS: Adaptive Transfer Scaling Laws for Multilingual Pretraining, Finetuning, and Decoding the Curse of Multilinguality
di: Longpre, Shayne, et al.
Pubblicazione: (2025)
di: Longpre, Shayne, et al.
Pubblicazione: (2025)
Improving Natural Language Understanding for LLMs via Large-Scale Instruction Synthesis
di: Yuan, Lin, et al.
Pubblicazione: (2025)
di: Yuan, Lin, et al.
Pubblicazione: (2025)
BNLI: A Linguistically-Refined Bengali Dataset for Natural Language Inference
di: Haque, Farah Binta, et al.
Pubblicazione: (2025)
di: Haque, Farah Binta, et al.
Pubblicazione: (2025)
UP4LS: User Profile Constructed by Multiple Attributes for Enhancing Linguistic Steganalysis
di: Wang, Yihao, et al.
Pubblicazione: (2023)
di: Wang, Yihao, et al.
Pubblicazione: (2023)
On Instruction-Finetuning Neural Machine Translation Models
di: Raunak, Vikas, et al.
Pubblicazione: (2024)
di: Raunak, Vikas, et al.
Pubblicazione: (2024)
MAPLE: Multilingual Evaluation of Parameter Efficient Finetuning of Large Language Models
di: Aggarwal, Divyanshu, et al.
Pubblicazione: (2024)
di: Aggarwal, Divyanshu, et al.
Pubblicazione: (2024)
Palm: A Culturally Inclusive and Linguistically Diverse Dataset for Arabic LLMs
di: Alwajih, Fakhraddin, et al.
Pubblicazione: (2025)
di: Alwajih, Fakhraddin, et al.
Pubblicazione: (2025)
The Role of Diversity in In-Context Learning for Large Language Models
di: Xiao, Wenyang, et al.
Pubblicazione: (2025)
di: Xiao, Wenyang, et al.
Pubblicazione: (2025)
Improving Sparse Memory Finetuning
di: Goyal, Satyam, et al.
Pubblicazione: (2026)
di: Goyal, Satyam, et al.
Pubblicazione: (2026)
Investigating Multilingual Instruction-Tuning: Do Polyglot Models Demand for Multilingual Instructions?
di: Weber, Alexander Arno, et al.
Pubblicazione: (2024)
di: Weber, Alexander Arno, et al.
Pubblicazione: (2024)
Documenti analoghi
-
WPO: Enhancing RLHF with Weighted Preference Optimization
di: Zhou, Wenxuan, et al.
Pubblicazione: (2024) -
Instructional Segment Embedding: Improving LLM Safety with Instruction Hierarchy
di: Wu, Tong, et al.
Pubblicazione: (2024) -
Aligning Multilingual Reasoning with Verifiable Semantics from a High-Resource Expert Model
di: Faisal, Fahim, et al.
Pubblicazione: (2025) -
Beyond Monolithic Rewards: A Hybrid and Multi-Aspect Reward Optimization for MLLM Alignment
di: Gulhane, Radha, et al.
Pubblicazione: (2025) -
TCIA: A Task-Centric Instruction Augmentation Method for Instruction Finetuning
di: Ma, Simin, et al.
Pubblicazione: (2025)