Extending LLMs to New Languages: A Case Study of Llama and Persian Adaptation
Fuente:
arXiv
Saved in:
| Main Authors: | Sani, Samin Mahdizadeh, Sadeghi, Pouya, Vu, Thuy-Trang, Yaghoobzadeh, Yadollah, Haffari, Gholamreza |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Comparative Study of Multilingual Idioms and Similes in Large Language Models
by: Khoshtab, Paria, et al.
Published: (2024)
by: Khoshtab, Paria, et al.
Published: (2024)
Benchmarking Large Language Models for Persian: A Preliminary Study Focusing on ChatGPT
by: Abaskohi, Amirhossein, et al.
Published: (2024)
by: Abaskohi, Amirhossein, et al.
Published: (2024)
uTeBC-NLP at SemEval-2024 Task 9: Can LLMs be Lateral Thinkers?
by: Sadeghi, Pouya, et al.
Published: (2024)
by: Sadeghi, Pouya, et al.
Published: (2024)
GhazalBench: Usage-Grounded Evaluation of LLMs on Persian Ghazals
by: Kalhor, Ghazal, et al.
Published: (2026)
by: Kalhor, Ghazal, et al.
Published: (2026)
Mixture-of-Skills: Learning to Optimize Data Usage for Fine-Tuning Large Language Models
by: Wu, Minghao, et al.
Published: (2024)
by: Wu, Minghao, et al.
Published: (2024)
Evaluating the Creativity of LLMs in Persian Literary Text Generation
by: Tourajmehr, Armin, et al.
Published: (2025)
by: Tourajmehr, Armin, et al.
Published: (2025)
The Best of Both Worlds: Bridging Quality and Diversity in Data Selection with Bipartite Graph
by: Wu, Minghao, et al.
Published: (2024)
by: Wu, Minghao, et al.
Published: (2024)
SituatedThinker: Grounding LLM Reasoning with Real-World through Situated Thinking
by: Liu, Junnan, et al.
Published: (2025)
by: Liu, Junnan, et al.
Published: (2025)
Towards Inference-time Scaling for Continuous Space Reasoning
by: Wang, Minghan, et al.
Published: (2025)
by: Wang, Minghan, et al.
Published: (2025)
FFE-Hallu:Hallucinations in Fixed Figurative Expressions:Benchmark of Idioms and Proverbs in the Persian Language
by: Hosseini, Faezeh, et al.
Published: (2026)
by: Hosseini, Faezeh, et al.
Published: (2026)
Adapting Large Language Models for Document-Level Machine Translation
by: Wu, Minghao, et al.
Published: (2024)
by: Wu, Minghao, et al.
Published: (2024)
Conversational SimulMT: Efficient Simultaneous Translation with Large Language Models
by: Wang, Minghan, et al.
Published: (2024)
by: Wang, Minghan, et al.
Published: (2024)
Large Language Models for Persian $ \leftrightarrow $ English Idiom Translation
by: Rezaeimanesh, Sara, et al.
Published: (2024)
by: Rezaeimanesh, Sara, et al.
Published: (2024)
AIPO: Learning to Reason from Active Interaction
by: Liu, Junnan, et al.
Published: (2026)
by: Liu, Junnan, et al.
Published: (2026)
Beyond Imitation: Recovering Dense Rewards from Demonstrations
by: Li, Jiangnan, et al.
Published: (2025)
by: Li, Jiangnan, et al.
Published: (2025)
Discrete Minds in a Continuous World: Do Language Models Know Time Passes?
by: Wang, Minghan, et al.
Published: (2025)
by: Wang, Minghan, et al.
Published: (2025)
Counterfactuals As a Means for Evaluating Faithfulness of Attribution Methods in Autoregressive Language Models
by: Kamahi, Sepehr, et al.
Published: (2024)
by: Kamahi, Sepehr, et al.
Published: (2024)
Exploring the Potential of Multimodal LLM with Knowledge-Intensive Multimodal ASR
by: Wang, Minghan, et al.
Published: (2024)
by: Wang, Minghan, et al.
Published: (2024)
Simultaneous Machine Translation with Large Language Models
by: Wang, Minghan, et al.
Published: (2023)
by: Wang, Minghan, et al.
Published: (2023)
SCAR: Data Selection via Style Consistency-Aware Response Ranking for Efficient Instruction-Tuning of Large Language Models
by: Li, Zhuang, et al.
Published: (2024)
by: Li, Zhuang, et al.
Published: (2024)
Active Continual Learning: On Balancing Knowledge Retention and Learnability
by: Vu, Thuy-Trang, et al.
Published: (2023)
by: Vu, Thuy-Trang, et al.
Published: (2023)
GTS: Inference-Time Scaling of Latent Reasoning with a Learnable Gaussian Thought Sampler
by: Wang, Minghan, et al.
Published: (2026)
by: Wang, Minghan, et al.
Published: (2026)
Continual Learning for Large Language Models: A Survey
by: Wu, Tongtong, et al.
Published: (2024)
by: Wu, Tongtong, et al.
Published: (2024)
CONGRAD:Conflicting Gradient Filtering for Multilingual Preference Alignment
by: Li, Jiangnan, et al.
Published: (2025)
by: Li, Jiangnan, et al.
Published: (2025)
SpeechDialogueFactory: Generating High-Quality Speech Dialogue Data to Accelerate Your Speech-LLM Development
by: Wang, Minghan, et al.
Published: (2025)
by: Wang, Minghan, et al.
Published: (2025)
PerCul: A Story-Driven Cultural Evaluation of LLMs in Persian
by: Monazzah, Erfan Moosavi, et al.
Published: (2025)
by: Monazzah, Erfan Moosavi, et al.
Published: (2025)
Layer-wise Positional Bias in Short-Context Language Modeling
by: Rahimi, Maryam, et al.
Published: (2026)
by: Rahimi, Maryam, et al.
Published: (2026)
Explanations of Large Language Models Explain Language Representations in the Brain
by: Rahimi, Maryam, et al.
Published: (2025)
by: Rahimi, Maryam, et al.
Published: (2025)
GenKnowSub: Improving Modularity and Reusability of LLMs through General Knowledge Subtraction
by: Bagherifard, Mohammadtaha, et al.
Published: (2025)
by: Bagherifard, Mohammadtaha, et al.
Published: (2025)
Direct Evaluation of Chain-of-Thought in Multi-hop Reasoning with Knowledge Graphs
by: Nguyen, Minh-Vuong, et al.
Published: (2024)
by: Nguyen, Minh-Vuong, et al.
Published: (2024)
SOI Matters: Analyzing Multi-Setting Training Dynamics in Pretrained Language Models via Subsets of Interest
by: Vassef, Shayan, et al.
Published: (2025)
by: Vassef, Shayan, et al.
Published: (2025)
A Dual-Axis Taxonomy of Knowledge Editing for LLMs: From Mechanisms to Functions
by: Salehoof, Amir Mohammad, et al.
Published: (2025)
by: Salehoof, Amir Mohammad, et al.
Published: (2025)
Jigsaw Puzzles: Splitting Harmful Questions to Jailbreak Large Language Models
by: Yang, Hao, et al.
Published: (2024)
by: Yang, Hao, et al.
Published: (2024)
Assistive Large Language Model Agents for Socially-Aware Negotiation Dialogues
by: Hua, Yuncheng, et al.
Published: (2024)
by: Hua, Yuncheng, et al.
Published: (2024)
MAPLE: Multi-Agent Adaptive Planning with Long-Term Memory for Table Reasoning
by: Bai, Ye, et al.
Published: (2025)
by: Bai, Ye, et al.
Published: (2025)
Synthia: Scalable Grounded Persona Generation from Social Media Data
by: Rahimzadeh, Vahid, et al.
Published: (2025)
by: Rahimzadeh, Vahid, et al.
Published: (2025)
Proverbs Run in Pairs: Evaluating Proverb Translation Capability of Large Language Model
by: Wang, Minghan, et al.
Published: (2025)
by: Wang, Minghan, et al.
Published: (2025)
Hybrid Dialogue State Tracking for Persian Chatbots: A Language Model-Based Approach
by: Aghabagher, Samin Mahdipour, et al.
Published: (2025)
by: Aghabagher, Samin Mahdipour, et al.
Published: (2025)
Improving Table Understanding with LLMs and Entity-Oriented Search
by: Nguyen, Thi-Nhung, et al.
Published: (2025)
by: Nguyen, Thi-Nhung, et al.
Published: (2025)
LLMCARE: early detection of cognitive impairment via transformer models enhanced by LLM-generated synthetic data
by: Zolnour, Ali, et al.
Published: (2025)
by: Zolnour, Ali, et al.
Published: (2025)
Similar Items
-
Comparative Study of Multilingual Idioms and Similes in Large Language Models
by: Khoshtab, Paria, et al.
Published: (2024) -
Benchmarking Large Language Models for Persian: A Preliminary Study Focusing on ChatGPT
by: Abaskohi, Amirhossein, et al.
Published: (2024) -
uTeBC-NLP at SemEval-2024 Task 9: Can LLMs be Lateral Thinkers?
by: Sadeghi, Pouya, et al.
Published: (2024) -
GhazalBench: Usage-Grounded Evaluation of LLMs on Persian Ghazals
by: Kalhor, Ghazal, et al.
Published: (2026) -
Mixture-of-Skills: Learning to Optimize Data Usage for Fine-Tuning Large Language Models
by: Wu, Minghao, et al.
Published: (2024)