Enregistré dans:
| Auteurs principaux: | Lundin, Jessica M., Zhang, Ada, Adelani, David, Carroll, Cody |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2509.05425 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Token Tax: Systematic Bias in Multilingual Tokenization
par: Lundin, Jessica M., et autres
Publié: (2025)
par: Lundin, Jessica M., et autres
Publié: (2025)
Natural language processing for African languages
par: Adelani, David Ifeoluwa
Publié: (2025)
par: Adelani, David Ifeoluwa
Publié: (2025)
DIVERS-Bench: Evaluating Language Identification Across Domain Shifts and Code-Switching
par: Ojo, Jessica, et autres
Publié: (2025)
par: Ojo, Jessica, et autres
Publié: (2025)
From Guidelines to Guarantees: A Graph-Based Evaluation Harness for Domain-Specific Evaluation of LLMs
par: Lundin, Jessica M., et autres
Publié: (2025)
par: Lundin, Jessica M., et autres
Publié: (2025)
SSA-COMET: Do LLMs Outperform Learned Metrics in Evaluating MT for Under-Resourced African Languages?
par: Li, Senyu, et autres
Publié: (2025)
par: Li, Senyu, et autres
Publié: (2025)
ANGOFA: Leveraging OFA Embedding Initialization and Synthetic Data for Angolan Language Model
par: Quinjica, Osvaldo Luamba, et autres
Publié: (2024)
par: Quinjica, Osvaldo Luamba, et autres
Publié: (2024)
Fleurs-SLU: A Massively Multilingual Benchmark for Spoken Language Understanding
par: Schmidt, Fabian David, et autres
Publié: (2025)
par: Schmidt, Fabian David, et autres
Publié: (2025)
AfroBench: How Good are Large Language Models on African Languages?
par: Ojo, Jessica, et autres
Publié: (2023)
par: Ojo, Jessica, et autres
Publié: (2023)
Lugha-Llama: Adapting Large Language Models for African Languages
par: Buzaaba, Happy, et autres
Publié: (2025)
par: Buzaaba, Happy, et autres
Publié: (2025)
Bridging the Gap: Enhancing LLM Performance for Low-Resource African Languages with New Benchmarks, Fine-Tuning, and Cultural Adjustments
par: Alhanai, Tuka, et autres
Publié: (2024)
par: Alhanai, Tuka, et autres
Publié: (2024)
NLIP_Lab-IITH Low-Resource MT System for WMT24 Indic MT Shared Task
par: Sahoo, Pramit, et autres
Publié: (2024)
par: Sahoo, Pramit, et autres
Publié: (2024)
TukaBench: A Culturally Grounded Jailbreak Benchmark for African Languages
par: Akinode, Victor, et autres
Publié: (2026)
par: Akinode, Victor, et autres
Publié: (2026)
Tokenizer Fertility and Zero-Shot Performance of Foundation Models on Ukrainian Legal Text: A Comparative Study
par: Ovcharov, Volodymyr
Publié: (2026)
par: Ovcharov, Volodymyr
Publié: (2026)
Warmup Generations: A Task-Agnostic Approach for Guiding Sequence-to-Sequence Learning with Unsupervised Initial State Generation
par: Li, Senyu, et autres
Publié: (2025)
par: Li, Senyu, et autres
Publié: (2025)
COIG-CQIA: Quality is All You Need for Chinese Instruction Fine-tuning
par: Bai, Yuelin, et autres
Publié: (2024)
par: Bai, Yuelin, et autres
Publié: (2024)
Generating Diverse and High-Quality Texts by Minimum Bayes Risk Decoding
par: Jinnai, Yuu, et autres
Publié: (2024)
par: Jinnai, Yuu, et autres
Publié: (2024)
From Text to Forecasts: Bridging Modality Gap with Temporal Evolution Semantic Space
par: Li, Lehui, et autres
Publié: (2026)
par: Li, Lehui, et autres
Publié: (2026)
An Extra RMSNorm is All You Need for Fine Tuning to 1.58 Bits
par: Steinmetz, Cody, et autres
Publié: (2025)
par: Steinmetz, Cody, et autres
Publié: (2025)
SafeMT: Multi-turn Safety for Multimodal Language Models
par: Zhu, Han, et autres
Publié: (2025)
par: Zhu, Han, et autres
Publié: (2025)
Bias in Text Embedding Models
par: Rakivnenko, Vasyl, et autres
Publié: (2024)
par: Rakivnenko, Vasyl, et autres
Publié: (2024)
PARL-MT: Learning to Call Functions in Multi-Turn Conversation with Progress Awareness
par: Chai, Huacan, et autres
Publié: (2025)
par: Chai, Huacan, et autres
Publié: (2025)
MT$^{3}$: Scaling MLLM-based Text Image Machine Translation via Multi-Task Reinforcement Learning
par: Feng, Zhaopeng, et autres
Publié: (2025)
par: Feng, Zhaopeng, et autres
Publié: (2025)
Making Metadata More FAIR Using Large Language Models
par: Sundaram, Sowmya S., et autres
Publié: (2023)
par: Sundaram, Sowmya S., et autres
Publié: (2023)
How to Evaluate Speech Translation with Source-Aware Neural MT Metrics
par: Cettolo, Mauro, et autres
Publié: (2025)
par: Cettolo, Mauro, et autres
Publié: (2025)
HQA-Attack: Toward High Quality Black-Box Hard-Label Adversarial Attack on Text
par: Liu, Han, et autres
Publié: (2024)
par: Liu, Han, et autres
Publié: (2024)
Ibom NLP: A Step Toward Inclusive Natural Language Processing for Nigeria's Minority Languages
par: Kalejaiye, Oluwadara, et autres
Publié: (2025)
par: Kalejaiye, Oluwadara, et autres
Publié: (2025)
Language Models Largely Exhibit Human-like Constituent Ordering Preferences
par: Tur, Ada Defne, et autres
Publié: (2025)
par: Tur, Ada Defne, et autres
Publié: (2025)
LIME: Making LLM Data More Efficient with Linguistic Metadata Embeddings
par: Sztwiertnia, Sebastian, et autres
Publié: (2025)
par: Sztwiertnia, Sebastian, et autres
Publié: (2025)
PerQ: Efficient Evaluation of Multilingual Text Personalization Quality
par: Macko, Dominik, et autres
Publié: (2025)
par: Macko, Dominik, et autres
Publié: (2025)
MTQ-Eval: Multilingual Text Quality Evaluation for Language Models
par: Pokharel, Rhitabrat, et autres
Publié: (2025)
par: Pokharel, Rhitabrat, et autres
Publié: (2025)
Leveraging LLMs for MT in Crisis Scenarios: a blueprint for low-resource languages
par: Lankford, Séamus, et autres
Publié: (2024)
par: Lankford, Séamus, et autres
Publié: (2024)
A Comparative Study of Quality Evaluation Methods for Text Summarization
par: Nguyen, Huyen, et autres
Publié: (2024)
par: Nguyen, Huyen, et autres
Publié: (2024)
Translation as a Scalable Proxy for Multilingual Evaluation
par: Issaka, Sheriff, et autres
Publié: (2026)
par: Issaka, Sheriff, et autres
Publié: (2026)
Data Quality Issues in Multilingual Speech Datasets: The Need for Sociolinguistic Awareness and Proactive Language Planning
par: Lau, Mingfei, et autres
Publié: (2025)
par: Lau, Mingfei, et autres
Publié: (2025)
Mined Prompting and Metadata-Guided Generation for Wound Care Visual Question Answering
par: Durgapraveen, Bavana, et autres
Publié: (2025)
par: Durgapraveen, Bavana, et autres
Publié: (2025)
FuxiMT: Sparsifying Large Language Models for Chinese-Centric Multilingual Machine Translation
par: Zhu, Shaolin, et autres
Publié: (2025)
par: Zhu, Shaolin, et autres
Publié: (2025)
GOSt-MT: A Knowledge Graph for Occupation-related Gender Biases in Machine Translation
par: Mastromichalakis, Orfeas Menis, et autres
Publié: (2024)
par: Mastromichalakis, Orfeas Menis, et autres
Publié: (2024)
Check-Eval: A Checklist-based Approach for Evaluating Text Quality
par: Pereira, Jayr, et autres
Publié: (2024)
par: Pereira, Jayr, et autres
Publié: (2024)
Forecasting Future International Events: A Reliable Dataset for Text-Based Event Modeling
par: Gwak, Daehoon, et autres
Publié: (2024)
par: Gwak, Daehoon, et autres
Publié: (2024)
ChartCards: A Chart-Metadata Generation Framework for Multi-Task Chart Understanding
par: Wu, Yifan, et autres
Publié: (2025)
par: Wu, Yifan, et autres
Publié: (2025)
Documents similaires
-
The Token Tax: Systematic Bias in Multilingual Tokenization
par: Lundin, Jessica M., et autres
Publié: (2025) -
Natural language processing for African languages
par: Adelani, David Ifeoluwa
Publié: (2025) -
DIVERS-Bench: Evaluating Language Identification Across Domain Shifts and Code-Switching
par: Ojo, Jessica, et autres
Publié: (2025) -
From Guidelines to Guarantees: A Graph-Based Evaluation Harness for Domain-Specific Evaluation of LLMs
par: Lundin, Jessica M., et autres
Publié: (2025) -
SSA-COMET: Do LLMs Outperform Learned Metrics in Evaluating MT for Under-Resourced African Languages?
par: Li, Senyu, et autres
Publié: (2025)