Testing the Assumptions of Active Learning for Translation Tasks with Few Samples
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Flores, Lorenzo Jaime Yu, di-Piano, Cesare Spinoso, Ernst, Ori, Adelani, David Ifeoluwa, Cheung, Jackie Chi Kit |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Confident in a Confidence Score: Investigating the Sensitivity of Confidence Scores to Supervised Fine-Tuning
par: Flores, Lorenzo Jaime Yu, et autres
Publié: (2026)
par: Flores, Lorenzo Jaime Yu, et autres
Publié: (2026)
Does This Summary Answer My Question? Modeling Query-Focused Summary Readers with Rational Speech Acts
par: Piano, Cesare Spinoso-Di, et autres
Publié: (2024)
par: Piano, Cesare Spinoso-Di, et autres
Publié: (2024)
Improving the Calibration of Confidence Scores in Text Generation Using the Output Distribution's Characteristics
par: Flores, Lorenzo Jaime Yu, et autres
Publié: (2025)
par: Flores, Lorenzo Jaime Yu, et autres
Publié: (2025)
$(RSA)^2$: A Rhetorical-Strategy-Aware Rational Speech Act Framework for Figurative Language Understanding
par: Piano, Cesare Spinoso-Di, et autres
Publié: (2025)
par: Piano, Cesare Spinoso-Di, et autres
Publié: (2025)
PreSumm: Predicting Summarization Performance Without Summarizing
par: Koniaev, Steven, et autres
Publié: (2025)
par: Koniaev, Steven, et autres
Publié: (2025)
Identifying and Analyzing Performance-Critical Tokens in Large Language Models
par: Bai, Yu, et autres
Publié: (2024)
par: Bai, Yu, et autres
Publié: (2024)
Solving the Challenge Set without Solving the Task: On Winograd Schemas as a Test of Pronominal Coreference Resolution
par: Porada, Ian, et autres
Publié: (2024)
par: Porada, Ian, et autres
Publié: (2024)
Natural language processing for African languages
par: Adelani, David Ifeoluwa
Publié: (2025)
par: Adelani, David Ifeoluwa
Publié: (2025)
An Empirical Study of Many-Shot In-Context Learning for Machine Translation of Low-Resource Languages
par: Lu, Yinhan, et autres
Publié: (2026)
par: Lu, Yinhan, et autres
Publié: (2026)
$\texttt{COSMIC}$: Mutual Information for Task-Agnostic Summarization Evaluation
par: Darrin, Maxime, et autres
Publié: (2024)
par: Darrin, Maxime, et autres
Publié: (2024)
ANGOFA: Leveraging OFA Embedding Initialization and Synthetic Data for Angolan Language Model
par: Quinjica, Osvaldo Luamba, et autres
Publié: (2024)
par: Quinjica, Osvaldo Luamba, et autres
Publié: (2024)
DIVERS-Bench: Evaluating Language Identification Across Domain Shifts and Code-Switching
par: Ojo, Jessica, et autres
Publié: (2025)
par: Ojo, Jessica, et autres
Publié: (2025)
AfriMTEB and AfriE5: Benchmarking and Adapting Text Embedding Models for African Languages
par: Uemura, Kosei, et autres
Publié: (2025)
par: Uemura, Kosei, et autres
Publié: (2025)
A Controlled Reevaluation of Coreference Resolution Models
par: Porada, Ian, et autres
Publié: (2024)
par: Porada, Ian, et autres
Publié: (2024)
Mechanistic Understanding and Mitigation of Language Model Non-Factual Hallucinations
par: Yu, Lei, et autres
Publié: (2024)
par: Yu, Lei, et autres
Publié: (2024)
MINERS: Multilingual Language Models as Semantic Retrievers
par: Winata, Genta Indra, et autres
Publié: (2024)
par: Winata, Genta Indra, et autres
Publié: (2024)
Lugha-Llama: Adapting Large Language Models for African Languages
par: Buzaaba, Happy, et autres
Publié: (2025)
par: Buzaaba, Happy, et autres
Publié: (2025)
Warmup Generations: A Task-Agnostic Approach for Guiding Sequence-to-Sequence Learning with Unsupervised Initial State Generation
par: Li, Senyu, et autres
Publié: (2025)
par: Li, Senyu, et autres
Publié: (2025)
Neither Valid nor Reliable? Investigating the Use of LLMs as Judges
par: Chehbouni, Khaoula, et autres
Publié: (2025)
par: Chehbouni, Khaoula, et autres
Publié: (2025)
Improving Language Plasticity via Pretraining with Active Forgetting
par: Chen, Yihong, et autres
Publié: (2023)
par: Chen, Yihong, et autres
Publié: (2023)
Fleurs-SLU: A Massively Multilingual Benchmark for Spoken Language Understanding
par: Schmidt, Fabian David, et autres
Publié: (2025)
par: Schmidt, Fabian David, et autres
Publié: (2025)
Multilinguality as Sense Adaptation
par: Cruz, Jan Christian Blaise, et autres
Publié: (2026)
par: Cruz, Jan Christian Blaise, et autres
Publié: (2026)
Does Generative AI speak Nigerian-Pidgin?: Issues about Representativeness and Bias for Multilingualism in LLMs
par: Adelani, David Ifeoluwa, et autres
Publié: (2024)
par: Adelani, David Ifeoluwa, et autres
Publié: (2024)
Stochastic Chameleons: Irrelevant Context Hallucinations Reveal Class-Based (Mis)Generalization in LLMs
par: Cheng, Ziling, et autres
Publié: (2025)
par: Cheng, Ziling, et autres
Publié: (2025)
Machine Translation Hallucination Detection for Low and High Resource Languages using Large Language Models
par: Benkirane, Kenza, et autres
Publié: (2024)
par: Benkirane, Kenza, et autres
Publié: (2024)
Charting the Landscape of African NLP: Mapping Progress and Shaping the Road Ahead
par: Alabi, Jesujoba O., et autres
Publié: (2025)
par: Alabi, Jesujoba O., et autres
Publié: (2025)
ÌròyìnSpeech: A multi-purpose Yorùbá Speech Corpus
par: Ogunremi, Tolulope, et autres
Publié: (2023)
par: Ogunremi, Tolulope, et autres
Publié: (2023)
AfriHG: News headline generation for African Languages
par: Ogunremi, Toyib, et autres
Publié: (2024)
par: Ogunremi, Toyib, et autres
Publié: (2024)
Comparing LLM prompting with Cross-lingual transfer performance on Indigenous and Low-resource Brazilian Languages
par: Adelani, David Ifeoluwa, et autres
Publié: (2024)
par: Adelani, David Ifeoluwa, et autres
Publié: (2024)
Challenges to Evaluating the Generalization of Coreference Resolution Models: A Measurement Modeling Perspective
par: Porada, Ian, et autres
Publié: (2023)
par: Porada, Ian, et autres
Publié: (2023)
Can LLMs Reason Abstractly Over Math Word Problems Without CoT? Disentangling Abstract Formulation From Arithmetic Computation
par: Cheng, Ziling, et autres
Publié: (2025)
par: Cheng, Ziling, et autres
Publié: (2025)
mSTEB: Massively Multilingual Evaluation of LLMs on Speech and Text Tasks
par: Beyene, Luel Hagos, et autres
Publié: (2025)
par: Beyene, Luel Hagos, et autres
Publié: (2025)
Translation as a Scalable Proxy for Multilingual Evaluation
par: Issaka, Sheriff, et autres
Publié: (2026)
par: Issaka, Sheriff, et autres
Publié: (2026)
Can Vision Language Models Be Adaptive in Mathematics Education? A Learner Model-based Rubric Study
par: Gao, Jie, et autres
Publié: (2026)
par: Gao, Jie, et autres
Publié: (2026)
Word Closure-Based Metamorphic Testing for Machine Translation
par: Xie, Xiaoyuan, et autres
Publié: (2023)
par: Xie, Xiaoyuan, et autres
Publié: (2023)
Improving Multilingual Math Reasoning for African Languages
par: Ogundepo, Odunayo, et autres
Publié: (2025)
par: Ogundepo, Odunayo, et autres
Publié: (2025)
Error Diversity Matters: An Error-Resistant Ensemble Method for Unsupervised Dependency Parsing
par: Shayegh, Behzad, et autres
Publié: (2024)
par: Shayegh, Behzad, et autres
Publié: (2024)
Análisis micro de los determinantes de la fecundidad adolescente en Brasil y Colombia
par: Mariachiara di Cesare
Publié: (2006)
par: Mariachiara di Cesare
Publié: (2006)
AfriqueLLM: How Data Mixing and Model Architecture Impact Continued Pre-training for African Languages
par: Yu, Hao, et autres
Publié: (2026)
par: Yu, Hao, et autres
Publié: (2026)
TukaBench: A Culturally Grounded Jailbreak Benchmark for African Languages
par: Akinode, Victor, et autres
Publié: (2026)
par: Akinode, Victor, et autres
Publié: (2026)
Documents similaires
-
Confident in a Confidence Score: Investigating the Sensitivity of Confidence Scores to Supervised Fine-Tuning
par: Flores, Lorenzo Jaime Yu, et autres
Publié: (2026) -
Does This Summary Answer My Question? Modeling Query-Focused Summary Readers with Rational Speech Acts
par: Piano, Cesare Spinoso-Di, et autres
Publié: (2024) -
Improving the Calibration of Confidence Scores in Text Generation Using the Output Distribution's Characteristics
par: Flores, Lorenzo Jaime Yu, et autres
Publié: (2025) -
$(RSA)^2$: A Rhetorical-Strategy-Aware Rational Speech Act Framework for Figurative Language Understanding
par: Piano, Cesare Spinoso-Di, et autres
Publié: (2025) -
PreSumm: Predicting Summarization Performance Without Summarizing
par: Koniaev, Steven, et autres
Publié: (2025)