Efficiently Identifying Low-Quality Language Subsets in Multilingual Datasets: A Case Study on a Large-Scale Multilingual Audio Dataset

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Samir, Farhan, Ahn, Emily P., Prakash, Shreya, Soskuthy, Márton, Shwartz, Vered, Zhu, Jian
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!