Connecting Voices: LoReSpeech as a Low-Resource Speech Parallel Corpus
Fuente:
arXiv
Guardado en:
| Autor principal: | Ouzerrout, Samy |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Pashto Common Voice: Building the First Open Speech Corpus for a 60-Million-Speaker Low-Resource Language
por: Rahman, Hanif, et al.
Publicado: (2026)
por: Rahman, Hanif, et al.
Publicado: (2026)
Giving Voice to the Constitution: Low-Resource Text-to-Speech for Quechua and Spanish Using a Bilingual Legal Corpus
por: Ortega, John E., et al.
Publicado: (2026)
por: Ortega, John E., et al.
Publicado: (2026)
DrVoice: Parallel Speech-Text Voice Conversation Model via Dual-Resolution Speech Representations
por: Tan, Chao-Hong, et al.
Publicado: (2025)
por: Tan, Chao-Hong, et al.
Publicado: (2025)
Saar-Voice: A Multi-Speaker Saarbrücken Dialect Speech Corpus
por: Oberkircher, Lena S., et al.
Publicado: (2026)
por: Oberkircher, Lena S., et al.
Publicado: (2026)
Speech-to-Speech Translation Pipelines for Conversations in Low-Resource Languages
por: Popescu-Belis, Andrei, et al.
Publicado: (2025)
por: Popescu-Belis, Andrei, et al.
Publicado: (2025)
Mixture of LoRA Experts for Low-Resourced Multi-Accent Automatic Speech Recognition
por: Bagat, Raphaël, et al.
Publicado: (2025)
por: Bagat, Raphaël, et al.
Publicado: (2025)
EuroSpeech: A Multilingual Speech Corpus
por: Pfisterer, Samuel, et al.
Publicado: (2025)
por: Pfisterer, Samuel, et al.
Publicado: (2025)
LoASR-Bench: Evaluating Large Speech Language Models on Low-Resource Automatic Speech Recognition Across Language Families
por: Chen, Jianan, et al.
Publicado: (2026)
por: Chen, Jianan, et al.
Publicado: (2026)
Enhancing Voice Wake-Up for Dysarthria: Mandarin Dysarthria Speech Corpus Release and Customized System Design
por: Gao, Ming, et al.
Publicado: (2024)
por: Gao, Ming, et al.
Publicado: (2024)
FFSTC: Fongbe to French Speech Translation Corpus
por: Kponou, D. Fortune, et al.
Publicado: (2024)
por: Kponou, D. Fortune, et al.
Publicado: (2024)
Towards Inclusive ASR: Investigating Voice Conversion for Dysarthric Speech Recognition in Low-Resource Languages
por: Li, Chin-Jou, et al.
Publicado: (2025)
por: Li, Chin-Jou, et al.
Publicado: (2025)
RegSpeech12: A Regional Corpus of Bengali Spontaneous Speech Across Dialects
por: Hassan, Md. Rezuwan, et al.
Publicado: (2025)
por: Hassan, Md. Rezuwan, et al.
Publicado: (2025)
DATASHI: A Parallel English-Tashlhiyt Corpus for Orthography Normalization and Low-Resource Language Processing
por: Monir, Nasser-Eddine, et al.
Publicado: (2026)
por: Monir, Nasser-Eddine, et al.
Publicado: (2026)
ÌròyìnSpeech: A multi-purpose Yorùbá Speech Corpus
por: Ogunremi, Tolulope, et al.
Publicado: (2023)
por: Ogunremi, Tolulope, et al.
Publicado: (2023)
Speech Vecalign: an Embedding-based Method for Aligning Parallel Speech Documents
por: Meng, Chutong, et al.
Publicado: (2025)
por: Meng, Chutong, et al.
Publicado: (2025)
Speechless: Speech Instruction Training Without Speech for Low Resource Languages
por: Dao, Alan, et al.
Publicado: (2025)
por: Dao, Alan, et al.
Publicado: (2025)
Advancing STT for Low-Resource Real-World Speech
por: D'Intino, Flavio, et al.
Publicado: (2025)
por: D'Intino, Flavio, et al.
Publicado: (2025)
Leveraging the Cross-Domain & Cross-Linguistic Corpus for Low Resource NMT: A Case Study On Bhili-Hindi-English Parallel Corpus
por: Singh, Pooja, et al.
Publicado: (2025)
por: Singh, Pooja, et al.
Publicado: (2025)
An Annotated Corpus of Arabic Tweets for Hate Speech Analysis
por: Zaghouani, Wajdi, et al.
Publicado: (2025)
por: Zaghouani, Wajdi, et al.
Publicado: (2025)
Developing an Open Conversational Speech Corpus for the Isan Language
por: Na-Thalang, Adisai, et al.
Publicado: (2025)
por: Na-Thalang, Adisai, et al.
Publicado: (2025)
Gradient-Informed Training for Low-Resource Multilingual Speech Translation
por: Sun, Ruiyan, et al.
Publicado: (2026)
por: Sun, Ruiyan, et al.
Publicado: (2026)
MimicLM: Zero-Shot Voice Imitation through Autoregressive Modeling of Pseudo-Parallel Speech Corpora
por: Feng, Tao, et al.
Publicado: (2026)
por: Feng, Tao, et al.
Publicado: (2026)
VoiceCraft-X: Unifying Multilingual, Voice-Cloning Speech Synthesis and Speech Editing
por: Zheng, Zhisheng, et al.
Publicado: (2025)
por: Zheng, Zhisheng, et al.
Publicado: (2025)
Swedish Whispers; Leveraging a Massive Speech Corpus for Swedish Speech Recognition
por: Vesterbacka, Leonora, et al.
Publicado: (2025)
por: Vesterbacka, Leonora, et al.
Publicado: (2025)
Textless Speech-to-Speech Translation With Limited Parallel Data
por: Diwan, Anuj, et al.
Publicado: (2023)
por: Diwan, Anuj, et al.
Publicado: (2023)
RosettaSpeech: Zero-Shot Speech-to-Speech Translation without Parallel Speech
por: Zheng, Zhisheng, et al.
Publicado: (2025)
por: Zheng, Zhisheng, et al.
Publicado: (2025)
ParCzech4Speech: A New Speech Corpus Derived from Czech Parliamentary Data
por: Stankov, Vladislav, et al.
Publicado: (2025)
por: Stankov, Vladislav, et al.
Publicado: (2025)
WorldSpeech: A Multilingual Speech Corpus from Around the World
por: Asonitis, Antonis, et al.
Publicado: (2026)
por: Asonitis, Antonis, et al.
Publicado: (2026)
Speak & Improve Corpus 2025: an L2 English Speech Corpus for Language Assessment and Feedback
por: Knill, Kate, et al.
Publicado: (2024)
por: Knill, Kate, et al.
Publicado: (2024)
Voice of a Continent: Mapping Africa's Speech Technology Frontier
por: Elmadany, AbdelRahim, et al.
Publicado: (2025)
por: Elmadany, AbdelRahim, et al.
Publicado: (2025)
OpenWHO: A Document-Level Parallel Corpus for Health Translation in Low-Resource Languages
por: Merx, Raphaël, et al.
Publicado: (2025)
por: Merx, Raphaël, et al.
Publicado: (2025)
IndicVoices-R: Unlocking a Massive Multilingual Multi-speaker Speech Corpus for Scaling Indian TTS
por: Sankar, Ashwin, et al.
Publicado: (2024)
por: Sankar, Ashwin, et al.
Publicado: (2024)
ViDia2Std: A Parallel Corpus and Methods for Low-Resource Vietnamese Dialect-to-Standard Translation
por: Ta, Khoa Anh, et al.
Publicado: (2026)
por: Ta, Khoa Anh, et al.
Publicado: (2026)
Advancing Speech Translation: A Corpus of Mandarin-English Conversational Telephone Speech
por: Wotherspoon, Shannon, et al.
Publicado: (2024)
por: Wotherspoon, Shannon, et al.
Publicado: (2024)
WenetSpeech-Chuan: A Large-Scale Sichuanese Corpus with Rich Annotation for Dialectal Speech Processing
por: Dai, Yuhang, et al.
Publicado: (2025)
por: Dai, Yuhang, et al.
Publicado: (2025)
SMILE: Speech Meta In-Context Learning for Low-Resource Language Automatic Speech Recognition
por: Hsu, Ming-Hao, et al.
Publicado: (2024)
por: Hsu, Ming-Hao, et al.
Publicado: (2024)
EthioMT: Parallel Corpus for Low-resource Ethiopian Languages
por: Tonja, Atnafu Lambebo, et al.
Publicado: (2024)
por: Tonja, Atnafu Lambebo, et al.
Publicado: (2024)
SpeechLLM: Unified Speech and Language Model for Enhanced Multi-Task Understanding in Low Resource Settings
por: Yoo, Jaekwon, et al.
Publicado: (2025)
por: Yoo, Jaekwon, et al.
Publicado: (2025)
ZAEBUC-Spoken: A Multilingual Multidialectal Arabic-English Speech Corpus
por: Hamed, Injy, et al.
Publicado: (2024)
por: Hamed, Injy, et al.
Publicado: (2024)
GMU Systems for the IWSLT 2025 Low-Resource Speech Translation Shared Task
por: Meng, Chutong, et al.
Publicado: (2025)
por: Meng, Chutong, et al.
Publicado: (2025)
Ejemplares similares
-
Pashto Common Voice: Building the First Open Speech Corpus for a 60-Million-Speaker Low-Resource Language
por: Rahman, Hanif, et al.
Publicado: (2026) -
Giving Voice to the Constitution: Low-Resource Text-to-Speech for Quechua and Spanish Using a Bilingual Legal Corpus
por: Ortega, John E., et al.
Publicado: (2026) -
DrVoice: Parallel Speech-Text Voice Conversation Model via Dual-Resolution Speech Representations
por: Tan, Chao-Hong, et al.
Publicado: (2025) -
Saar-Voice: A Multi-Speaker Saarbrücken Dialect Speech Corpus
por: Oberkircher, Lena S., et al.
Publicado: (2026) -
Speech-to-Speech Translation Pipelines for Conversations in Low-Resource Languages
por: Popescu-Belis, Andrei, et al.
Publicado: (2025)