EuroSpeech: A Multilingual Speech Corpus
Fuente:
arXiv
Salvato in:
| Autori principali: | Pfisterer, Samuel, Grötschla, Florian, Lanzendörfer, Luca A., Yan, Florian, Wattenhofer, Roger |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
WorldSpeech: A Multilingual Speech Corpus from Around the World
di: Asonitis, Antonis, et al.
Pubblicazione: (2026)
di: Asonitis, Antonis, et al.
Pubblicazione: (2026)
Inductive Transfer Learning for Graph-Based Recommenders
di: Grötschla, Florian, et al.
Pubblicazione: (2025)
di: Grötschla, Florian, et al.
Pubblicazione: (2025)
Benchmarking Diarization Models
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
Benchmarking Music Generation Models and Metrics via Human Preference Studies
di: Grötschla, Florian, et al.
Pubblicazione: (2025)
di: Grötschla, Florian, et al.
Pubblicazione: (2025)
Bias beyond Borders: Global Inequalities in AI-Generated Music
di: Solak, Ahmet, et al.
Pubblicazione: (2025)
di: Solak, Ahmet, et al.
Pubblicazione: (2025)
High-Fidelity Music Vocoder using Neural Audio Codecs
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
SALSA-V: Shortcut-Augmented Long-form Synchronized Audio from Videos
di: Dellali, Amir, et al.
Pubblicazione: (2025)
di: Dellali, Amir, et al.
Pubblicazione: (2025)
Parametric Neural Amp Modeling with Active Learning
di: Grötschla, Florian, et al.
Pubblicazione: (2025)
di: Grötschla, Florian, et al.
Pubblicazione: (2025)
Parametric Neural Amp Modeling with Active Learning
di: Grötschla, Florian, et al.
Pubblicazione: (2025)
di: Grötschla, Florian, et al.
Pubblicazione: (2025)
Multi-bit Audio Watermarking
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
Source Separation for A Cappella Music
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
CoRe-GD: A Hierarchical Framework for Scalable Graph Visualization with GNNs
di: Grötschla, Florian, et al.
Pubblicazione: (2024)
di: Grötschla, Florian, et al.
Pubblicazione: (2024)
Evaluating Objective Speech Quality Metrics for Neural Audio Codecs
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
AEye: A Visualization Tool for Image Datasets
di: Grötschla, Florian, et al.
Pubblicazione: (2024)
di: Grötschla, Florian, et al.
Pubblicazione: (2024)
SAO-Instruct: Free-form Audio Editing using Natural Language Instructions
di: Ungersböck, Michael, et al.
Pubblicazione: (2025)
di: Ungersböck, Michael, et al.
Pubblicazione: (2025)
SNAC: Multi-Scale Neural Audio Codec
di: Siuzdak, Hubert, et al.
Pubblicazione: (2024)
di: Siuzdak, Hubert, et al.
Pubblicazione: (2024)
Benchmarking Positional Encodings for GNNs and Graph Transformers
di: Grötschla, Florian, et al.
Pubblicazione: (2024)
di: Grötschla, Florian, et al.
Pubblicazione: (2024)
Next Level Message-Passing with Hierarchical Support Graphs
di: Vonessen, Carlos, et al.
Pubblicazione: (2024)
di: Vonessen, Carlos, et al.
Pubblicazione: (2024)
High-Fidelity Speech Enhancement via Discrete Audio Tokens
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
Towards Leveraging Contrastively Pretrained Neural Audio Embeddings for Recommender Tasks
di: Grötschla, Florian, et al.
Pubblicazione: (2024)
di: Grötschla, Florian, et al.
Pubblicazione: (2024)
MaskBeat: Loopable Drum Beat Generation
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
Audio Atlas: Visualizing and Exploring Audio Datasets
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2024)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2024)
Decentralized Federated Policy Gradient with Byzantine Fault-Tolerance and Provably Fast Convergence
di: Jordan, Philip, et al.
Pubblicazione: (2024)
di: Jordan, Philip, et al.
Pubblicazione: (2024)
Benchmarking GNNs Using Lightning Network Data
di: Feichtinger, Rainer, et al.
Pubblicazione: (2024)
di: Feichtinger, Rainer, et al.
Pubblicazione: (2024)
Flood and Echo Net: Algorithmically Aligned GNNs that Generalize
di: Mathys, Joël, et al.
Pubblicazione: (2023)
di: Mathys, Joël, et al.
Pubblicazione: (2023)
Text-to-Scene with Large Reasoning Models
di: Berdoz, Frédéric, et al.
Pubblicazione: (2025)
di: Berdoz, Frédéric, et al.
Pubblicazione: (2025)
Tiny Transformers Excel at Sentence Compression
di: Belcak, Peter, et al.
Pubblicazione: (2024)
di: Belcak, Peter, et al.
Pubblicazione: (2024)
MSNER: A Multilingual Speech Dataset for Named Entity Recognition
di: Meeus, Quentin, et al.
Pubblicazione: (2024)
di: Meeus, Quentin, et al.
Pubblicazione: (2024)
IndicVoices-R: Unlocking a Massive Multilingual Multi-speaker Speech Corpus for Scaling Indian TTS
di: Sankar, Ashwin, et al.
Pubblicazione: (2024)
di: Sankar, Ashwin, et al.
Pubblicazione: (2024)
FeruzaSpeech: A 60 Hour Uzbek Read Speech Corpus with Punctuation, Casing, and Context
di: Povey, Anna, et al.
Pubblicazione: (2024)
di: Povey, Anna, et al.
Pubblicazione: (2024)
Alignment-Aware Decoding
di: Berdoz, Frédéric, et al.
Pubblicazione: (2025)
di: Berdoz, Frédéric, et al.
Pubblicazione: (2025)
PUZZLES: A Benchmark for Neural Algorithmic Reasoning
di: Estermann, Benjamin, et al.
Pubblicazione: (2024)
di: Estermann, Benjamin, et al.
Pubblicazione: (2024)
FalAR: A Large-scale Speaker-Annotated European Portuguese Speech Corpus of Parliamentary Sessions
di: Teixeira, Francisco, et al.
Pubblicazione: (2026)
di: Teixeira, Francisco, et al.
Pubblicazione: (2026)
Investigating Affect Mining Techniques for Annotation Sample Selection in the Creation of Finnish Affective Speech Corpus
di: Lahtinen, Kalle, et al.
Pubblicazione: (2025)
di: Lahtinen, Kalle, et al.
Pubblicazione: (2025)
Reasoning Boosts Opinion Alignment in LLMs
di: Berdoz, Frédéric, et al.
Pubblicazione: (2026)
di: Berdoz, Frédéric, et al.
Pubblicazione: (2026)
Assessing Adversarial Robustness of Large Language Models: An Empirical Study
di: Yang, Zeyu, et al.
Pubblicazione: (2024)
di: Yang, Zeyu, et al.
Pubblicazione: (2024)
OWLS: Scaling Laws for Multilingual Speech Recognition and Translation Models
di: Chen, William, et al.
Pubblicazione: (2025)
di: Chen, William, et al.
Pubblicazione: (2025)
Hate Speech Detection and Classification in Amharic Text with Deep Learning
di: Gashe, Samuel Minale, et al.
Pubblicazione: (2024)
di: Gashe, Samuel Minale, et al.
Pubblicazione: (2024)
Enhancing Multilingual Voice Toxicity Detection with Speech-Text Alignment
di: Liu, Joseph, et al.
Pubblicazione: (2024)
di: Liu, Joseph, et al.
Pubblicazione: (2024)
GHaLIB: A Multilingual Framework for Hope Speech Detection in Low-Resource Languages
di: Abdullah, Ahmed, et al.
Pubblicazione: (2025)
di: Abdullah, Ahmed, et al.
Pubblicazione: (2025)
Documenti analoghi
-
WorldSpeech: A Multilingual Speech Corpus from Around the World
di: Asonitis, Antonis, et al.
Pubblicazione: (2026) -
Inductive Transfer Learning for Graph-Based Recommenders
di: Grötschla, Florian, et al.
Pubblicazione: (2025) -
Benchmarking Diarization Models
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025) -
Benchmarking Music Generation Models and Metrics via Human Preference Studies
di: Grötschla, Florian, et al.
Pubblicazione: (2025) -
Bias beyond Borders: Global Inequalities in AI-Generated Music
di: Solak, Ahmet, et al.
Pubblicazione: (2025)