Transfer Learning of Transformer-based Speech Recognition Models from Czech to Slovak
Fuente:
arXiv
Guardado en:
| Autores principales: | Lehečka, Jan, Psutka, Josef V., Psutka, Josef |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Comparative Analysis of Bilingual and Trilingual Wav2Vec Models for Automatic Speech Recognition in Multilingual Oral History Archives
por: Lehečka, Jan, et al.
Publicado: (2024)
por: Lehečka, Jan, et al.
Publicado: (2024)
Lightweight Target-Speaker-Based Overlap Transcription for Practical Streaming ASR
por: Pražák, Aleš, et al.
Publicado: (2025)
por: Pražák, Aleš, et al.
Publicado: (2025)
Zero-Shot vs. Few-Shot Multi-Speaker TTS Using Pre-trained Czech SpeechT5 Model
por: Lehečka, Jan, et al.
Publicado: (2024)
por: Lehečka, Jan, et al.
Publicado: (2024)
Examining the Metrics for Document-Level Claim Extraction in Czech and Slovak
por: Makaiova, Lucia, et al.
Publicado: (2025)
por: Makaiova, Lucia, et al.
Publicado: (2025)
Speech Technology Services for Oral History Research
por: Draxler, Christoph, et al.
Publicado: (2024)
por: Draxler, Christoph, et al.
Publicado: (2024)
Thesis proposal: Are We Losing Textual Diversity to Natural Language Processing?
por: Jon, Josef
Publicado: (2024)
por: Jon, Josef
Publicado: (2024)
ParCzech4Speech: A New Speech Corpus Derived from Czech Parliamentary Data
por: Stankov, Vladislav, et al.
Publicado: (2025)
por: Stankov, Vladislav, et al.
Publicado: (2025)
Automatic Speech Recognition for Sanskrit with Transfer Learning
por: Sadhukhan, Bidit, et al.
Publicado: (2025)
por: Sadhukhan, Bidit, et al.
Publicado: (2025)
Towards Explainability in Legal Outcome Prediction Models
por: Valvoda, Josef, et al.
Publicado: (2024)
por: Valvoda, Josef, et al.
Publicado: (2024)
Slovak Conceptual Dictionary
por: Blšták, Miroslav
Publicado: (2025)
por: Blšták, Miroslav
Publicado: (2025)
CWRCzech: 100M Query-Document Czech Click Dataset and Its Application to Web Relevance Ranking
por: Vonášek, Josef, et al.
Publicado: (2024)
por: Vonášek, Josef, et al.
Publicado: (2024)
Finetuning LLMs for EvaCun 2025 token prediction shared task
por: Jon, Josef, et al.
Publicado: (2025)
por: Jon, Josef, et al.
Publicado: (2025)
SloPal: A 60-Million-Word Slovak Parliamentary Corpus with Aligned Speech and Fine-Tuned ASR Models
por: Božík, Erik, et al.
Publicado: (2025)
por: Božík, Erik, et al.
Publicado: (2025)
In-context Language Learning for Endangered Languages in Speech Recognition
por: Li, Zhaolin, et al.
Publicado: (2025)
por: Li, Zhaolin, et al.
Publicado: (2025)
Speech Swin-Transformer: Exploring a Hierarchical Transformer with Shifted Windows for Speech Emotion Recognition
por: Wang, Yong, et al.
Publicado: (2024)
por: Wang, Yong, et al.
Publicado: (2024)
Rewiring the Transformer with Depth-Wise LSTMs
por: Xu, Hongfei, et al.
Publicado: (2020)
por: Xu, Hongfei, et al.
Publicado: (2020)
Probing Context Localization of Polysemous Words in Pre-trained Language Model Sub-Layers
por: Vijayakumar, Soniya, et al.
Publicado: (2024)
por: Vijayakumar, Soniya, et al.
Publicado: (2024)
Epicure: Navigating the Emergent Geometry of Food Ingredient Embeddings
por: Radzikowski, Jakub, et al.
Publicado: (2026)
por: Radzikowski, Jakub, et al.
Publicado: (2026)
AutoPsyC: Automatic Recognition of Psychodynamic Conflicts from Semi-structured Interviews with Large Language Models
por: Hossain, Sayed Muddashir, et al.
Publicado: (2025)
por: Hossain, Sayed Muddashir, et al.
Publicado: (2025)
Augmenting Automatic Speech Recognition Models with Disfluency Detection
por: Amann, Robin, et al.
Publicado: (2024)
por: Amann, Robin, et al.
Publicado: (2024)
GPT Czech Poet: Generation of Czech Poetic Strophes with Language Models
por: Chudoba, Michal, et al.
Publicado: (2024)
por: Chudoba, Michal, et al.
Publicado: (2024)
Small Models, Big Impact: Efficient Corpus and Graph-Based Adaptation of Small Multilingual Language Models for Low-Resource Languages
por: Gurgurov, Daniil, et al.
Publicado: (2025)
por: Gurgurov, Daniil, et al.
Publicado: (2025)
On Multilingual Encoder Language Model Compression for Low-Resource Languages
por: Gurgurov, Daniil, et al.
Publicado: (2025)
por: Gurgurov, Daniil, et al.
Publicado: (2025)
Sparse Subnetwork Enhancement for Underrepresented Languages in Large Language Models
por: Gurgurov, Daniil, et al.
Publicado: (2025)
por: Gurgurov, Daniil, et al.
Publicado: (2025)
BenCzechMark : A Czech-centric Multitask and Multimetric Benchmark for Large Language Models with Duel Scoring Mechanism
por: Fajcik, Martin, et al.
Publicado: (2024)
por: Fajcik, Martin, et al.
Publicado: (2024)
Towards Empowering Consumers through Sentence-level Readability Scoring in German ESG Reports
por: Schüßler, Benjamin Josef, et al.
Publicado: (2026)
por: Schüßler, Benjamin Josef, et al.
Publicado: (2026)
Pre-trained Language Models Learn Remarkably Accurate Representations of Numbers
por: Kadlčík, Marek, et al.
Publicado: (2025)
por: Kadlčík, Marek, et al.
Publicado: (2025)
When Scale Meets Diversity: Evaluating Language Models on Fine-Grained Multilingual Claim Verification
por: Shcharbakova, Hanna, et al.
Publicado: (2025)
por: Shcharbakova, Hanna, et al.
Publicado: (2025)
Cross-Lingual Transfer Learning for Speech Translation
por: Ma, Rao, et al.
Publicado: (2024)
por: Ma, Rao, et al.
Publicado: (2024)
Seeing, Signing, and Saying: A Vision-Language Model-Assisted Pipeline for Sign Language Data Acquisition and Curation from Social Media
por: Yazdani, Shakib, et al.
Publicado: (2025)
por: Yazdani, Shakib, et al.
Publicado: (2025)
Disentangling Mathematical Reasoning in LLMs: A Methodological Investigation of Internal Mechanisms
por: Baeumel, Tanja, et al.
Publicado: (2026)
por: Baeumel, Tanja, et al.
Publicado: (2026)
The Lookahead Limitation: Why Multi-Operand Addition is Hard for LLMs
por: Baeumel, Tanja, et al.
Publicado: (2025)
por: Baeumel, Tanja, et al.
Publicado: (2025)
End-to-end Automatic Speech Recognition and Speech Translation: Integration of Speech Foundational Models and LLMs
por: Luu, Nam, et al.
Publicado: (2025)
por: Luu, Nam, et al.
Publicado: (2025)
Speech Recognition Transformers: Topological-lingualism Perspective
por: Singh, Shruti, et al.
Publicado: (2024)
por: Singh, Shruti, et al.
Publicado: (2024)
What Languages are Easy to Language-Model? A Perspective from Learning Probabilistic Regular Languages
por: Borenstein, Nadav, et al.
Publicado: (2024)
por: Borenstein, Nadav, et al.
Publicado: (2024)
Explainable Transformer-CNN Fusion for Noise-Robust Speech Emotion Recognition
por: Chakrabarty, Sudip, et al.
Publicado: (2025)
por: Chakrabarty, Sudip, et al.
Publicado: (2025)
Why Does Reinforcement Learning Generalize? A Feature-Level Mechanistic Study of Post-Training in Large Language Models
por: Shi, Dan, et al.
Publicado: (2026)
por: Shi, Dan, et al.
Publicado: (2026)
Cross-Modal Robustness Transfer (CMRT): Training Robust Speech Translation Models Using Adversarial Text
por: Issam, Abderrahmane, et al.
Publicado: (2026)
por: Issam, Abderrahmane, et al.
Publicado: (2026)
MooER: LLM-based Speech Recognition and Translation Models from Moore Threads
por: Xu, Junhao, et al.
Publicado: (2024)
por: Xu, Junhao, et al.
Publicado: (2024)
Reverse Probing: Evaluating Knowledge Transfer via Finetuned Task Embeddings for Coreference Resolution
por: Anikina, Tatiana, et al.
Publicado: (2025)
por: Anikina, Tatiana, et al.
Publicado: (2025)
Ejemplares similares
-
A Comparative Analysis of Bilingual and Trilingual Wav2Vec Models for Automatic Speech Recognition in Multilingual Oral History Archives
por: Lehečka, Jan, et al.
Publicado: (2024) -
Lightweight Target-Speaker-Based Overlap Transcription for Practical Streaming ASR
por: Pražák, Aleš, et al.
Publicado: (2025) -
Zero-Shot vs. Few-Shot Multi-Speaker TTS Using Pre-trained Czech SpeechT5 Model
por: Lehečka, Jan, et al.
Publicado: (2024) -
Examining the Metrics for Document-Level Claim Extraction in Czech and Slovak
por: Makaiova, Lucia, et al.
Publicado: (2025) -
Speech Technology Services for Oral History Research
por: Draxler, Christoph, et al.
Publicado: (2024)