Open Universal Arabic ASR Leaderboard
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Yingzhi, Alhmoud, Anas, Alqurishi, Muhammad |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Calm-Whisper: Reduce Whisper Hallucination On Non-Speech By Calming Crazy Heads Down
por: Wang, Yingzhi, et al.
Publicado: (2025)
por: Wang, Yingzhi, et al.
Publicado: (2025)
CamelEval: Advancing Culturally Aligned Arabic Language Models and Benchmarks
por: Qian, Zhaozhi, et al.
Publicado: (2024)
por: Qian, Zhaozhi, et al.
Publicado: (2024)
ArabicNumBench: Evaluating Arabic Number Reading in Large Language Models
por: Alhumud, Anas, et al.
Publicado: (2026)
por: Alhumud, Anas, et al.
Publicado: (2026)
Zero-Shot Context-Aware ASR for Diverse Arabic Varieties
por: Talafha, Bashar, et al.
Publicado: (2025)
por: Talafha, Bashar, et al.
Publicado: (2025)
Open ASR Leaderboard: Towards Reproducible and Transparent Multilingual and Long-Form Speech Recognition Evaluation
por: Srivastav, Vaibhav, et al.
Publicado: (2025)
por: Srivastav, Vaibhav, et al.
Publicado: (2025)
The Hallucinations Leaderboard -- An Open Effort to Measure Hallucinations in Large Language Models
por: Hong, Giwon, et al.
Publicado: (2024)
por: Hong, Giwon, et al.
Publicado: (2024)
Libra-Leaderboard: Towards Responsible AI through a Balanced Leaderboard of Safety and Capability
por: Li, Haonan, et al.
Publicado: (2024)
por: Li, Haonan, et al.
Publicado: (2024)
Prompt-to-Leaderboard
por: Frick, Evan, et al.
Publicado: (2025)
por: Frick, Evan, et al.
Publicado: (2025)
CLARIN-PT-LDB: An Open LLM Leaderboard for Portuguese to assess Language, Culture and Civility
por: Silva, João, et al.
Publicado: (2026)
por: Silva, João, et al.
Publicado: (2026)
Ramsa: A Large Sociolinguistically Rich Emirati Arabic Speech Corpus for ASR and TTS
por: Al-Sabbagh, Rania
Publicado: (2026)
por: Al-Sabbagh, Rania
Publicado: (2026)
La Leaderboard: A Large Language Model Leaderboard for Spanish Varieties and Languages of Spain and Latin America
por: Grandury, María, et al.
Publicado: (2025)
por: Grandury, María, et al.
Publicado: (2025)
The Leaderboard Illusion
por: Singh, Shivalika, et al.
Publicado: (2025)
por: Singh, Shivalika, et al.
Publicado: (2025)
LEGOBench: Scientific Leaderboard Generation Benchmark
por: Singh, Shruti, et al.
Publicado: (2024)
por: Singh, Shruti, et al.
Publicado: (2024)
Open-LLM-Leaderboard: From Multi-choice to Open-style Questions for LLMs Evaluation, Benchmark, and Arena
por: Myrzakhan, Aidar, et al.
Publicado: (2024)
por: Myrzakhan, Aidar, et al.
Publicado: (2024)
Benchmarking Commercial ASR Systems on Code-Switching Speech: Arabic, Persian, and German
por: Abdoli, Sajjad, et al.
Publicado: (2026)
por: Abdoli, Sajjad, et al.
Publicado: (2026)
League: Leaderboard Generation on Demand
por: Wu, Jian, et al.
Publicado: (2025)
por: Wu, Jian, et al.
Publicado: (2025)
SpeechColab Leaderboard: An Open-Source Platform for Automatic Speech Recognition Evaluation
por: Du, Jiayu, et al.
Publicado: (2024)
por: Du, Jiayu, et al.
Publicado: (2024)
Open Ko-LLM Leaderboard2: Bridging Foundational and Practical Evaluation for Korean LLMs
por: Kim, Hyeonwoo, et al.
Publicado: (2024)
por: Kim, Hyeonwoo, et al.
Publicado: (2024)
Understanding LLM Development Through Longitudinal Study: Insights from the Open Ko-LLM Leaderboard
por: Park, Chanjun, et al.
Publicado: (2024)
por: Park, Chanjun, et al.
Publicado: (2024)
Exploring the Latest LLMs for Leaderboard Extraction
por: Kabongo, Salomon, et al.
Publicado: (2024)
por: Kabongo, Salomon, et al.
Publicado: (2024)
User-centric Subjective Leaderboard by Customizable Reward Modeling
por: Jia, Qi, et al.
Publicado: (2025)
por: Jia, Qi, et al.
Publicado: (2025)
LLMs Meet Finance: Fine-Tuning Foundation Models for the Open FinLLM Leaderboard
por: Rao, Varun, et al.
Publicado: (2025)
por: Rao, Varun, et al.
Publicado: (2025)
Open Ko-LLM Leaderboard: Evaluating Large Language Models in Korean with Ko-H5 Benchmark
por: Park, Chanjun, et al.
Publicado: (2024)
por: Park, Chanjun, et al.
Publicado: (2024)
Improving LLM Leaderboards with Psychometrical Methodology
por: Federiakin, Denis
Publicado: (2025)
por: Federiakin, Denis
Publicado: (2025)
Instruction Finetuning for Leaderboard Generation from Empirical AI Research
por: Kabongo, Salomon, et al.
Publicado: (2024)
por: Kabongo, Salomon, et al.
Publicado: (2024)
Beyond the Numbers: Transparency in Relation Extraction Benchmark Creation and Leaderboards
por: Arzt, Varvara, et al.
Publicado: (2024)
por: Arzt, Varvara, et al.
Publicado: (2024)
Benchmarking LLM Faithfulness in RAG with Evolving Leaderboards
por: Tamber, Manveer Singh, et al.
Publicado: (2025)
por: Tamber, Manveer Singh, et al.
Publicado: (2025)
Overcoming Data Scarcity in Multi-Dialectal Arabic ASR via Whisper Fine-Tuning
por: Özyilmaz, Ömer Tarik, et al.
Publicado: (2025)
por: Özyilmaz, Ömer Tarik, et al.
Publicado: (2025)
Qabas: An Open-Source Arabic Lexicographic Database
por: Jarrar, Mustafa, et al.
Publicado: (2024)
por: Jarrar, Mustafa, et al.
Publicado: (2024)
Omnilingual ASR: Open-Source Multilingual Speech Recognition for 1600+ Languages
por: Omnilingual ASR team, et al.
Publicado: (2025)
por: Omnilingual ASR team, et al.
Publicado: (2025)
LibVulnWatch: A Deep Assessment Agent System and Leaderboard for Uncovering Hidden Vulnerabilities in Open-Source AI Libraries
por: Wu, Zekun, et al.
Publicado: (2025)
por: Wu, Zekun, et al.
Publicado: (2025)
Effective Context Selection in LLM-based Leaderboard Generation: An Empirical Study
por: Kabongo, Salomon, et al.
Publicado: (2024)
por: Kabongo, Salomon, et al.
Publicado: (2024)
Creating Arabic LLM Prompts at Scale
por: El-Sheikh, Abdelrahman, et al.
Publicado: (2024)
por: El-Sheikh, Abdelrahman, et al.
Publicado: (2024)
The Trust Paradox: How CS Researchers Engage LLM Leaderboards
por: Sadeghi, Pouya, et al.
Publicado: (2026)
por: Sadeghi, Pouya, et al.
Publicado: (2026)
The FACTS Grounding Leaderboard: Benchmarking LLMs' Ability to Ground Responses to Long-Form Input
por: Jacovi, Alon, et al.
Publicado: (2025)
por: Jacovi, Alon, et al.
Publicado: (2025)
A Position Paper on the Automatic Generation of Machine Learning Leaderboards
por: Timmer, Roelien C, et al.
Publicado: (2025)
por: Timmer, Roelien C, et al.
Publicado: (2025)
CTC-DID: CTC-Based Arabic dialect identification for streaming applications
por: Farooq, Muhammad Umar, et al.
Publicado: (2026)
por: Farooq, Muhammad Umar, et al.
Publicado: (2026)
Swan and ArabicMTEB: Dialect-Aware, Arabic-Centric, Cross-Lingual, and Cross-Cultural Embedding Models and Benchmarks
por: Bhatia, Gagan, et al.
Publicado: (2024)
por: Bhatia, Gagan, et al.
Publicado: (2024)
MULTI: Multimodal Understanding Leaderboard with Text and Images
por: Zhu, Zichen, et al.
Publicado: (2024)
por: Zhu, Zichen, et al.
Publicado: (2024)
ASR Under Noise: Exploring Robustness for Sundanese and Javanese
por: Pranida, Salsabila Zahirah, et al.
Publicado: (2025)
por: Pranida, Salsabila Zahirah, et al.
Publicado: (2025)
Ejemplares similares
-
Calm-Whisper: Reduce Whisper Hallucination On Non-Speech By Calming Crazy Heads Down
por: Wang, Yingzhi, et al.
Publicado: (2025) -
CamelEval: Advancing Culturally Aligned Arabic Language Models and Benchmarks
por: Qian, Zhaozhi, et al.
Publicado: (2024) -
ArabicNumBench: Evaluating Arabic Number Reading in Large Language Models
por: Alhumud, Anas, et al.
Publicado: (2026) -
Zero-Shot Context-Aware ASR for Diverse Arabic Varieties
por: Talafha, Bashar, et al.
Publicado: (2025) -
Open ASR Leaderboard: Towards Reproducible and Transparent Multilingual and Long-Form Speech Recognition Evaluation
por: Srivastav, Vaibhav, et al.
Publicado: (2025)