LIWhiz: A Non-Intrusive Lyric Intelligibility Prediction System for the Cadenza Challenge
Fuente:
arXiv
Salvato in:
| Autori principali: | Shekar, Ram C. M. C., López-Espejo, Iván |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Non-Intrusive Intelligibility Prediction for Hearing Aids: Recent Advances, Trends, and Challenges
di: Zezario, Ryandhimas E.
Pubblicazione: (2025)
di: Zezario, Ryandhimas E.
Pubblicazione: (2025)
Feature Importance across Domains for Improving Non-Intrusive Speech Intelligibility Prediction in Hearing Aids
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2025)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2025)
Non-Intrusive Binaural Speech Intelligibility Prediction Using Mamba for Hearing-Impaired Listeners
di: Yamamoto, Katsuhiko, et al.
Pubblicazione: (2025)
di: Yamamoto, Katsuhiko, et al.
Pubblicazione: (2025)
Frame-Aligned Fusion of Canary and WavLM for Non-Intrusive Intelligibility Prediction of Hearing-Aid-Processed Speech
di: Nakazawa, Kazushi
Pubblicazione: (2026)
di: Nakazawa, Kazushi
Pubblicazione: (2026)
A Study on Zero-Shot Non-Intrusive Speech Intelligibility for Hearing Aids Using Large Language Models
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2025)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2025)
Non-Intrusive Speech Intelligibility Prediction for Hearing Aids using Whisper and Metadata
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2023)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2023)
Leveraging Multiple Speech Enhancers for Non-Intrusive Intelligibility Prediction for Hearing-Impaired Listeners
di: Cao, Boxuan, et al.
Pubblicazione: (2025)
di: Cao, Boxuan, et al.
Pubblicazione: (2025)
ASASVIcomtech: The Vicomtech-UGR Speech Deepfake Detection and SASV Systems for the ASVspoof5 Challenge
di: Martín-Doñas, Juan M., et al.
Pubblicazione: (2024)
di: Martín-Doñas, Juan M., et al.
Pubblicazione: (2024)
Exploiting Music Source Separation for Automatic Lyrics Transcription with Whisper
di: Syed, Jaza, et al.
Pubblicazione: (2025)
di: Syed, Jaza, et al.
Pubblicazione: (2025)
Evaluating Speech Enhancement Systems Through Listening Effort
di: Gelderblom, Femke B., et al.
Pubblicazione: (2024)
di: Gelderblom, Femke B., et al.
Pubblicazione: (2024)
Non-Intrusive Speech Intelligibility Prediction for Hearing-Impaired Users using Intermediate ASR Features and Human Memory Models
di: Mogridge, Rhiannon, et al.
Pubblicazione: (2024)
di: Mogridge, Rhiannon, et al.
Pubblicazione: (2024)
Multimodal Lyrics-Rhythm Matching
di: Liao, Callie C., et al.
Pubblicazione: (2023)
di: Liao, Callie C., et al.
Pubblicazione: (2023)
Enhancing Lyrics Transcription on Music Mixtures with Consistency Loss
di: Huang, Jiawen, et al.
Pubblicazione: (2025)
di: Huang, Jiawen, et al.
Pubblicazione: (2025)
WhiSQA: Non-Intrusive Speech Quality Prediction Using Whisper Encoder Features
di: Close, George, et al.
Pubblicazione: (2025)
di: Close, George, et al.
Pubblicazione: (2025)
The first Cadenza challenges: using machine learning competitions to improve music for listeners with a hearing loss
di: Dabike, Gerardo Roa, et al.
Pubblicazione: (2024)
di: Dabike, Gerardo Roa, et al.
Pubblicazione: (2024)
Embedding-Based Intrusive Evaluation Metrics for Musical Source Separation Using MERT Representations
di: Bereuter, Paul A., et al.
Pubblicazione: (2026)
di: Bereuter, Paul A., et al.
Pubblicazione: (2026)
Music Enhancement with Deep Filters: A Technical Report for The ICASSP 2024 Cadenza Challenge
di: Shao, Keren, et al.
Pubblicazione: (2024)
di: Shao, Keren, et al.
Pubblicazione: (2024)
Relationships between Keywords and Strong Beats in Lyrical Music
di: Liao, Callie C., et al.
Pubblicazione: (2024)
di: Liao, Callie C., et al.
Pubblicazione: (2024)
LyricWhiz: Robust Multilingual Zero-shot Lyrics Transcription by Whispering to ChatGPT
di: Zhuo, Le, et al.
Pubblicazione: (2023)
di: Zhuo, Le, et al.
Pubblicazione: (2023)
YingMusic-Singer-Plus: Controllable Singing Voice Synthesis with Flexible Lyric Manipulation and Annotation-free Melody Guidance
di: Hao, Chunbo, et al.
Pubblicazione: (2026)
di: Hao, Chunbo, et al.
Pubblicazione: (2026)
Multi-Task Pseudo-Label Learning for Non-Intrusive Speech Quality Assessment Model
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2023)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2023)
EventTrojan: Manipulating Non-Intrusive Speech Quality Assessment via Imperceptible Events
di: Ren, Ying, et al.
Pubblicazione: (2023)
di: Ren, Ying, et al.
Pubblicazione: (2023)
A Computational Analysis of Lyric Similarity Perception
di: Kim, Haven, et al.
Pubblicazione: (2024)
di: Kim, Haven, et al.
Pubblicazione: (2024)
MMAU-Pro: A Challenging and Comprehensive Benchmark for Holistic Evaluation of Audio General Intelligence
di: Kumar, Sonal, et al.
Pubblicazione: (2025)
di: Kumar, Sonal, et al.
Pubblicazione: (2025)
REFFLY: Melody-Constrained Lyrics Editing Model
di: Zhao, Songyan, et al.
Pubblicazione: (2024)
di: Zhao, Songyan, et al.
Pubblicazione: (2024)
Deep Learning-based Non-Intrusive Multi-Objective Speech Assessment Model with Cross-Domain Features
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2021)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2021)
The T12 System for AudioMOS Challenge 2025: Audio Aesthetics Score Prediction System Using KAN- and VERSA-based Models
di: Yamamoto, Katsuhiko, et al.
Pubblicazione: (2025)
di: Yamamoto, Katsuhiko, et al.
Pubblicazione: (2025)
A Real-Time Lyrics Alignment System Using Chroma And Phonetic Features For Classical Vocal Performance
di: Park, Jiyun, et al.
Pubblicazione: (2024)
di: Park, Jiyun, et al.
Pubblicazione: (2024)
SongCreator: Lyrics-based Universal Song Generation
di: Lei, Shun, et al.
Pubblicazione: (2024)
di: Lei, Shun, et al.
Pubblicazione: (2024)
XMUspeech Systems for the ASVspoof 5 Challenge
di: Li, Wangjie, et al.
Pubblicazione: (2025)
di: Li, Wangjie, et al.
Pubblicazione: (2025)
BUT Systems and Analyses for the ASVspoof 5 Challenge
di: Rohdin, Johan, et al.
Pubblicazione: (2024)
di: Rohdin, Johan, et al.
Pubblicazione: (2024)
The VoiceMOS Challenge 2024: Beyond Speech Quality Prediction
di: Huang, Wen-Chin, et al.
Pubblicazione: (2024)
di: Huang, Wen-Chin, et al.
Pubblicazione: (2024)
Joint Learning of Wording and Formatting for Singable Melody-to-Lyric Generation
di: Ou, Longshen, et al.
Pubblicazione: (2023)
di: Ou, Longshen, et al.
Pubblicazione: (2023)
The USTC-NERCSLIP Systems for The ICMC-ASR Challenge
di: Wu, Minghui, et al.
Pubblicazione: (2024)
di: Wu, Minghui, et al.
Pubblicazione: (2024)
STCON System for the CHiME-8 Challenge
di: Mitrofanov, Anton, et al.
Pubblicazione: (2024)
di: Mitrofanov, Anton, et al.
Pubblicazione: (2024)
Towards Building an End-to-End Multilingual Automatic Lyrics Transcription Model
di: Huang, Jiawen, et al.
Pubblicazione: (2024)
di: Huang, Jiawen, et al.
Pubblicazione: (2024)
GESI: Gammachirp Envelope Similarity Index for Predicting Intelligibility of Simulated Hearing Loss Sounds
di: Yamamoto, Ayako, et al.
Pubblicazione: (2023)
di: Yamamoto, Ayako, et al.
Pubblicazione: (2023)
CUHK-EE Systems for the vTAD Challenge at NCMMSC 2025
di: Chiu, Aemon Yat Fei, et al.
Pubblicazione: (2025)
di: Chiu, Aemon Yat Fei, et al.
Pubblicazione: (2025)
The SJTU X-LANCE Lab System for MSR Challenge 2025
di: Zhu, Jinxuan, et al.
Pubblicazione: (2026)
di: Zhu, Jinxuan, et al.
Pubblicazione: (2026)
The USTC-NERCSLIP Systems for the CHiME-8 MMCSG Challenge
di: Jiang, Ya, et al.
Pubblicazione: (2024)
di: Jiang, Ya, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Non-Intrusive Intelligibility Prediction for Hearing Aids: Recent Advances, Trends, and Challenges
di: Zezario, Ryandhimas E.
Pubblicazione: (2025) -
Feature Importance across Domains for Improving Non-Intrusive Speech Intelligibility Prediction in Hearing Aids
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2025) -
Non-Intrusive Binaural Speech Intelligibility Prediction Using Mamba for Hearing-Impaired Listeners
di: Yamamoto, Katsuhiko, et al.
Pubblicazione: (2025) -
Frame-Aligned Fusion of Canary and WavLM for Non-Intrusive Intelligibility Prediction of Hearing-Aid-Processed Speech
di: Nakazawa, Kazushi
Pubblicazione: (2026) -
A Study on Zero-Shot Non-Intrusive Speech Intelligibility for Hearing Aids Using Large Language Models
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2025)