An Effective Strategy for Modeling Score Ordinality and Non-uniform Intervals in Automated Speaking Assessment
Fuente:
arXiv
Salvato in:
| Autori principali: | Lo, Tien-Hong, Chen, Szu-Yu, Sung, Yao-Ting, Chen, Berlin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An Effective Automated Speaking Assessment Approach to Mitigating Data Scarcity and Imbalanced Distribution
di: Lo, Tien-Hong, et al.
Pubblicazione: (2024)
di: Lo, Tien-Hong, et al.
Pubblicazione: (2024)
Advancing Automated Speaking Assessment Leveraging Multifaceted Relevance and Grammar Information
di: Lu, Hao-Chien, et al.
Pubblicazione: (2025)
di: Lu, Hao-Chien, et al.
Pubblicazione: (2025)
ConPCO: Preserving Phoneme Characteristics for Automatic Pronunciation Assessment Leveraging Contrastive Ordinal Regularization
di: Yan, Bi-Cheng, et al.
Pubblicazione: (2024)
di: Yan, Bi-Cheng, et al.
Pubblicazione: (2024)
A Novel Data Augmentation Approach for Automatic Speaking Assessment on Opinion Expressions
di: Wang, Chung-Chun, et al.
Pubblicazione: (2025)
di: Wang, Chung-Chun, et al.
Pubblicazione: (2025)
Zero-Shot Text-to-Speech as Golden Speech Generator: A Systematic Framework and its Applicability in Automatic Pronunciation Assessment
di: Lo, Tien-Hong, et al.
Pubblicazione: (2024)
di: Lo, Tien-Hong, et al.
Pubblicazione: (2024)
A Study on Incorporating Whisper for Robust Speech Assessment
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2023)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2023)
The NTNU System at the S&I Challenge 2025 SLA Open Track
di: Lin, Hong-Yun, et al.
Pubblicazione: (2025)
di: Lin, Hong-Yun, et al.
Pubblicazione: (2025)
Mitigating Data Imbalance in Automated Speaking Assessment
di: Tsai, Fong-Chun, et al.
Pubblicazione: (2025)
di: Tsai, Fong-Chun, et al.
Pubblicazione: (2025)
Comparator Loss: An Ordinal Contrastive Loss to Derive a Severity Score for Speech-based Health Monitoring
di: Webber, Jacob J, et al.
Pubblicazione: (2025)
di: Webber, Jacob J, et al.
Pubblicazione: (2025)
Advancing automatic speech recognition using feature fusion with self-supervised learning features: A case study on Fearless Steps Apollo corpus
di: Chen, Szu-Jui, et al.
Pubblicazione: (2026)
di: Chen, Szu-Jui, et al.
Pubblicazione: (2026)
Deep Learning-based Non-Intrusive Multi-Objective Speech Assessment Model with Cross-Domain Features
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2021)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2021)
Optimizing Automatic Speech Assessment: W-RankSim Regularization and Hybrid Feature Fusion Strategies
di: Wu, Chung-Wen, et al.
Pubblicazione: (2024)
di: Wu, Chung-Wen, et al.
Pubblicazione: (2024)
Speech-Aware Neural Diarization with Encoder-Decoder Attractor Guided by Attention Constraints
di: Lee, PeiYing, et al.
Pubblicazione: (2024)
di: Lee, PeiYing, et al.
Pubblicazione: (2024)
ConSep: a Noise- and Reverberation-Robust Speech Separation Framework by Magnitude Conditioning
di: Ho, Kuan-Hsun, et al.
Pubblicazione: (2024)
di: Ho, Kuan-Hsun, et al.
Pubblicazione: (2024)
What do neural networks listen to? Exploring the crucial bands in Speech Enhancement using Sinc-convolution
di: Ho, Kuan-Hsun, et al.
Pubblicazione: (2024)
di: Ho, Kuan-Hsun, et al.
Pubblicazione: (2024)
Generative Speech Foundation Model Pretraining for High-Quality Speech Extraction and Restoration
di: Ku, Pin-Jui, et al.
Pubblicazione: (2024)
di: Ku, Pin-Jui, et al.
Pubblicazione: (2024)
Universal Preference-Score-based Pairwise Speech Quality Assessment
di: Shi, Yu-Fei, et al.
Pubblicazione: (2025)
di: Shi, Yu-Fei, et al.
Pubblicazione: (2025)
Efficient Dialect-Aware Modeling and Conditioning for Low-Resource Taiwanese Hakka Speech Processing
di: Peng, An-Ci, et al.
Pubblicazione: (2026)
di: Peng, An-Ci, et al.
Pubblicazione: (2026)
Scoring Time Intervals using Non-Hierarchical Transformer For Automatic Piano Transcription
di: Yan, Yujia, et al.
Pubblicazione: (2024)
di: Yan, Yujia, et al.
Pubblicazione: (2024)
Automating Urban Soundscape Enhancements with AI: In-situ Assessment of Quality and Restorativeness in Traffic-Exposed Residential Areas
di: Lam, Bhan, et al.
Pubblicazione: (2024)
di: Lam, Bhan, et al.
Pubblicazione: (2024)
A Study on Zero-shot Non-intrusive Speech Assessment using Large Language Models
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2024)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2024)
Leveraging Mamba with Full-Face Vision for Audio-Visual Speech Enhancement
di: Chao, Rong, et al.
Pubblicazione: (2025)
di: Chao, Rong, et al.
Pubblicazione: (2025)
Probing the Hidden Talent of ASR Foundation Models for L2 English Oral Assessment
di: Chao, Fu-An, et al.
Pubblicazione: (2025)
di: Chao, Fu-An, et al.
Pubblicazione: (2025)
Contextual Biasing for Streaming ASR via CTC-based Word Spotting
di: Tsai, Kai-Chen, et al.
Pubblicazione: (2026)
di: Tsai, Kai-Chen, et al.
Pubblicazione: (2026)
Universal Speech Enhancement with Regression and Generative Mamba
di: Chao, Rong, et al.
Pubblicazione: (2025)
di: Chao, Rong, et al.
Pubblicazione: (2025)
MelodyT5: A Unified Score-to-Score Transformer for Symbolic Music Processing
di: Wu, Shangda, et al.
Pubblicazione: (2024)
di: Wu, Shangda, et al.
Pubblicazione: (2024)
Few-Shot and Pseudo-Label Guided Speech Quality Evaluation with Large Language Models
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2026)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2026)
Rethinking Mean Opinion Scores in Speech Quality Assessment: Aggregation through Quantized Distribution Fitting
di: Kondo, Yuto, et al.
Pubblicazione: (2025)
di: Kondo, Yuto, et al.
Pubblicazione: (2025)
Joint Multi-scale Cross-lingual Speaking Style Transfer with Bidirectional Attention Mechanism for Automatic Dubbing
di: Li, Jingbei, et al.
Pubblicazione: (2023)
di: Li, Jingbei, et al.
Pubblicazione: (2023)
Pushing the Frontiers of Self-Distillation Prototypes Network with Dimension Regularization and Score Normalization
di: Chen, Yafeng, et al.
Pubblicazione: (2025)
di: Chen, Yafeng, et al.
Pubblicazione: (2025)
SoundCollage: Automated Discovery of New Classes in Audio Datasets
di: Choi, Ryuhaerang, et al.
Pubblicazione: (2024)
di: Choi, Ryuhaerang, et al.
Pubblicazione: (2024)
Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition
di: Hu, Cheng-Hung, et al.
Pubblicazione: (2025)
di: Hu, Cheng-Hung, et al.
Pubblicazione: (2025)
Building Tailored Speech Recognizers for Japanese Speaking Assessment
di: Kubo, Yotaro, et al.
Pubblicazione: (2025)
di: Kubo, Yotaro, et al.
Pubblicazione: (2025)
MALEFA: Multi-grAnularity Learning and Effective False Alarm Suppression for Zero-shot Keyword Spotting
di: Li, Lo-Ya, et al.
Pubblicazione: (2026)
di: Li, Lo-Ya, et al.
Pubblicazione: (2026)
Exploiting Consistency-Preserving Loss and Perceptual Contrast Stretching to Boost SSL-based Speech Enhancement
di: Khan, Muhammad Salman, et al.
Pubblicazione: (2024)
di: Khan, Muhammad Salman, et al.
Pubblicazione: (2024)
Speaking from Coarse to Fine: Improving Neural Codec Language Model via Multi-Scale Speech Coding and Generation
di: Guo, Haohan, et al.
Pubblicazione: (2024)
di: Guo, Haohan, et al.
Pubblicazione: (2024)
Restorative Speech Enhancement: A Progressive Approach Using SE and Codec Modules
di: Chiang, Hsin-Tien, et al.
Pubblicazione: (2024)
di: Chiang, Hsin-Tien, et al.
Pubblicazione: (2024)
GenSE: Generative Speech Enhancement via Language Models using Hierarchical Modeling
di: Yao, Jixun, et al.
Pubblicazione: (2025)
di: Yao, Jixun, et al.
Pubblicazione: (2025)
JIS: A Speech Corpus of Japanese Idol Speakers with Various Speaking Styles
di: Kondo, Yuto, et al.
Pubblicazione: (2025)
di: Kondo, Yuto, et al.
Pubblicazione: (2025)
Enhancing Code-Switching ASR Leveraging Non-Peaky CTC Loss and Deep Language Posterior Injection
di: Yang, Tzu-Ting, et al.
Pubblicazione: (2024)
di: Yang, Tzu-Ting, et al.
Pubblicazione: (2024)
Documenti analoghi
-
An Effective Automated Speaking Assessment Approach to Mitigating Data Scarcity and Imbalanced Distribution
di: Lo, Tien-Hong, et al.
Pubblicazione: (2024) -
Advancing Automated Speaking Assessment Leveraging Multifaceted Relevance and Grammar Information
di: Lu, Hao-Chien, et al.
Pubblicazione: (2025) -
ConPCO: Preserving Phoneme Characteristics for Automatic Pronunciation Assessment Leveraging Contrastive Ordinal Regularization
di: Yan, Bi-Cheng, et al.
Pubblicazione: (2024) -
A Novel Data Augmentation Approach for Automatic Speaking Assessment on Opinion Expressions
di: Wang, Chung-Chun, et al.
Pubblicazione: (2025) -
Zero-Shot Text-to-Speech as Golden Speech Generator: A Systematic Framework and its Applicability in Automatic Pronunciation Assessment
di: Lo, Tien-Hong, et al.
Pubblicazione: (2024)