Z-Scores: A Metric for Linguistically Assessing Disfluency Removal
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Teleki, Maria, Janjur, Sai, Liu, Haoran, Grabner, Oliver, Verma, Ketan, Docog, Thomas, Dong, Xiangjue, Shi, Lingfeng, Wang, Cong, Birkelbach, Stephanie, Kim, Jason, Zhang, Yin, Caverlee, James |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Conversational Speech Reveals Structural Robustness Failures in SpeechLLM Backbones
par: Teleki, Maria, et autres
Publié: (2025)
par: Teleki, Maria, et autres
Publié: (2025)
Typical vs. Atypical Disfluency Classification: Introducing the IIITH-TISA Corpus and Temporal Context-Based Feature Representations
par: Kommagouni, Priyanka, et autres
Publié: (2024)
par: Kommagouni, Priyanka, et autres
Publié: (2024)
DisfluencySpeech -- Single-Speaker Conversational Speech Dataset with Paralanguage
par: Wang, Kyra, et autres
Publié: (2024)
par: Wang, Kyra, et autres
Publié: (2024)
The Voice Behind the Words: Quantifying Intersectional Bias in SpeechLLMs
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2026)
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2026)
Automatic Speech Recognition for Non-Native English: Accuracy and Disfluency Handling
par: McGuire, Michael
Publié: (2025)
par: McGuire, Michael
Publié: (2025)
Missingness-resilient Video-enhanced Multimodal Disfluency Detection
par: Mohapatra, Payal, et autres
Publié: (2024)
par: Mohapatra, Payal, et autres
Publié: (2024)
Full-Duplex-Bench-v3: Benchmarking Tool Use for Full-Duplex Voice Agents Under Real-World Disfluency
par: Lin, Guan-Ting, et autres
Publié: (2026)
par: Lin, Guan-Ting, et autres
Publié: (2026)
AURA Score: A Metric For Holistic Audio Question Answering Evaluation
par: Dixit, Satvik, et autres
Publié: (2025)
par: Dixit, Satvik, et autres
Publié: (2025)
Toward a Reinforcement-Learning-Based System for Adjusting Medication to Minimize Speech Disfluency
par: Constas, Pavlos, et autres
Publié: (2023)
par: Constas, Pavlos, et autres
Publié: (2023)
Smooth Operators: LLMs Translating Imperfect Hints into Disfluency-Rich Transcripts
par: Altinok, Duygu
Publié: (2025)
par: Altinok, Duygu
Publié: (2025)
A Study of the Removability of Speaker-Adversarial Perturbations
par: Chen, Liping, et autres
Publié: (2025)
par: Chen, Liping, et autres
Publié: (2025)
Similarity Metrics For Late Reverberation
par: Santo, Gloria Dal, et autres
Publié: (2024)
par: Santo, Gloria Dal, et autres
Publié: (2024)
Layer-Aware Early Fusion of Acoustic and Linguistic Embeddings for Cognitive Status Classification
par: Novotny, Krystof, et autres
Publié: (2026)
par: Novotny, Krystof, et autres
Publié: (2026)
Toward Objective and Interpretable Prosody Evaluation in Text-to-Speech: A Linguistically Motivated Approach
par: Chan, Cedric, et autres
Publié: (2025)
par: Chan, Cedric, et autres
Publié: (2025)
ScoreDec: A Phase-preserving High-Fidelity Audio Codec with A Generalized Score-based Diffusion Post-filter
par: Wu, Yi-Chiao, et autres
Publié: (2024)
par: Wu, Yi-Chiao, et autres
Publié: (2024)
Zimtohrli: An Efficient Psychoacoustic Audio Similarity Metric
par: Alakuijala, Jyrki, et autres
Publié: (2025)
par: Alakuijala, Jyrki, et autres
Publié: (2025)
The Extended SONICOM HRTF Dataset and Spatial Audio Metrics Toolbox
par: Poole, Katarina C., et autres
Publié: (2025)
par: Poole, Katarina C., et autres
Publié: (2025)
Trainable Adaptive Score Normalization for Automatic Speaker Verification
par: Choi, Jeong-Hwan, et autres
Publié: (2025)
par: Choi, Jeong-Hwan, et autres
Publié: (2025)
Validating Computational Markers of Depressive Behavior: Cross-Linguistic Speech-Based Depression Detection with Neurophysiological Validation
par: Tao, Fuxiang, et autres
Publié: (2026)
par: Tao, Fuxiang, et autres
Publié: (2026)
Classification of Autistic and Non-Autistic Children's Speech: A Cross-Linguistic Study in Finnish, French, and Slovak
par: Kakouros, Sofoklis, et autres
Publié: (2026)
par: Kakouros, Sofoklis, et autres
Publié: (2026)
Reducing Linguistic Hallucination in LM-Based Speech Enhancement via Noise-Invariant Acoustic-Semantic Distillation
par: Wang, Zheng, et autres
Publié: (2026)
par: Wang, Zheng, et autres
Publié: (2026)
Dynamically Slimmable Speech Enhancement Network with Metric-Guided Training
par: Zhao, Haixin, et autres
Publié: (2025)
par: Zhao, Haixin, et autres
Publié: (2025)
Bias in the Ear of the Listener: Assessing Sensitivity in Audio Language Models Across Linguistic, Demographic, and Positional Variations
par: Wei, Sheng-Lun, et autres
Publié: (2026)
par: Wei, Sheng-Lun, et autres
Publié: (2026)
MelodyT5: A Unified Score-to-Score Transformer for Symbolic Music Processing
par: Wu, Shangda, et autres
Publié: (2024)
par: Wu, Shangda, et autres
Publié: (2024)
Comparator Loss: An Ordinal Contrastive Loss to Derive a Severity Score for Speech-based Health Monitoring
par: Webber, Jacob J, et autres
Publié: (2025)
par: Webber, Jacob J, et autres
Publié: (2025)
Benchmarking Humans and Machines on Complex Multilingual Speech Understanding Tasks
par: Kankanala, Sai Samrat, et autres
Publié: (2025)
par: Kankanala, Sai Samrat, et autres
Publié: (2025)
Electrolaryngeal Speech Intelligibility Enhancement Through Robust Linguistic Encoders
par: Violeta, Lester Phillip, et autres
Publié: (2023)
par: Violeta, Lester Phillip, et autres
Publié: (2023)
ALDAS: Audio-Linguistic Data Augmentation for Spoofed Audio Detection
par: Khanjani, Zahra, et autres
Publié: (2024)
par: Khanjani, Zahra, et autres
Publié: (2024)
Investigating the Potential of Multi-Stage Score Fusion in Spoofing-Aware Speaker Verification
par: Kurnaz, Oguzhan, et autres
Publié: (2025)
par: Kurnaz, Oguzhan, et autres
Publié: (2025)
Towards Reliable Objective Evaluation Metrics for Generative Singing Voice Separation Models
par: Bereuter, Paul A., et autres
Publié: (2025)
par: Bereuter, Paul A., et autres
Publié: (2025)
DMOSpeech 2: Reinforcement Learning for Duration Prediction in Metric-Optimized Speech Synthesis
par: Li, Yinghao Aaron, et autres
Publié: (2025)
par: Li, Yinghao Aaron, et autres
Publié: (2025)
Musical Source Separation Bake-Off: Comparing Objective Metrics with Human Perception
par: Jaffe, Noah, et autres
Publié: (2025)
par: Jaffe, Noah, et autres
Publié: (2025)
Beyond Global Metrics: A Fairness Analysis for Interpretable Voice Disorder Detection Systems
par: Estevez, Mariel, et autres
Publié: (2025)
par: Estevez, Mariel, et autres
Publié: (2025)
Measuring Prosody Diversity in Zero-Shot TTS: A New Metric, Benchmark, and Exploration
par: Yang, Yifan, et autres
Publié: (2025)
par: Yang, Yifan, et autres
Publié: (2025)
Assessing the Impact of Noise and Speech Enhancement on the Intelligibility of Speech Codecs
par: Behringer, Lyonel, et autres
Publié: (2026)
par: Behringer, Lyonel, et autres
Publié: (2026)
ATMM-SAGA: Alternating Training for Multi-Module with Score-Aware Gated Attention SASV system
par: Asali, Amro, et autres
Publié: (2025)
par: Asali, Amro, et autres
Publié: (2025)
Transient Noise Removal via Diffusion-based Speech Inpainting
par: Moradi, Mordehay, et autres
Publié: (2025)
par: Moradi, Mordehay, et autres
Publié: (2025)
DeePAQ: A Perceptual Audio Quality Metric Based On Foundational Models and Weakly Supervised Learning
par: Jiang, Guanxin, et autres
Publié: (2025)
par: Jiang, Guanxin, et autres
Publié: (2025)
Performance of Objective Speech Quality Metrics on Languages Beyond Validation Data: A Study of Turkish and Korean
par: Perez, Javier, et autres
Publié: (2025)
par: Perez, Javier, et autres
Publié: (2025)
Linguistic Knowledge Transfer Learning for Speech Enhancement
par: Hung, Kuo-Hsuan, et autres
Publié: (2025)
par: Hung, Kuo-Hsuan, et autres
Publié: (2025)
Documents similaires
-
Conversational Speech Reveals Structural Robustness Failures in SpeechLLM Backbones
par: Teleki, Maria, et autres
Publié: (2025) -
Typical vs. Atypical Disfluency Classification: Introducing the IIITH-TISA Corpus and Temporal Context-Based Feature Representations
par: Kommagouni, Priyanka, et autres
Publié: (2024) -
DisfluencySpeech -- Single-Speaker Conversational Speech Dataset with Paralanguage
par: Wang, Kyra, et autres
Publié: (2024) -
The Voice Behind the Words: Quantifying Intersectional Bias in SpeechLLMs
par: Satish, Shree Harsha Bokkahalli, et autres
Publié: (2026) -
Automatic Speech Recognition for Non-Native English: Accuracy and Disfluency Handling
par: McGuire, Michael
Publié: (2025)