Rho-Perfect: Correlation Ceiling For Subjective Evaluation Datasets
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Cumlin, Fredrik |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SA-SSL-MOS: Self-supervised Learning MOS Prediction with Spectral Augmentation for Generalized Multi-Rate Speech Assessment
par: Cao, Fengyuan, et autres
Publié: (2026)
par: Cao, Fengyuan, et autres
Publié: (2026)
Leveraging LLMs for Scalable Non-intrusive Speech Quality Assessment
par: Cumlin, Fredrik, et autres
Publié: (2025)
par: Cumlin, Fredrik, et autres
Publié: (2025)
Impairments are Clustered in Latents of Deep Neural Network-based Speech Quality Models
par: Cumlin, Fredrik, et autres
Publié: (2025)
par: Cumlin, Fredrik, et autres
Publié: (2025)
Multivariate Probabilistic Assessment of Speech Quality
par: Cumlin, Fredrik, et autres
Publié: (2025)
par: Cumlin, Fredrik, et autres
Publié: (2025)
Selection of Layers from Self-supervised Learning Models for Predicting Mean-Opinion-Score of Speech
par: Liang, Xinyu, et autres
Publié: (2025)
par: Liang, Xinyu, et autres
Publié: (2025)
Decoding Stimulus Reconstruction-Based Auditory Attention Robustly in Unbalanced EEG Datasets
par: Zhang, Yuanming, et autres
Publié: (2026)
par: Zhang, Yuanming, et autres
Publié: (2026)
Vibravox: A Dataset of French Speech Captured with Body-conduction Audio Sensors
par: Hauret, Julien, et autres
Publié: (2024)
par: Hauret, Julien, et autres
Publié: (2024)
Multilingual Dataset Integration Strategies for Robust Audio Deepfake Detection: A SAFE Challenge System
par: Ali, Hashim, et autres
Publié: (2025)
par: Ali, Hashim, et autres
Publié: (2025)
Efficient Evaluation of Quantization-Effects in Neural Codecs
par: Mack, Wolfgang, et autres
Publié: (2025)
par: Mack, Wolfgang, et autres
Publié: (2025)
The iNaturalist Sounds Dataset
par: Chasmai, Mustafa, et autres
Publié: (2025)
par: Chasmai, Mustafa, et autres
Publié: (2025)
Improving the Speaker Anonymization Evaluation's Robustness to Target Speakers with Adversarial Learning
par: Franzreb, Carlos, et autres
Publié: (2025)
par: Franzreb, Carlos, et autres
Publié: (2025)
Multiview Canonical Correlation Analysis for Automatic Pathological Speech Detection
par: Kaloga, Yacouba, et autres
Publié: (2024)
par: Kaloga, Yacouba, et autres
Publié: (2024)
Beyond the Labels: Unveiling Text-Dependency in Paralinguistic Speech Recognition Datasets
par: Pešán, Jan, et autres
Publié: (2024)
par: Pešán, Jan, et autres
Publié: (2024)
Conditional Generative Data Augmentation for Clinical Audio Datasets
par: Seibold, Matthias, et autres
Publié: (2022)
par: Seibold, Matthias, et autres
Publié: (2022)
PBSCR: The Piano Bootleg Score Composer Recognition Dataset
par: Jain, Arhan, et autres
Publié: (2024)
par: Jain, Arhan, et autres
Publié: (2024)
SynthSOD: Developing an Heterogeneous Dataset for Orchestra Music Source Separation
par: Garcia-Martinez, Jaime, et autres
Publié: (2024)
par: Garcia-Martinez, Jaime, et autres
Publié: (2024)
EARS: An Anechoic Fullband Speech Dataset Benchmarked for Speech Enhancement and Dereverberation
par: Richter, Julius, et autres
Publié: (2024)
par: Richter, Julius, et autres
Publié: (2024)
Analysis-Driven Procedural Generation of an Engine Sound Dataset with Embedded Control Annotations
par: Doerfler, Robin, et autres
Publié: (2026)
par: Doerfler, Robin, et autres
Publié: (2026)
The 2025 PNPL Competition: Speech Detection and Phoneme Classification in the LibriBrain Dataset
par: Landau, Gilad, et autres
Publié: (2025)
par: Landau, Gilad, et autres
Publié: (2025)
The Spheres Dataset: Multitrack Orchestral Recordings for Music Source Separation and Information Retrieval
par: Garcia-Martinez, Jaime, et autres
Publié: (2025)
par: Garcia-Martinez, Jaime, et autres
Publié: (2025)
Development of Large Annotated Music Datasets using HMM-based Forced Viterbi Alignment
par: Joysingh, S. Johanan, et autres
Publié: (2024)
par: Joysingh, S. Johanan, et autres
Publié: (2024)
Systematic FAIRness Assessment of Open Voice Biomarker Datasets for Mental Health and Neurodegenerative Diseases
par: Mahapatra, Ishaan, et autres
Publié: (2025)
par: Mahapatra, Ishaan, et autres
Publié: (2025)
NaturalVoices: A Large-Scale, Spontaneous and Emotional Podcast Dataset for Voice Conversion
par: Du, Zongyang, et autres
Publié: (2025)
par: Du, Zongyang, et autres
Publié: (2025)
Audio2Tool: Speak, Call, Act -- A Dataset for Benchmarking Speech Tool Use
par: Pahwa, Ramit, et autres
Publié: (2026)
par: Pahwa, Ramit, et autres
Publié: (2026)
MB-RIRs: a Synthetic Room Impulse Response Dataset with Frequency-Dependent Absorption Coefficients
par: Gusó, Enric, et autres
Publié: (2025)
par: Gusó, Enric, et autres
Publié: (2025)
Automatic Identification of Samples in Hip-Hop Music via Multi-Loss Training and an Artificial Dataset
par: Cheston, Huw, et autres
Publié: (2025)
par: Cheston, Huw, et autres
Publié: (2025)
JAZZVAR: A Dataset of Variations found within Solo Piano Performances of Jazz Standards for Music Overpainting
par: Row, Eleanor, et autres
Publié: (2023)
par: Row, Eleanor, et autres
Publié: (2023)
Evaluating Disentangled Representations for Controllable Music Generation
par: Ibáñez-Martínez, Laura, et autres
Publié: (2026)
par: Ibáñez-Martínez, Laura, et autres
Publié: (2026)
Evaluation of Neural Surrogates for Physical Modelling Synthesis of Nonlinear Elastic Plates
par: Martin, Carlos De La Vega, et autres
Publié: (2025)
par: Martin, Carlos De La Vega, et autres
Publié: (2025)
Evaluating Echo State Network for Parkinson's Disease Prediction using Voice Features
par: Hosseininian, Seyedeh Zahra Seyedi, et autres
Publié: (2024)
par: Hosseininian, Seyedeh Zahra Seyedi, et autres
Publié: (2024)
Objective Evaluation of Prosody and Intelligibility in Speech Synthesis via Conditional Prediction of Discrete Tokens
par: Ulgen, Ismail Rasim, et autres
Publié: (2025)
par: Ulgen, Ismail Rasim, et autres
Publié: (2025)
Evaluation of Speech Foundation Models for ASR on Child-Adult Conversations in Autism Diagnostic Sessions
par: Ashvin, Aditya, et autres
Publié: (2024)
par: Ashvin, Aditya, et autres
Publié: (2024)
A Comparative Evaluation of Deep Learning Models for Speech Enhancement in Real-World Noisy Environments
par: Khondkar, Md Jahangir Alam, et autres
Publié: (2025)
par: Khondkar, Md Jahangir Alam, et autres
Publié: (2025)
Bringing the Discussion of Minima Sharpness to the Audio Domain: a Filter-Normalised Evaluation for Acoustic Scene Classification
par: Milling, Manuel, et autres
Publié: (2023)
par: Milling, Manuel, et autres
Publié: (2023)
Multimodal Dataset Normalization and Perceptual Validation for Music-Taste Correspondences
par: Spanio, Matteo, et autres
Publié: (2026)
par: Spanio, Matteo, et autres
Publié: (2026)
EmergentTTS-Eval: Evaluating TTS Models on Complex Prosodic, Expressiveness, and Linguistic Challenges Using Model-as-a-Judge
par: Manku, Ruskin Raj, et autres
Publié: (2025)
par: Manku, Ruskin Raj, et autres
Publié: (2025)
CHORDONOMICON: A Dataset of 666,000 Songs and their Chord Progressions
par: Kantarelis, Spyridon, et autres
Publié: (2024)
par: Kantarelis, Spyridon, et autres
Publié: (2024)
Bias and Fairness in Self-Supervised Acoustic Representations for Cognitive Impairment Detection
par: Gulzar, Kashaf, et autres
Publié: (2026)
par: Gulzar, Kashaf, et autres
Publié: (2026)
Prompt Amplification and Zero-Shot Late Fusion in Audio-Language Models for Speech Emotion Recognition
par: Kataria, Saurabh, et autres
Publié: (2026)
par: Kataria, Saurabh, et autres
Publié: (2026)
Zero-Shot Imagined Speech Decoding via Imagined-to-Listened MEG Mapping
par: Maghsoudi, Maryam, et autres
Publié: (2026)
par: Maghsoudi, Maryam, et autres
Publié: (2026)
Documents similaires
-
SA-SSL-MOS: Self-supervised Learning MOS Prediction with Spectral Augmentation for Generalized Multi-Rate Speech Assessment
par: Cao, Fengyuan, et autres
Publié: (2026) -
Leveraging LLMs for Scalable Non-intrusive Speech Quality Assessment
par: Cumlin, Fredrik, et autres
Publié: (2025) -
Impairments are Clustered in Latents of Deep Neural Network-based Speech Quality Models
par: Cumlin, Fredrik, et autres
Publié: (2025) -
Multivariate Probabilistic Assessment of Speech Quality
par: Cumlin, Fredrik, et autres
Publié: (2025) -
Selection of Layers from Self-supervised Learning Models for Predicting Mean-Opinion-Score of Speech
par: Liang, Xinyu, et autres
Publié: (2025)