ODAQ: Open Dataset of Audio Quality
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Torcoli, Matteo, Wu, Chih-Wei, Dick, Sascha, Williams, Phillip A., Halimeh, Mhd Modar, Wolcott, William, Habets, Emanuel A. P. |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Expanding and Analyzing ODAQ -- the Open Dataset of Audio Quality
par: Dick, Sascha, et autres
Publié: (2025)
par: Dick, Sascha, et autres
Publié: (2025)
Navigating PESQ: Up-to-Date Versions and Open Implementations
par: Torcoli, Matteo, et autres
Publié: (2025)
par: Torcoli, Matteo, et autres
Publié: (2025)
Investigating the impact of stereo processing -- a study for extending the Open Dataset of Audio Quality (ODAQ)
par: Dick, Sascha, et autres
Publié: (2025)
par: Dick, Sascha, et autres
Publié: (2025)
ConcateNet: Dialogue Separation Using Local And Global Feature Concatenation
par: Halimeh, Mhd Modar, et autres
Publié: (2024)
par: Halimeh, Mhd Modar, et autres
Publié: (2024)
On the Relation Between Speech Quality and Quantized Latent Representations of Neural Codecs
par: Halimeh, Mhd Modar, et autres
Publié: (2025)
par: Halimeh, Mhd Modar, et autres
Publié: (2025)
Acoustic Teleportation via Disentangled Neural Audio Codec Representations
par: Grundhuber, Philipp, et autres
Publié: (2025)
par: Grundhuber, Philipp, et autres
Publié: (2025)
Robust Speech Activity Detection in the Presence of Singing Voice
par: Grundhuber, Philipp, et autres
Publié: (2025)
par: Grundhuber, Philipp, et autres
Publié: (2025)
Speech Loudness in Broadcasting and Streaming
par: Torcoli, Matteo, et autres
Publié: (2024)
par: Torcoli, Matteo, et autres
Publié: (2024)
Exploring Perceptual Audio Quality Measurement on Stereo Processing Using the Open Dataset of Audio Quality
par: Delgado, Pablo M., et autres
Publié: (2025)
par: Delgado, Pablo M., et autres
Publié: (2025)
Neural Directional Filtering Using a Compact Microphone Array
par: Huang, Weilong, et autres
Publié: (2025)
par: Huang, Weilong, et autres
Publié: (2025)
Neural Directional Filtering: Far-Field Directivity Control With a Small Microphone Array
par: Wechsler, Julian, et autres
Publié: (2024)
par: Wechsler, Julian, et autres
Publié: (2024)
Sample Rate Offset Compensated Acoustic Echo Cancellation For Multi-Device Scenarios
par: Korse, Srikanth, et autres
Publié: (2025)
par: Korse, Srikanth, et autres
Publié: (2025)
A Generalized Bandsplit Neural Network for Cinematic Audio Source Separation
par: Watcharasupat, Karn N., et autres
Publié: (2023)
par: Watcharasupat, Karn N., et autres
Publié: (2023)
Leveraging Discriminative Latent Representations for Conditioning GAN-Based Speech Enhancement
par: Shetu, Shrishti Saha, et autres
Publié: (2025)
par: Shetu, Shrishti Saha, et autres
Publié: (2025)
Neural Directional Filtering with Configurable Directivity Pattern at Inference
par: Huang, Weilong, et autres
Publié: (2025)
par: Huang, Weilong, et autres
Publié: (2025)
GAN-Based Multi-Microphone Spatial Target Speaker Extraction
par: Shetu, Shrishti Saha, et autres
Publié: (2025)
par: Shetu, Shrishti Saha, et autres
Publié: (2025)
Dynamic Slimmable Networks for Efficient Speech Separation
par: Elminshawi, Mohamed, et autres
Publié: (2025)
par: Elminshawi, Mohamed, et autres
Publié: (2025)
Stereo Reproduction in the Presence of Sample Rate Offsets
par: Korse, Srikanth, et autres
Publié: (2025)
par: Korse, Srikanth, et autres
Publié: (2025)
Low-Complexity Neural Wind Noise Reduction for Audio Recordings
par: Eftekhari, Hesam, et autres
Publié: (2025)
par: Eftekhari, Hesam, et autres
Publié: (2025)
VoxATtack: A Multimodal Attack on Voice Anonymization Systems
par: Aloradi, Ahmad, et autres
Publié: (2025)
par: Aloradi, Ahmad, et autres
Publié: (2025)
Room Impulse Response Completion Using Signal-Prediction Diffusion Models Conditioned on Simulated Early Reflections
par: Xu, Zeyu, et autres
Publié: (2026)
par: Xu, Zeyu, et autres
Publié: (2026)
Training Strategies for Modality Dropout Resilient Multi-Modal Target Speaker Extraction
par: Korse, Srikanth, et autres
Publié: (2025)
par: Korse, Srikanth, et autres
Publié: (2025)
Comparative Analysis Of Discriminative Deep Learning-Based Noise Reduction Methods In Low SNR Scenarios
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
Blind Acoustic Parameter Estimation Through Task-Agnostic Embeddings Using Latent Approximations
par: Götz, Philipp, et autres
Publié: (2024)
par: Götz, Philipp, et autres
Publié: (2024)
NDF+: Joint Neural Directional Filtering and Diffuse Sound Extraction
par: Huang, Weilong, et autres
Publié: (2026)
par: Huang, Weilong, et autres
Publié: (2026)
GAN-Based Speech Enhancement for Low SNR Using Latent Feature Conditioning
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
Low-Resource Text-to-Speech Synthesis Using Noise-Augmented Training of ForwardTacotron
par: Lakshminarayana, Kishor Kayyar, et autres
Publié: (2025)
par: Lakshminarayana, Kishor Kayyar, et autres
Publié: (2025)
Data-driven Joint Detection and Localization of Acoustic Reflectors
par: Bicer, H. Nazim, et autres
Publié: (2024)
par: Bicer, H. Nazim, et autres
Publié: (2024)
Matching Reverberant Speech Through Learned Acoustic Embeddings and Feedback Delay Networks
par: Götz, Philipp, et autres
Publié: (2025)
par: Götz, Philipp, et autres
Publié: (2025)
Benchmarking Neural Speech Codec Intelligibility with SITool
par: Leschanowsky, Anna, et autres
Publié: (2025)
par: Leschanowsky, Anna, et autres
Publié: (2025)
Align-ULCNet: Towards Low-Complexity and Robust Acoustic Echo and Noise Reduction
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
A Hybrid Approach for Low-Complexity Joint Acoustic Echo and Noise Reduction
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
AudioSetCaps: An Enriched Audio-Caption Dataset using Automated Generation Pipeline with Large Audio and Language Models
par: Bai, Jisheng, et autres
Publié: (2024)
par: Bai, Jisheng, et autres
Publié: (2024)
On the Language and Gender Biases in PSTN, VoIP and Neural Audio Codecs
par: Altwlkany, Kemal, et autres
Publié: (2025)
par: Altwlkany, Kemal, et autres
Publié: (2025)
PAM: Prompting Audio-Language Models for Audio Quality Assessment
par: Deshmukh, Soham, et autres
Publié: (2024)
par: Deshmukh, Soham, et autres
Publié: (2024)
MLAAD: The Multi-Language Audio Anti-Spoofing Dataset
par: Müller, Nicolas M., et autres
Publié: (2024)
par: Müller, Nicolas M., et autres
Publié: (2024)
VoxEffects: A Speech-Oriented Audio Effects Dataset and Benchmark
par: Zhang, Zhe, et autres
Publié: (2026)
par: Zhang, Zhe, et autres
Publié: (2026)
FLAMO: An Open-Source Library for Frequency-Domain Differentiable Audio Processing
par: Santo, Gloria Dal, et autres
Publié: (2024)
par: Santo, Gloria Dal, et autres
Publié: (2024)
You Are What You Say: Exploiting Linguistic Content for VoicePrivacy Attacks
par: Gaznepoglu, Ünal Ege, et autres
Publié: (2025)
par: Gaznepoglu, Ünal Ege, et autres
Publié: (2025)
ASPED: An Audio Dataset for Detecting Pedestrians
par: Seshadri, Pavan, et autres
Publié: (2023)
par: Seshadri, Pavan, et autres
Publié: (2023)
Documents similaires
-
Expanding and Analyzing ODAQ -- the Open Dataset of Audio Quality
par: Dick, Sascha, et autres
Publié: (2025) -
Navigating PESQ: Up-to-Date Versions and Open Implementations
par: Torcoli, Matteo, et autres
Publié: (2025) -
Investigating the impact of stereo processing -- a study for extending the Open Dataset of Audio Quality (ODAQ)
par: Dick, Sascha, et autres
Publié: (2025) -
ConcateNet: Dialogue Separation Using Local And Global Feature Concatenation
par: Halimeh, Mhd Modar, et autres
Publié: (2024) -
On the Relation Between Speech Quality and Quantized Latent Representations of Neural Codecs
par: Halimeh, Mhd Modar, et autres
Publié: (2025)