BWSNet: Automatic Perceptual Assessment of Audio Signals
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Veillon, Clément Le Moine, Rosi, Victor, Sarah, Pablo Arias, Salais, Léane, Obin, Nicolas |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploring Perceptual Audio Quality Measurement on Stereo Processing Using the Open Dataset of Audio Quality
par: Delgado, Pablo M., et autres
Publié: (2025)
par: Delgado, Pablo M., et autres
Publié: (2025)
NOMAD: Unsupervised Learning of Perceptual Embeddings for Speech Enhancement and Non-matching Reference Audio Quality Assessment
par: Ragano, Alessandro, et autres
Publié: (2023)
par: Ragano, Alessandro, et autres
Publié: (2023)
Towards Improved Objective Perceptual Audio Quality Assessment -- Part 1: A Novel Data-Driven Cognitive Model
par: Delgado, Pablo M., et autres
Publié: (2024)
par: Delgado, Pablo M., et autres
Publié: (2024)
Fast-VGAN: Lightweight Voice Conversion with Explicit Control of F0 and Duration Parameters
par: Abrassart, Mathilde, et autres
Publié: (2025)
par: Abrassart, Mathilde, et autres
Publié: (2025)
Small-E: Small Language Model with Linear Attention for Efficient Speech Synthesis
par: Lemerle, Théodor, et autres
Publié: (2024)
par: Lemerle, Théodor, et autres
Publié: (2024)
VR-PTOLEMAIC: A Virtual Environment for the Perceptual Testing of Spatial Audio Algorithms
par: Ostan, Paolo, et autres
Publié: (2025)
par: Ostan, Paolo, et autres
Publié: (2025)
MAPSS: Manifold-based Assessment of Perceptual Source Separation
par: Ivry, Amir, et autres
Publié: (2025)
par: Ivry, Amir, et autres
Publié: (2025)
dCoNNear: An Artifact-Free Neural Network Architecture for Closed-loop Audio Signal Processing
par: Wen, Chuan, et autres
Publié: (2025)
par: Wen, Chuan, et autres
Publié: (2025)
AudioEval: Automatic Dual-Perspective and Multi-Dimensional Evaluation of Text-to-Audio-Generation
par: Wang, Hui, et autres
Publié: (2025)
par: Wang, Hui, et autres
Publié: (2025)
Lina-Speech: Gated Linear Attention and Initial-State Tuning for Multi-Sample Prompting Text-To-Speech Synthesis
par: Lemerle, Théodor, et autres
Publié: (2024)
par: Lemerle, Théodor, et autres
Publié: (2024)
PAM: Prompting Audio-Language Models for Audio Quality Assessment
par: Deshmukh, Soham, et autres
Publié: (2024)
par: Deshmukh, Soham, et autres
Publié: (2024)
Improving Perceptual Audio Aesthetic Assessment via Triplet Loss and Self-Supervised Embeddings
par: Wisnu, Dyah A. M. G., et autres
Publié: (2025)
par: Wisnu, Dyah A. M. G., et autres
Publié: (2025)
Perceptual Musical Features for Interpretable Audio Tagging
par: Lyberatos, Vassilis, et autres
Publié: (2023)
par: Lyberatos, Vassilis, et autres
Publié: (2023)
DiveSound: LLM-Assisted Automatic Taxonomy Construction for Diverse Audio Generation
par: Li, Baihan, et autres
Publié: (2024)
par: Li, Baihan, et autres
Publié: (2024)
A Practical Guide to Spectrogram Analysis for Audio Signal Processing
par: Khodzhaev, Zulfidin
Publié: (2024)
par: Khodzhaev, Zulfidin
Publié: (2024)
SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation
par: Kumar, Sonal, et autres
Publié: (2024)
par: Kumar, Sonal, et autres
Publié: (2024)
A Dataset for Automatic Assessment of TTS Quality in Spanish
par: Welford, Alejandro Sosa, et autres
Publié: (2025)
par: Welford, Alejandro Sosa, et autres
Publié: (2025)
Automatic acoustic detection of birds through deep learning: the first Bird Audio Detection challenge
par: Stowell, Dan, et autres
Publié: (2018)
par: Stowell, Dan, et autres
Publié: (2018)
Point to the Hidden: Exposing Speech Audio Splicing via Signal Pointer Nets
par: Moussa, Denise, et autres
Publié: (2023)
par: Moussa, Denise, et autres
Publié: (2023)
HearFit+: Personalized Fitness Monitoring via Audio Signals on Smart Speakers
par: Xie, Yadong, et autres
Publié: (2025)
par: Xie, Yadong, et autres
Publié: (2025)
Example-Based Framework for Perceptually Guided Audio Texture Generation
par: Kamath, Purnima, et autres
Publié: (2023)
par: Kamath, Purnima, et autres
Publié: (2023)
Audiosockets: A Python socket package for Real-Time Audio Processing
par: Shu, Nicolas, et autres
Publié: (2024)
par: Shu, Nicolas, et autres
Publié: (2024)
Audio Palette: A Diffusion Transformer with Multi-Signal Conditioning for Controllable Foley Synthesis
par: Wang, Junnuo
Publié: (2025)
par: Wang, Junnuo
Publié: (2025)
Towards Automatic Assessment of Self-Supervised Speech Models using Rank
par: Aldeneh, Zakaria, et autres
Publié: (2024)
par: Aldeneh, Zakaria, et autres
Publié: (2024)
A Frequency-aware Augmentation Network for Mental Disorders Assessment from Audio
par: Li, Shuanglin, et autres
Publié: (2025)
par: Li, Shuanglin, et autres
Publié: (2025)
Sketch2Sound: Controllable Audio Generation via Time-Varying Signals and Sonic Imitations
par: García, Hugo Flores, et autres
Publié: (2024)
par: García, Hugo Flores, et autres
Publié: (2024)
Learning to Solve Inverse Problems for Perceptual Sound Matching
par: Han, Han, et autres
Publié: (2023)
par: Han, Han, et autres
Publié: (2023)
Perceptually Transparent Binaural Auralization of Simulated Sound Fields
par: Ahrens, Jens
Publié: (2024)
par: Ahrens, Jens
Publié: (2024)
Speech Synthesis along Perceptual Voice Quality Dimensions
par: Rautenberg, Frederik, et autres
Publié: (2025)
par: Rautenberg, Frederik, et autres
Publié: (2025)
Hallucination in Perceptual Metric-Driven Speech Enhancement Networks
par: Close, George, et autres
Publié: (2024)
par: Close, George, et autres
Publié: (2024)
Echoes of Ideology: Toward an Audio Analysis Pipeline to Unveil Character Traits in Historical Nazi Propaganda Films
par: Ruth, Nicolas, et autres
Publié: (2026)
par: Ruth, Nicolas, et autres
Publié: (2026)
A Survey on 30+ Years of Automatic Singing Assessment and Singing Information Processing
par: Santos, Arthur N. dos, et autres
Publié: (2026)
par: Santos, Arthur N. dos, et autres
Publié: (2026)
Do Joint Language-Audio Embeddings Encode Perceptual Timbre Semantics?
par: Deng, Qixin, et autres
Publié: (2025)
par: Deng, Qixin, et autres
Publié: (2025)
Continuous Learning of Transformer-based Audio Deepfake Detection
par: Le, Tuan Duy Nguyen, et autres
Publié: (2024)
par: Le, Tuan Duy Nguyen, et autres
Publié: (2024)
Multimodal Assessment of Speech Impairment in ALS Using Audio-Visual and Machine Learning Approaches
par: Pierotti, Francesco, et autres
Publié: (2025)
par: Pierotti, Francesco, et autres
Publié: (2025)
Automatic Contextual Audio Denoising
par: Luong, Diep, et autres
Publié: (2026)
par: Luong, Diep, et autres
Publié: (2026)
IQRA 2026: Interspeech Challenge on Automatic Pronunciation Assessment for Modern Standard Arabic (MSA)
par: Kheir, Yassine El, et autres
Publié: (2026)
par: Kheir, Yassine El, et autres
Publié: (2026)
Improving Audio Captioning Models with Fine-grained Audio Features, Text Embedding Supervision, and LLM Mix-up Augmentation
par: Wu, Shih-Lun, et autres
Publié: (2023)
par: Wu, Shih-Lun, et autres
Publié: (2023)
Toward Multimodal Industrial Fault Analysis: A Single-Speed Chain Conveyor Dataset with Audio and Vibration Signals
par: Chen, Zhang, et autres
Publié: (2026)
par: Chen, Zhang, et autres
Publié: (2026)
Self-Supervised Multi-View Learning for Disentangled Music Audio Representations
par: Wilkins, Julia, et autres
Publié: (2024)
par: Wilkins, Julia, et autres
Publié: (2024)
Documents similaires
-
Exploring Perceptual Audio Quality Measurement on Stereo Processing Using the Open Dataset of Audio Quality
par: Delgado, Pablo M., et autres
Publié: (2025) -
NOMAD: Unsupervised Learning of Perceptual Embeddings for Speech Enhancement and Non-matching Reference Audio Quality Assessment
par: Ragano, Alessandro, et autres
Publié: (2023) -
Towards Improved Objective Perceptual Audio Quality Assessment -- Part 1: A Novel Data-Driven Cognitive Model
par: Delgado, Pablo M., et autres
Publié: (2024) -
Fast-VGAN: Lightweight Voice Conversion with Explicit Control of F0 and Duration Parameters
par: Abrassart, Mathilde, et autres
Publié: (2025) -
Small-E: Small Language Model with Linear Attention for Efficient Speech Synthesis
par: Lemerle, Théodor, et autres
Publié: (2024)