OpenACE: An Open Benchmark for Evaluating Audio Coding Performance
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Coldenhoff, Jozef, Granqvist, Niclas, Cernak, Milos |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Semi-intrusive audio evaluation: Casting non-intrusive assessment as a multi-modal text prediction task
par: Coldenhoff, Jozef, et autres
Publié: (2024)
par: Coldenhoff, Jozef, et autres
Publié: (2024)
Multi-Channel MOSRA: Mean Opinion Score and Room Acoustics Estimation Using Simulated Data and a Teacher Model
par: Coldenhoff, Jozef, et autres
Publié: (2023)
par: Coldenhoff, Jozef, et autres
Publié: (2023)
Differentiable Time-Varying IIR Filtering for Real-Time Speech Denoising
par: Rota, Riccardo, et autres
Publié: (2026)
par: Rota, Riccardo, et autres
Publié: (2026)
Zimtohrli: An Efficient Psychoacoustic Audio Similarity Metric
par: Alakuijala, Jyrki, et autres
Publié: (2025)
par: Alakuijala, Jyrki, et autres
Publié: (2025)
Diffusion-based Speech Enhancement with Schrödinger Bridge and Symmetric Noise Schedule
par: Wang, Siyi, et autres
Publié: (2024)
par: Wang, Siyi, et autres
Publié: (2024)
OpenBEATs: A Fully Open-Source General-Purpose Audio Encoder
par: Bharadwaj, Shikhar, et autres
Publié: (2025)
par: Bharadwaj, Shikhar, et autres
Publié: (2025)
Open-Set Source Tracing of Audio Deepfake Systems
par: Klein, Nicholas, et autres
Publié: (2025)
par: Klein, Nicholas, et autres
Publié: (2025)
Amphion: An Open-Source Audio, Music and Speech Generation Toolkit
par: Zhang, Xueyao, et autres
Publié: (2023)
par: Zhang, Xueyao, et autres
Publié: (2023)
Exploring Perceptual Audio Quality Measurement on Stereo Processing Using the Open Dataset of Audio Quality
par: Delgado, Pablo M., et autres
Publié: (2025)
par: Delgado, Pablo M., et autres
Publié: (2025)
Audio Jailbreak: An Open Comprehensive Benchmark for Jailbreaking Large Audio-Language Models
par: Song, Zirui, et autres
Publié: (2025)
par: Song, Zirui, et autres
Publié: (2025)
GRAFX: An Open-Source Library for Audio Processing Graphs in PyTorch
par: Lee, Sungho, et autres
Publié: (2024)
par: Lee, Sungho, et autres
Publié: (2024)
StreamMark: A Deep Learning-Based Semi-Fragile Audio Watermarking for Proactive Deepfake Detection
par: Liu, Zhentao, et autres
Publié: (2026)
par: Liu, Zhentao, et autres
Publié: (2026)
Stable Audio Open
par: Evans, Zach, et autres
Publié: (2024)
par: Evans, Zach, et autres
Publié: (2024)
Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems
par: Xiao, Yang, et autres
Publié: (2026)
par: Xiao, Yang, et autres
Publié: (2026)
Singing Voice Data Scaling-up: An Introduction to ACE-Opencpop and ACE-KiSing
par: Shi, Jiatong, et autres
Publié: (2024)
par: Shi, Jiatong, et autres
Publié: (2024)
TTA-Bench: A Comprehensive Benchmark for Evaluating Text-to-Audio Models
par: Wang, Hui, et autres
Publié: (2025)
par: Wang, Hui, et autres
Publié: (2025)
OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction
par: Alonso-Jiménez, Pablo, et autres
Publié: (2025)
par: Alonso-Jiménez, Pablo, et autres
Publié: (2025)
Model as Loss: A Self-Consistent Training Paradigm
par: Phaye, Saisamarth Rajesh, et autres
Publié: (2025)
par: Phaye, Saisamarth Rajesh, et autres
Publié: (2025)
MMAU-Pro: A Challenging and Comprehensive Benchmark for Holistic Evaluation of Audio General Intelligence
par: Kumar, Sonal, et autres
Publié: (2025)
par: Kumar, Sonal, et autres
Publié: (2025)
AudioRAG: A Challenging Benchmark for Audio Reasoning and Information Retrieval
par: Lin, Jingru, et autres
Publié: (2026)
par: Lin, Jingru, et autres
Publié: (2026)
Low-latency Assistive Audio Enhancement for Neurodivergent People
par: Popescu, Alexander, et autres
Publié: (2025)
par: Popescu, Alexander, et autres
Publié: (2025)
MACE: Leveraging Audio for Evaluating Audio Captioning Systems
par: Dixit, Satvik, et autres
Publié: (2024)
par: Dixit, Satvik, et autres
Publié: (2024)
Code Drift: Towards Idempotent Neural Audio Codecs
par: O'Reilly, Patrick, et autres
Publié: (2024)
par: O'Reilly, Patrick, et autres
Publié: (2024)
LALM-as-a-Judge: Benchmarking Large Audio-Language Models for Safety Evaluation in Multi-Turn Spoken Dialogues
par: Ivry, Amir, et autres
Publié: (2026)
par: Ivry, Amir, et autres
Publié: (2026)
Benchmarking Time-localized Explanations for Audio Classification Models
par: Bolaños, Cecilia, et autres
Publié: (2025)
par: Bolaños, Cecilia, et autres
Publié: (2025)
OpenSep: Leveraging Large Language Models with Textual Inversion for Open World Audio Separation
par: Mahmud, Tanvir, et autres
Publié: (2024)
par: Mahmud, Tanvir, et autres
Publié: (2024)
SHEET: A Multi-purpose Open-source Speech Human Evaluation Estimation Toolkit
par: Huang, Wen-Chin, et autres
Publié: (2025)
par: Huang, Wen-Chin, et autres
Publié: (2025)
Expressive Range Characterization of Open Text-to-Audio Models
par: Morse, Jonathan, et autres
Publié: (2025)
par: Morse, Jonathan, et autres
Publié: (2025)
PolyBench: A Benchmark for Compositional Reasoning in Polyphonic Audio
par: Chen, Yuanjian, et autres
Publié: (2026)
par: Chen, Yuanjian, et autres
Publié: (2026)
ACE-Step: A Step Towards Music Generation Foundation Model
par: Gong, Junmin, et autres
Publié: (2025)
par: Gong, Junmin, et autres
Publié: (2025)
Benchmarking Open-ended Audio Dialogue Understanding for Large Audio-Language Models
par: Gao, Kuofeng, et autres
Publié: (2024)
par: Gao, Kuofeng, et autres
Publié: (2024)
AudioEval: Automatic Dual-Perspective and Multi-Dimensional Evaluation of Text-to-Audio-Generation
par: Wang, Hui, et autres
Publié: (2025)
par: Wang, Hui, et autres
Publié: (2025)
Synthetic Audio Forensics Evaluation (SAFE) Challenge
par: Trapeznikov, Kirill, et autres
Publié: (2025)
par: Trapeznikov, Kirill, et autres
Publié: (2025)
Neutone SDK: An Open Source Framework for Neural Audio Processing
par: Mitcheltree, Christopher, et autres
Publié: (2025)
par: Mitcheltree, Christopher, et autres
Publié: (2025)
AudioBERTScore: Objective Evaluation of Environmental Sound Synthesis Based on Similarity of Audio embedding Sequences
par: Kishi, Minoru, et autres
Publié: (2025)
par: Kishi, Minoru, et autres
Publié: (2025)
Towards Robust Audio Deepfake Detection: A Evolving Benchmark for Continual Learning
par: Zhang, Xiaohui, et autres
Publié: (2024)
par: Zhang, Xiaohui, et autres
Publié: (2024)
Reject Threshold Adaptation for Open-Set Model Attribution of Deepfake Audio
par: Yan, Xinrui, et autres
Publié: (2024)
par: Yan, Xinrui, et autres
Publié: (2024)
ACES: Evaluating Automated Audio Captioning Models on the Semantics of Sounds
par: Wijngaard, Gijs, et autres
Publié: (2024)
par: Wijngaard, Gijs, et autres
Publié: (2024)
X-ARES: A Comprehensive Framework for Assessing Audio Encoder Performance
par: Zhang, Junbo, et autres
Publié: (2025)
par: Zhang, Junbo, et autres
Publié: (2025)
DOTA-ME-CS: Daily Oriented Text Audio-Mandarin English-Code Switching Dataset
par: Li, Yupei, et autres
Publié: (2025)
par: Li, Yupei, et autres
Publié: (2025)
Documents similaires
-
Semi-intrusive audio evaluation: Casting non-intrusive assessment as a multi-modal text prediction task
par: Coldenhoff, Jozef, et autres
Publié: (2024) -
Multi-Channel MOSRA: Mean Opinion Score and Room Acoustics Estimation Using Simulated Data and a Teacher Model
par: Coldenhoff, Jozef, et autres
Publié: (2023) -
Differentiable Time-Varying IIR Filtering for Real-Time Speech Denoising
par: Rota, Riccardo, et autres
Publié: (2026) -
Zimtohrli: An Efficient Psychoacoustic Audio Similarity Metric
par: Alakuijala, Jyrki, et autres
Publié: (2025) -
Diffusion-based Speech Enhancement with Schrödinger Bridge and Symmetric Noise Schedule
par: Wang, Siyi, et autres
Publié: (2024)