Salvato in:
| Autori principali: | Sadok, Samir, Hauret, Julien, Bavu, Éric |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2506.04492 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Real-time speech enhancement in noise for throat microphone using neural audio codec as foundation model
di: Hauret, Julien, et al.
Pubblicazione: (2025)
di: Hauret, Julien, et al.
Pubblicazione: (2025)
French Listening Tests for the Assessment of Intelligibility, Quality, and Identity of Body-Conducted Speech Enhancement
di: Joubaud, Thomas, et al.
Pubblicazione: (2025)
di: Joubaud, Thomas, et al.
Pubblicazione: (2025)
EBEN: Extreme bandwidth extension network applied to speech signals captured with noise-resilient body-conduction microphones
di: Hauret, Julien, et al.
Pubblicazione: (2022)
di: Hauret, Julien, et al.
Pubblicazione: (2022)
Configurable EBEN: Extreme Bandwidth Extension Network to enhance body-conducted speech capture
di: Hauret, Julien, et al.
Pubblicazione: (2023)
di: Hauret, Julien, et al.
Pubblicazione: (2023)
Vibravox: A Dataset of French Speech Captured with Body-conduction Audio Sensors
di: Hauret, Julien, et al.
Pubblicazione: (2024)
di: Hauret, Julien, et al.
Pubblicazione: (2024)
Toward a Sparse and Interpretable Audio Codec
di: Vinyard, John
Pubblicazione: (2025)
di: Vinyard, John
Pubblicazione: (2025)
Codec-Based Deepfake Source Tracing via Neural Audio Codec Taxonomy
di: Chen, Xuanjun, et al.
Pubblicazione: (2025)
di: Chen, Xuanjun, et al.
Pubblicazione: (2025)
ESPnet-Codec: Comprehensive Training and Evaluation of Neural Codecs for Audio, Music, and Speech
di: Shi, Jiatong, et al.
Pubblicazione: (2024)
di: Shi, Jiatong, et al.
Pubblicazione: (2024)
Towards Neural Audio Codec Source Parsing
di: Phukan, Orchid Chetia, et al.
Pubblicazione: (2025)
di: Phukan, Orchid Chetia, et al.
Pubblicazione: (2025)
Acoustic Teleportation via Disentangled Neural Audio Codec Representations
di: Grundhuber, Philipp, et al.
Pubblicazione: (2025)
di: Grundhuber, Philipp, et al.
Pubblicazione: (2025)
Speech Separation using Neural Audio Codecs with Embedding Loss
di: Yip, Jia Qi, et al.
Pubblicazione: (2024)
di: Yip, Jia Qi, et al.
Pubblicazione: (2024)
Towards Evaluating Generative Audio: Insights from Neural Audio Codec Embedding Distances
di: Biswas, Arijit, et al.
Pubblicazione: (2025)
di: Biswas, Arijit, et al.
Pubblicazione: (2025)
SUNAC: Source-aware Unified Neural Audio Codec
di: Aihara, Ryo, et al.
Pubblicazione: (2025)
di: Aihara, Ryo, et al.
Pubblicazione: (2025)
Analysing the Language of Neural Audio Codecs
di: Park, Joonyong, et al.
Pubblicazione: (2025)
di: Park, Joonyong, et al.
Pubblicazione: (2025)
Code Drift: Towards Idempotent Neural Audio Codecs
di: O'Reilly, Patrick, et al.
Pubblicazione: (2024)
di: O'Reilly, Patrick, et al.
Pubblicazione: (2024)
HILCodec: High-Fidelity and Lightweight Neural Audio Codec
di: Ahn, Sunghwan, et al.
Pubblicazione: (2024)
di: Ahn, Sunghwan, et al.
Pubblicazione: (2024)
CodecFake+: A Large-Scale Neural Audio Codec-Based Deepfake Speech Dataset
di: Chen, Xuanjun, et al.
Pubblicazione: (2025)
di: Chen, Xuanjun, et al.
Pubblicazione: (2025)
Indic-CodecFake meets SATYAM: Towards Detecting Neural Audio Codec Synthesized Speech Deepfakes in Indic Languages
di: Girish, et al.
Pubblicazione: (2026)
di: Girish, et al.
Pubblicazione: (2026)
DualCodec: A Low-Frame-Rate, Semantically-Enhanced Neural Audio Codec for Speech Generation
di: Li, Jiaqi, et al.
Pubblicazione: (2025)
di: Li, Jiaqi, et al.
Pubblicazione: (2025)
Spectral Codecs: Improving Non-Autoregressive Speech Synthesis with Spectrogram-Based Audio Codecs
di: Langman, Ryan, et al.
Pubblicazione: (2024)
di: Langman, Ryan, et al.
Pubblicazione: (2024)
OmniCodec: Low Frame Rate Universal Audio Codec with Semantic-Acoustic Disentanglement
di: Hu, Jingbin, et al.
Pubblicazione: (2026)
di: Hu, Jingbin, et al.
Pubblicazione: (2026)
BSCodec: A Band-Split Neural Codec for High-Quality Universal Audio Reconstruction
di: Wang, Haoran, et al.
Pubblicazione: (2025)
di: Wang, Haoran, et al.
Pubblicazione: (2025)
UniCodec: Unified Audio Codec with Single Domain-Adaptive Codebook
di: Jiang, Yidi, et al.
Pubblicazione: (2025)
di: Jiang, Yidi, et al.
Pubblicazione: (2025)
On the Language and Gender Biases in PSTN, VoIP and Neural Audio Codecs
di: Altwlkany, Kemal, et al.
Pubblicazione: (2025)
di: Altwlkany, Kemal, et al.
Pubblicazione: (2025)
BANC: Towards Efficient Binaural Audio Neural Codec for Overlapping Speech
di: Ratnarajah, Anton, et al.
Pubblicazione: (2023)
di: Ratnarajah, Anton, et al.
Pubblicazione: (2023)
ERVQ: Enhanced Residual Vector Quantization with Intra-and-Inter-Codebook Optimization for Neural Audio Codecs
di: Zheng, Rui-Chen, et al.
Pubblicazione: (2024)
di: Zheng, Rui-Chen, et al.
Pubblicazione: (2024)
SNAC: Multi-Scale Neural Audio Codec
di: Siuzdak, Hubert, et al.
Pubblicazione: (2024)
di: Siuzdak, Hubert, et al.
Pubblicazione: (2024)
SwitchCodec: A High-Fidelity Nerual Audio Codec With Sparse Quantization
di: Wang, Jin, et al.
Pubblicazione: (2025)
di: Wang, Jin, et al.
Pubblicazione: (2025)
Analysis of Speaker Verification Performance Trade-offs with Neural Audio Codec Transmission
di: Thakur, Nirmalya Mallick, et al.
Pubblicazione: (2025)
di: Thakur, Nirmalya Mallick, et al.
Pubblicazione: (2025)
An Intra-BRNN and GB-RVQ Based END-TO-END Neural Audio Codec
di: Xu, Linping, et al.
Pubblicazione: (2024)
di: Xu, Linping, et al.
Pubblicazione: (2024)
NDVQ: Robust Neural Audio Codec with Normal Distribution-Based Vector Quantization
di: Niu, Zhikang, et al.
Pubblicazione: (2024)
di: Niu, Zhikang, et al.
Pubblicazione: (2024)
Investigating Neural Audio Codecs for Speech Language Model-Based Speech Generation
di: Li, Jiaqi, et al.
Pubblicazione: (2024)
di: Li, Jiaqi, et al.
Pubblicazione: (2024)
Analyzing and Mitigating Inconsistency in Discrete Audio Tokens for Neural Codec Language Models
di: Liu, Wenrui, et al.
Pubblicazione: (2024)
di: Liu, Wenrui, et al.
Pubblicazione: (2024)
Streaming Endpointer for Spoken Dialogue using Neural Audio Codecs and Label-Delayed Training
di: Udupa, Sathvik, et al.
Pubblicazione: (2025)
di: Udupa, Sathvik, et al.
Pubblicazione: (2025)
VCNAC: A Variable-Channel Neural Audio Codec for Mono, Stereo, and Surround Sound
di: Grötschla, Florian, et al.
Pubblicazione: (2026)
di: Grötschla, Florian, et al.
Pubblicazione: (2026)
APCodec: A Neural Audio Codec with Parallel Amplitude and Phase Spectrum Encoding and Decoding
di: Ai, Yang, et al.
Pubblicazione: (2024)
di: Ai, Yang, et al.
Pubblicazione: (2024)
Latent Granular Resynthesis using Neural Audio Codecs
di: Tokui, Nao, et al.
Pubblicazione: (2025)
di: Tokui, Nao, et al.
Pubblicazione: (2025)
Trade-offs Between Capacity and Robustness in Neural Audio Codecs for Adversarially Robust Speech Recognition
di: Prescott, Jordan, et al.
Pubblicazione: (2026)
di: Prescott, Jordan, et al.
Pubblicazione: (2026)
SpectroStream: A Versatile Neural Codec for General Audio
di: Li, Yunpeng, et al.
Pubblicazione: (2025)
di: Li, Yunpeng, et al.
Pubblicazione: (2025)
Benchmarking Neural Speech Codec Intelligibility with SITool
di: Leschanowsky, Anna, et al.
Pubblicazione: (2025)
di: Leschanowsky, Anna, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Real-time speech enhancement in noise for throat microphone using neural audio codec as foundation model
di: Hauret, Julien, et al.
Pubblicazione: (2025) -
French Listening Tests for the Assessment of Intelligibility, Quality, and Identity of Body-Conducted Speech Enhancement
di: Joubaud, Thomas, et al.
Pubblicazione: (2025) -
EBEN: Extreme bandwidth extension network applied to speech signals captured with noise-resilient body-conduction microphones
di: Hauret, Julien, et al.
Pubblicazione: (2022) -
Configurable EBEN: Extreme Bandwidth Extension Network to enhance body-conducted speech capture
di: Hauret, Julien, et al.
Pubblicazione: (2023) -
Vibravox: A Dataset of French Speech Captured with Body-conduction Audio Sensors
di: Hauret, Julien, et al.
Pubblicazione: (2024)