Guardado en:
| Autores principales: | Santos, Arthur N. dos, Masiero, Bruno S., Mateus, Túlio C. L. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2404.14564 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Survey on 30+ Years of Automatic Singing Assessment and Singing Information Processing
por: Santos, Arthur N. dos, et al.
Publicado: (2026)
por: Santos, Arthur N. dos, et al.
Publicado: (2026)
Development of the Listening in Spatialized Noise-Sentences (LiSN-S) Test in Brazilian Portuguese: Presentation Software, Speech Stimuli, and Sentence Equivalence
por: Masiero, Bruno S., et al.
Publicado: (2024)
por: Masiero, Bruno S., et al.
Publicado: (2024)
An experiment on an automated literature survey of data-driven speech enhancement methods
por: Santos, Arthur dos, et al.
Publicado: (2023)
por: Santos, Arthur dos, et al.
Publicado: (2023)
Online Single-Channel Audio-Based Sound Speed Estimation for Robust Multi-Channel Audio Control
por: Fuglsig, Andreas Jonas, et al.
Publicado: (2026)
por: Fuglsig, Andreas Jonas, et al.
Publicado: (2026)
Speaker Distance Estimation in Enclosures from Single-Channel Audio
por: Neri, Michael, et al.
Publicado: (2024)
por: Neri, Michael, et al.
Publicado: (2024)
Unsupervised Single-Channel Audio Separation with Diffusion Source Priors
por: Shi, Runwu, et al.
Publicado: (2025)
por: Shi, Runwu, et al.
Publicado: (2025)
RPRA-ADD: Forgery Trace Enhancement-Driven Audio Deepfake Detection
por: Fu, Ruibo, et al.
Publicado: (2025)
por: Fu, Ruibo, et al.
Publicado: (2025)
Study of Lightweight Transformer Architectures for Single-Channel Speech Enhancement
por: Zhao, Haixin, et al.
Publicado: (2025)
por: Zhao, Haixin, et al.
Publicado: (2025)
w2v-SELD: A Sound Event Localization and Detection Framework for Self-Supervised Spatial Audio Pre-Training
por: Santos, Orlem Lima dos, et al.
Publicado: (2023)
por: Santos, Orlem Lima dos, et al.
Publicado: (2023)
Quantifying Spatial Audio Quality Impairment
por: Watcharasupat, Karn N., et al.
Publicado: (2023)
por: Watcharasupat, Karn N., et al.
Publicado: (2023)
Diff-SAGe: End-to-End Spatial Audio Generation Using Diffusion Models
por: Kushwaha, Saksham Singh, et al.
Publicado: (2024)
por: Kushwaha, Saksham Singh, et al.
Publicado: (2024)
ACES: Evaluating Automated Audio Captioning Models on the Semantics of Sounds
por: Wijngaard, Gijs, et al.
Publicado: (2024)
por: Wijngaard, Gijs, et al.
Publicado: (2024)
Exploring Perceptual Audio Quality Measurement on Stereo Processing Using the Open Dataset of Audio Quality
por: Delgado, Pablo M., et al.
Publicado: (2025)
por: Delgado, Pablo M., et al.
Publicado: (2025)
Can Large Language Models Understand Spatial Audio?
por: Tang, Changli, et al.
Publicado: (2024)
por: Tang, Changli, et al.
Publicado: (2024)
Universal Spatial Audio Transcoder
por: Sagasti, Amaia, et al.
Publicado: (2024)
por: Sagasti, Amaia, et al.
Publicado: (2024)
FlexIO: Flexible Single- and Multi-Channel Speech Separation and Enhancement
por: Masuyama, Yoshiki, et al.
Publicado: (2025)
por: Masuyama, Yoshiki, et al.
Publicado: (2025)
SALM: Spatial Audio Language Model with Structured Embeddings for Understanding and Editing
por: Hu, Jinbo, et al.
Publicado: (2025)
por: Hu, Jinbo, et al.
Publicado: (2025)
AudioSpa: Spatializing Sound Events with Text
por: Feng, Linfeng, et al.
Publicado: (2025)
por: Feng, Linfeng, et al.
Publicado: (2025)
Region-Specific Audio Tagging for Spatial Sound
por: Zhao, Jinzheng, et al.
Publicado: (2025)
por: Zhao, Jinzheng, et al.
Publicado: (2025)
The Extended SONICOM HRTF Dataset and Spatial Audio Metrics Toolbox
por: Poole, Katarina C., et al.
Publicado: (2025)
por: Poole, Katarina C., et al.
Publicado: (2025)
A Detailed Audio-Text Data Simulation Pipeline using Single-Event Sounds
por: Xu, Xuenan, et al.
Publicado: (2024)
por: Xu, Xuenan, et al.
Publicado: (2024)
Exploring Self-Supervised Audio Models for Generalized Anomalous Sound Detection
por: Han, Bing, et al.
Publicado: (2025)
por: Han, Bing, et al.
Publicado: (2025)
Multi-modal Speech Enhancement with Limited Electromyography Channels
por: Feng, Fuyuan, et al.
Publicado: (2025)
por: Feng, Fuyuan, et al.
Publicado: (2025)
Attention-Based Beamformer For Multi-Channel Speech Enhancement
por: Bai, Jinglin, et al.
Publicado: (2024)
por: Bai, Jinglin, et al.
Publicado: (2024)
Leveraging Mamba with Full-Face Vision for Audio-Visual Speech Enhancement
por: Chao, Rong, et al.
Publicado: (2025)
por: Chao, Rong, et al.
Publicado: (2025)
Past, Present, and Future of Spatial Audio and Room Acoustics
por: Koyama, Shoichi, et al.
Publicado: (2025)
por: Koyama, Shoichi, et al.
Publicado: (2025)
Towards Spatial Audio Understanding via Question Answering
por: Sudarsanam, Parthasaarathy, et al.
Publicado: (2025)
por: Sudarsanam, Parthasaarathy, et al.
Publicado: (2025)
ASAudio: A Survey of Advanced Spatial Audio Research
por: Zhu, Zhiyuan, et al.
Publicado: (2025)
por: Zhu, Zhiyuan, et al.
Publicado: (2025)
Exploring Differences between Human Perception and Model Inference in Audio Event Recognition
por: Tan, Yizhou, et al.
Publicado: (2024)
por: Tan, Yizhou, et al.
Publicado: (2024)
Stereo Audio Rendering for Personal Sound Zones Using a Binaural Spatially Adaptive Neural Network (BSANN)
por: Jiang, Hao, et al.
Publicado: (2026)
por: Jiang, Hao, et al.
Publicado: (2026)
FlowAVSE: Efficient Audio-Visual Speech Enhancement with Conditional Flow Matching
por: Jung, Chaeyoung, et al.
Publicado: (2024)
por: Jung, Chaeyoung, et al.
Publicado: (2024)
Audio Enhancement from Multiple Crowdsourced Recordings: A Simple and Effective Baseline
por: Aziz, Shiran, et al.
Publicado: (2024)
por: Aziz, Shiran, et al.
Publicado: (2024)
ALDAS: Audio-Linguistic Data Augmentation for Spoofed Audio Detection
por: Khanjani, Zahra, et al.
Publicado: (2024)
por: Khanjani, Zahra, et al.
Publicado: (2024)
PrimeK-Net: Multi-scale Spectral Learning via Group Prime-Kernel Convolutional Neural Networks for Single Channel Speech Enhancement
por: Lin, Zizhen, et al.
Publicado: (2025)
por: Lin, Zizhen, et al.
Publicado: (2025)
FullSubNet: A Full-Band and Sub-Band Fusion Model for Real-Time Single-Channel Speech Enhancement
por: Hao, Xiang, et al.
Publicado: (2020)
por: Hao, Xiang, et al.
Publicado: (2020)
Geometry-Constrained EEG Channel Selection for Brain-Assisted Speech Enhancement
por: Zuo, Keying, et al.
Publicado: (2024)
por: Zuo, Keying, et al.
Publicado: (2024)
Audio-Visual Speech Enhancement in Noisy Environments via Emotion-Based Contextual Cues
por: Hussain, Tassadaq, et al.
Publicado: (2024)
por: Hussain, Tassadaq, et al.
Publicado: (2024)
UniAudio: An Audio Foundation Model Toward Universal Audio Generation
por: Yang, Dongchao, et al.
Publicado: (2023)
por: Yang, Dongchao, et al.
Publicado: (2023)
Pengi: An Audio Language Model for Audio Tasks
por: Deshmukh, Soham, et al.
Publicado: (2023)
por: Deshmukh, Soham, et al.
Publicado: (2023)
xLSTM-SENet: xLSTM for Single-Channel Speech Enhancement
por: Kühne, Nikolai Lund, et al.
Publicado: (2025)
por: Kühne, Nikolai Lund, et al.
Publicado: (2025)
Ejemplares similares
-
A Survey on 30+ Years of Automatic Singing Assessment and Singing Information Processing
por: Santos, Arthur N. dos, et al.
Publicado: (2026) -
Development of the Listening in Spatialized Noise-Sentences (LiSN-S) Test in Brazilian Portuguese: Presentation Software, Speech Stimuli, and Sentence Equivalence
por: Masiero, Bruno S., et al.
Publicado: (2024) -
An experiment on an automated literature survey of data-driven speech enhancement methods
por: Santos, Arthur dos, et al.
Publicado: (2023) -
Online Single-Channel Audio-Based Sound Speed Estimation for Robust Multi-Channel Audio Control
por: Fuglsig, Andreas Jonas, et al.
Publicado: (2026) -
Speaker Distance Estimation in Enclosures from Single-Channel Audio
por: Neri, Michael, et al.
Publicado: (2024)