Speaker-Independent Acoustic-to-Articulatory Inversion through Multi-Channel Attention Discriminator
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chung, Woo-Jin, Kang, Hong-Goo |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Binaural Selective Attention Model for Target Speaker Extraction
par: Meng, Hanyu, et autres
Publié: (2024)
par: Meng, Hanyu, et autres
Publié: (2024)
EchoScan: Scanning Complex Room Geometries via Acoustic Echoes
par: Yeon, Inmo, et autres
Publié: (2023)
par: Yeon, Inmo, et autres
Publié: (2023)
LAMA-UT: Language Agnostic Multilingual ASR through Orthography Unification and Language-Specific Transliteration
par: Lee, Sangmin, et autres
Publié: (2024)
par: Lee, Sangmin, et autres
Publié: (2024)
HiRIS: an Airborne Sonar Sensor with a 1024 Channel Microphone Array for In-Air Acoustic Imaging
par: Laurijssen, Dennis, et autres
Publié: (2024)
par: Laurijssen, Dennis, et autres
Publié: (2024)
UniverSR: Unified and Versatile Audio Super-Resolution via Vocoder-Free Flow Matching
par: Choi, Woongjib, et autres
Publié: (2025)
par: Choi, Woongjib, et autres
Publié: (2025)
SpeakerBeam-SS: Real-time Target Speaker Extraction with Lightweight Conv-TasNet and State Space Modeling
par: Sato, Hiroshi, et autres
Publié: (2024)
par: Sato, Hiroshi, et autres
Publié: (2024)
Tracking of Intermittent and Moving Speakers : Dataset and Metrics
par: Iatariene, Taous, et autres
Publié: (2025)
par: Iatariene, Taous, et autres
Publié: (2025)
Differentiable Acoustic Radiance Transfer
par: Lee, Sungho, et autres
Publié: (2025)
par: Lee, Sungho, et autres
Publié: (2025)
String Sound Synthesizer on GPU-accelerated Finite Difference Scheme
par: Lee, Jin Woo, et autres
Publié: (2023)
par: Lee, Jin Woo, et autres
Publié: (2023)
FlexIO: Flexible Single- and Multi-Channel Speech Separation and Enhancement
par: Masuyama, Yoshiki, et autres
Publié: (2025)
par: Masuyama, Yoshiki, et autres
Publié: (2025)
An Investigation of Time-Frequency Representation Discriminators for High-Fidelity Vocoder
par: Gu, Yicheng, et autres
Publié: (2024)
par: Gu, Yicheng, et autres
Publié: (2024)
Comparison of Frequency-Fusion Mechanisms for Binaural Direction-of-Arrival Estimation for Multiple Speakers
par: Fejgin, Daniel, et autres
Publié: (2024)
par: Fejgin, Daniel, et autres
Publié: (2024)
Physics-Informed Direction-Aware Neural Acoustic Fields
par: Masuyama, Yoshiki, et autres
Publié: (2025)
par: Masuyama, Yoshiki, et autres
Publié: (2025)
Exploiting an External Microphone for Binaural RTF-Vector-Based Direction of Arrival Estimation for Multiple Speakers
par: Fejgin, Daniel, et autres
Publié: (2023)
par: Fejgin, Daniel, et autres
Publié: (2023)
Completing Sets of Prototype Transfer Functions for Subspace-based Direction of Arrival Estimation of Multiple Speakers
par: Fejgin, Daniel, et autres
Publié: (2025)
par: Fejgin, Daniel, et autres
Publié: (2025)
Dependence on Early and Late Reverberation of Single-Channel Speaker Distance Estimation
par: Neri, Michael, et autres
Publié: (2026)
par: Neri, Michael, et autres
Publié: (2026)
Acoustical Features as Knee Health Biomarkers: A Critical Analysis
par: Kechris, Christodoulos, et autres
Publié: (2024)
par: Kechris, Christodoulos, et autres
Publié: (2024)
Machine Learning in Acoustics: A Review and Open-Source Repository
par: McCarthy, Ryan A., et autres
Publié: (2025)
par: McCarthy, Ryan A., et autres
Publié: (2025)
A Survey of Advancing Audio Super-Resolution and Bandwidth Extension from Discriminative to Generative Models
par: Yang, Ningyuan, et autres
Publié: (2026)
par: Yang, Ningyuan, et autres
Publié: (2026)
Acoustic Field Reconstruction in Tubes via Physics-Informed Neural Networks
par: Luan, Xinmeng, et autres
Publié: (2025)
par: Luan, Xinmeng, et autres
Publié: (2025)
CrossSpeech++: Cross-lingual Speech Synthesis with Decoupled Language and Speaker Generation
par: Kim, Ji-Hoon, et autres
Publié: (2024)
par: Kim, Ji-Hoon, et autres
Publié: (2024)
Interpolation Filter Design for Sample Rate Independent Audio Effect RNNs
par: Carson, Alistair, et autres
Publié: (2024)
par: Carson, Alistair, et autres
Publié: (2024)
Sample Rate Independent Recurrent Neural Networks for Audio Effects Processing
par: Carson, Alistair, et autres
Publié: (2024)
par: Carson, Alistair, et autres
Publié: (2024)
Align-ULCNet: Towards Low-Complexity and Robust Acoustic Echo and Noise Reduction
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
Comparison of Classification Algorithms for COVID19 Detection using Cough Acoustic Signals
par: Erdoğan, Yunus Emre, et autres
Publié: (2022)
par: Erdoğan, Yunus Emre, et autres
Publié: (2022)
Optimal Scalogram for Computational Complexity Reduction in Acoustic Recognition Using Deep Learning
par: Phan, Dang Thoai, et autres
Publié: (2025)
par: Phan, Dang Thoai, et autres
Publié: (2025)
Speech-Declipping Transformer with Complex Spectrogram and Learnerble Temporal Features
par: Kwon, Younghoo, et autres
Publié: (2024)
par: Kwon, Younghoo, et autres
Publié: (2024)
Online Similarity-and-Independence-Aware Beamformer for Low-latency Target Sound Extraction
par: Hiroe, Atsuo
Publié: (2023)
par: Hiroe, Atsuo
Publié: (2023)
Acoustivision Pro: An Open-Source Interactive Platform for Room Impulse Response Analysis and Acoustic Characterization
par: Goswami, Mandip
Publié: (2026)
par: Goswami, Mandip
Publié: (2026)
Decomposing the Influence of Physical Acoustic Modeling on Neural Personal Sound Zone Rendering: An Ablation Study
par: Jiang, Hao, et autres
Publié: (2026)
par: Jiang, Hao, et autres
Publié: (2026)
Neural Tracking of Sustained Attention, Attention Switching, and Natural Conversation in Audiovisual Environments using Mobile EEG
par: Wilroth, Johanna, et autres
Publié: (2026)
par: Wilroth, Johanna, et autres
Publié: (2026)
Speak in the Scene: Diffusion-based Acoustic Scene Transfer toward Immersive Speech Generation
par: Kim, Miseul, et autres
Publié: (2024)
par: Kim, Miseul, et autres
Publié: (2024)
Adaptive Control Attention Network for Underwater Acoustic Localization and Domain Adaptation
par: Vo, Quoc Thinh, et autres
Publié: (2025)
par: Vo, Quoc Thinh, et autres
Publié: (2025)
DeWinder: Single-Channel Wind Noise Reduction using Ultrasound Sensing
par: Yuan, Kuang, et autres
Publié: (2024)
par: Yuan, Kuang, et autres
Publié: (2024)
Adaptive Per-Channel Energy Normalization Front-end for Robust Audio Signal Processing
par: Meng, Hanyu, et autres
Publié: (2025)
par: Meng, Hanyu, et autres
Publié: (2025)
Towards Improving Speaker Distance Estimation through Generative Impulse Response Augmentation
par: Ratnarajah, Anton, et autres
Publié: (2026)
par: Ratnarajah, Anton, et autres
Publié: (2026)
Using Ear-EEG to Decode Auditory Attention in Multiple-speaker Environment
par: Zhu, Haolin, et autres
Publié: (2024)
par: Zhu, Haolin, et autres
Publié: (2024)
AADNet: An End-to-End Deep Learning Model for Auditory Attention Decoding
par: Nguyen, Nhan Duc Thanh, et autres
Publié: (2024)
par: Nguyen, Nhan Duc Thanh, et autres
Publié: (2024)
What is Learnt by the LEArnable Front-end (LEAF)? Adapting Per-Channel Energy Normalisation (PCEN) to Noisy Conditions
par: Meng, Hanyu, et autres
Publié: (2024)
par: Meng, Hanyu, et autres
Publié: (2024)
Towards Low-Latency Tracking of Multiple Speakers With Short-Context Speaker Embeddings
par: Iatariene, Taous, et autres
Publié: (2025)
par: Iatariene, Taous, et autres
Publié: (2025)
Documents similaires
-
Binaural Selective Attention Model for Target Speaker Extraction
par: Meng, Hanyu, et autres
Publié: (2024) -
EchoScan: Scanning Complex Room Geometries via Acoustic Echoes
par: Yeon, Inmo, et autres
Publié: (2023) -
LAMA-UT: Language Agnostic Multilingual ASR through Orthography Unification and Language-Specific Transliteration
par: Lee, Sangmin, et autres
Publié: (2024) -
HiRIS: an Airborne Sonar Sensor with a 1024 Channel Microphone Array for In-Air Acoustic Imaging
par: Laurijssen, Dennis, et autres
Publié: (2024) -
UniverSR: Unified and Versatile Audio Super-Resolution via Vocoder-Free Flow Matching
par: Choi, Woongjib, et autres
Publié: (2025)