A Multi-Channel Auditory Signal Encoder with Adaptive Resolution Using Volatile Memristors
Fuente:
arXiv
Guardado en:
| Autores principales: | Guo, Dongxu, Yadav, Deepika, Foster, Patrick, Stathopoulos, Spyros, Chen, Mingyi, Prodromakis, Themis, Wang, Shiwei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Short-Segment Speaker Verification with Pre-trained Models and Multi-Resolution Encoder
por: Myoung, Jisoo, et al.
Publicado: (2025)
por: Myoung, Jisoo, et al.
Publicado: (2025)
Single Channel Blind Dereverberation of Speech Signals
por: Nigam, Dhruv
Publicado: (2025)
por: Nigam, Dhruv
Publicado: (2025)
Frequency-Based Alignment of EEG and Audio Signals Using Contrastive Learning and SincNet for Auditory Attention Detection
por: Liao, Yuan, et al.
Publicado: (2025)
por: Liao, Yuan, et al.
Publicado: (2025)
Multi-Channel Multi-Speaker ASR Using Target Speaker's Solo Segment
por: Shao, Yiwen, et al.
Publicado: (2024)
por: Shao, Yiwen, et al.
Publicado: (2024)
Multi-agent Auditory Scene Analysis
por: Rascon, Caleb, et al.
Publicado: (2025)
por: Rascon, Caleb, et al.
Publicado: (2025)
Self-Supervised Learning of Spatial Acoustic Representation with Cross-Channel Signal Reconstruction and Multi-Channel Conformer
por: Yang, Bing, et al.
Publicado: (2023)
por: Yang, Bing, et al.
Publicado: (2023)
Reference Channel Selection by Multi-Channel Masking for End-to-End Multi-Channel Speech Enhancement
por: Dai, Wang, et al.
Publicado: (2024)
por: Dai, Wang, et al.
Publicado: (2024)
Auditory Attention Decoding from Ear-EEG Signals: A Dataset with Dynamic Attention Switching and Rigorous Cross-Validation
por: Zhang, Yuanming, et al.
Publicado: (2025)
por: Zhang, Yuanming, et al.
Publicado: (2025)
An Efficient Neural Network for Modeling Human Auditory Neurograms for Speech
por: Zohar, Eylon, et al.
Publicado: (2025)
por: Zohar, Eylon, et al.
Publicado: (2025)
Speech Denoising with Auditory Models
por: Saddler, Mark R., et al.
Publicado: (2020)
por: Saddler, Mark R., et al.
Publicado: (2020)
DeepASA: An Object-Oriented Multi-Purpose Network for Auditory Scene Analysis
por: Lee, Dongheon, et al.
Publicado: (2025)
por: Lee, Dongheon, et al.
Publicado: (2025)
Detecting gamma-band responses to the speech envelope for the ICASSP 2024 Auditory EEG Decoding Signal Processing Grand Challenge
por: Thornton, Mike, et al.
Publicado: (2024)
por: Thornton, Mike, et al.
Publicado: (2024)
Adaptive Per-Channel Energy Normalization Front-end for Robust Audio Signal Processing
por: Meng, Hanyu, et al.
Publicado: (2025)
por: Meng, Hanyu, et al.
Publicado: (2025)
Towards General Auditory Intelligence: Large Multimodal Models for Machine Listening and Speaking
por: Wang, Siyin, et al.
Publicado: (2025)
por: Wang, Siyin, et al.
Publicado: (2025)
Using Ear-EEG to Decode Auditory Attention in Multiple-speaker Environment
por: Zhu, Haolin, et al.
Publicado: (2024)
por: Zhu, Haolin, et al.
Publicado: (2024)
Flexible Multi-Channel Target Speaker Extraction Using Geometry-Conditioned Spatially Selective Non-linear Filters
por: Li, Jiatong, et al.
Publicado: (2026)
por: Li, Jiatong, et al.
Publicado: (2026)
Auditory Representation Effective for Estimating Vocal Tract Information
por: Irino, Toshio, et al.
Publicado: (2023)
por: Irino, Toshio, et al.
Publicado: (2023)
Can Large Audio Language Models Ignore Multilingual Distractors? An Evaluation of Their Selective Auditory Attention Capabilities
por: Koo, Heejoon
Publicado: (2026)
por: Koo, Heejoon
Publicado: (2026)
Lumename: Wearable Device for Hearing Impaired with Personalized ML-Based Auditory Detection and Haptic-Visual Alerts
por: Dao, Jeanelle, et al.
Publicado: (2025)
por: Dao, Jeanelle, et al.
Publicado: (2025)
Identifiability Conditions for Acoustic Feedback Cancellation with the Two-Channel Adaptive Feedback Canceller Algorithm
por: Roebben, Arnout, et al.
Publicado: (2025)
por: Roebben, Arnout, et al.
Publicado: (2025)
Unified Diffusion Refinement for Multi-Channel Speech Enhancement and Separation
por: Xu, Zhongweiyang, et al.
Publicado: (2026)
por: Xu, Zhongweiyang, et al.
Publicado: (2026)
ARiSE: Auto-Regressive Multi-Channel Speech Enhancement
por: Shen, Pengjie, et al.
Publicado: (2025)
por: Shen, Pengjie, et al.
Publicado: (2025)
Separate and Reconstruct: Asymmetric Encoder-Decoder for Speech Separation
por: Shin, Ui-Hyeop, et al.
Publicado: (2024)
por: Shin, Ui-Hyeop, et al.
Publicado: (2024)
How to train your ears: Auditory-model emulation for large-dynamic-range inputs and mild-to-severe hearing losses
por: Leer, Peter, et al.
Publicado: (2024)
por: Leer, Peter, et al.
Publicado: (2024)
Audio-Visual Target Speaker Extraction with Reverse Selective Auditory Attention
por: Tao, Ruijie, et al.
Publicado: (2024)
por: Tao, Ruijie, et al.
Publicado: (2024)
StreamAAD: Decoding Spatial Auditory Attention with a Streaming Architecture
por: Qiu, Zelin, et al.
Publicado: (2024)
por: Qiu, Zelin, et al.
Publicado: (2024)
Flow2GAN: Hybrid Flow Matching and GAN with Multi-Resolution Network for Few-step High-Fidelity Audio Generation
por: Yao, Zengwei, et al.
Publicado: (2025)
por: Yao, Zengwei, et al.
Publicado: (2025)
Generating Localized Audible Zones Using a Single-Channel Parametric Loudspeaker
por: Zhuang, Tao, et al.
Publicado: (2025)
por: Zhuang, Tao, et al.
Publicado: (2025)
Improved Topology-Independent Distributed Adaptive Node-Specific Signal Estimation for Wireless Acoustic Sensor Networks
por: Didier, Paul, et al.
Publicado: (2025)
por: Didier, Paul, et al.
Publicado: (2025)
Speech-Aware Neural Diarization with Encoder-Decoder Attractor Guided by Attention Constraints
por: Lee, PeiYing, et al.
Publicado: (2024)
por: Lee, PeiYing, et al.
Publicado: (2024)
Phase Aware Ear-Conditioned Learning for Multi-Channel Binaural Speaker Separation
por: Jeremiah, Ruben Johnson Robert, et al.
Publicado: (2025)
por: Jeremiah, Ruben Johnson Robert, et al.
Publicado: (2025)
ArrayDPS-Refine: Generative Refinement of Discriminative Multi-Channel Speech Enhancement
por: Xu, Zhongweiyang, et al.
Publicado: (2026)
por: Xu, Zhongweiyang, et al.
Publicado: (2026)
Spatially Aware Self-Supervised Models for Multi-Channel Neural Speaker Diarization
por: Han, Jiangyu, et al.
Publicado: (2025)
por: Han, Jiangyu, et al.
Publicado: (2025)
Self-Speculative Decoding for LLM-based ASR with CTC Encoder Drafts
por: Saon, George, et al.
Publicado: (2026)
por: Saon, George, et al.
Publicado: (2026)
Training a Perceptual Model for Evaluating Auditory Similarity in Music Adversarial Attack
por: Liu, Yuxuan, et al.
Publicado: (2025)
por: Liu, Yuxuan, et al.
Publicado: (2025)
Harmonic Detection from Noisy Speech with Auditory Frame Gain for Intelligibility Enhancement
por: Queiroz, A., et al.
Publicado: (2024)
por: Queiroz, A., et al.
Publicado: (2024)
Multi-Channel Sequence-to-Sequence Neural Diarization: Experimental Results for The MISP 2025 Challenge
por: Cheng, Ming, et al.
Publicado: (2025)
por: Cheng, Ming, et al.
Publicado: (2025)
Lightweight and Robust Multi-Channel End-to-End Speech Recognition with Spherical Harmonic Transform
por: Kong, Xiangzhu, et al.
Publicado: (2025)
por: Kong, Xiangzhu, et al.
Publicado: (2025)
DeCRED: Decoder-Centric Regularization for Encoder-Decoder Based Speech Recognition
por: Polok, Alexander, et al.
Publicado: (2025)
por: Polok, Alexander, et al.
Publicado: (2025)
Improving Automatic Speech Recognition with Decoder-Centric Regularisation in Encoder-Decoder Models
por: Polok, Alexander, et al.
Publicado: (2024)
por: Polok, Alexander, et al.
Publicado: (2024)
Ejemplares similares
-
Short-Segment Speaker Verification with Pre-trained Models and Multi-Resolution Encoder
por: Myoung, Jisoo, et al.
Publicado: (2025) -
Single Channel Blind Dereverberation of Speech Signals
por: Nigam, Dhruv
Publicado: (2025) -
Frequency-Based Alignment of EEG and Audio Signals Using Contrastive Learning and SincNet for Auditory Attention Detection
por: Liao, Yuan, et al.
Publicado: (2025) -
Multi-Channel Multi-Speaker ASR Using Target Speaker's Solo Segment
por: Shao, Yiwen, et al.
Publicado: (2024) -
Multi-agent Auditory Scene Analysis
por: Rascon, Caleb, et al.
Publicado: (2025)