Neural personal sound zones with flexible bright zone control
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Wenye, Tang, Jun, Li, Xiaofei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LSZone: A Lightweight Spatial Information Modeling Architecture for Real-time In-car Multi-zone Speech Separation
di: Chen, Jun, et al.
Pubblicazione: (2025)
di: Chen, Jun, et al.
Pubblicazione: (2025)
Comparison of window shapes and lengths in short-time feature extraction for classification of heart sound signals
di: Fakhry, Mahmoud, et al.
Pubblicazione: (2026)
di: Fakhry, Mahmoud, et al.
Pubblicazione: (2026)
Multi-modal expressive personality recognition in data non-ideal audiovisual based on multi-scale feature enhancement and modal augment
di: Kong, Weixuan, et al.
Pubblicazione: (2025)
di: Kong, Weixuan, et al.
Pubblicazione: (2025)
An investigation of AI integration in sound designer workflows and experiences
di: Garcia, Nelly, et al.
Pubblicazione: (2026)
di: Garcia, Nelly, et al.
Pubblicazione: (2026)
Multi-Task Learning for Lung sound & Lung disease classification
di: K V, Suma, et al.
Pubblicazione: (2024)
di: K V, Suma, et al.
Pubblicazione: (2024)
AudioMoG: Guiding Audio Generation with Mixture-of-Guidance
di: Wang, Junyou, et al.
Pubblicazione: (2025)
di: Wang, Junyou, et al.
Pubblicazione: (2025)
Music Style Transfer With Diffusion Model
di: Huang, Hong, et al.
Pubblicazione: (2024)
di: Huang, Hong, et al.
Pubblicazione: (2024)
Heterogeneous sound classification with the Broad Sound Taxonomy and Dataset
di: Anastasopoulou, Panagiota, et al.
Pubblicazione: (2024)
di: Anastasopoulou, Panagiota, et al.
Pubblicazione: (2024)
Probabilistic Fusion and Calibration of Neural Speaker Diarization Models
di: Alvarez-Trejos, Juan Ignacio, et al.
Pubblicazione: (2025)
di: Alvarez-Trejos, Juan Ignacio, et al.
Pubblicazione: (2025)
Toward Complex-Valued Neural Networks for Waveform Generation
di: Oh, Hyung-Seok, et al.
Pubblicazione: (2026)
di: Oh, Hyung-Seok, et al.
Pubblicazione: (2026)
Latent-Mark: An Audio Watermark Robust to Neural Resynthesis
di: Chen, Yen-Shan, et al.
Pubblicazione: (2026)
di: Chen, Yen-Shan, et al.
Pubblicazione: (2026)
Evaluating Neural Networks Architectures for Spring Reverb Modelling
di: Papaleo, Francesco, et al.
Pubblicazione: (2024)
di: Papaleo, Francesco, et al.
Pubblicazione: (2024)
Unifying Speech Editing Detection and Content Localization via Prior-Enhanced Audio LLMs
di: Xue, Jun, et al.
Pubblicazione: (2026)
di: Xue, Jun, et al.
Pubblicazione: (2026)
State Space Models for Bioacoustics: A Comparative Evaluation with Transformers
di: Tang, Chengyu, et al.
Pubblicazione: (2025)
di: Tang, Chengyu, et al.
Pubblicazione: (2025)
SonicSim: A customizable simulation platform for speech processing in moving sound source scenarios
di: Li, Kai, et al.
Pubblicazione: (2024)
di: Li, Kai, et al.
Pubblicazione: (2024)
AnalysisGNN: Unified Music Analysis with Graph Neural Networks
di: Karystinaios, Emmanouil, et al.
Pubblicazione: (2025)
di: Karystinaios, Emmanouil, et al.
Pubblicazione: (2025)
Robust Neural Audio Fingerprinting using Music Foundation Models
di: Singh, Shubhr, et al.
Pubblicazione: (2025)
di: Singh, Shubhr, et al.
Pubblicazione: (2025)
The Equalizer: Introducing Shape-Gain Decomposition in Neural Audio Codecs
di: Sadok, Samir, et al.
Pubblicazione: (2026)
di: Sadok, Samir, et al.
Pubblicazione: (2026)
Self Voice Conversion as an Attack against Neural Audio Watermarking
di: Özer, Yigitcan, et al.
Pubblicazione: (2026)
di: Özer, Yigitcan, et al.
Pubblicazione: (2026)
NSTR: Neural Spectral Transport Representation for Space-Varying Frequency Fields
di: Versace, Plein
Pubblicazione: (2025)
di: Versace, Plein
Pubblicazione: (2025)
Neural Multi-Speaker Voice Cloning for Nepali in Low-Resource Settings
di: Shrestha, Aayush M., et al.
Pubblicazione: (2026)
di: Shrestha, Aayush M., et al.
Pubblicazione: (2026)
AutoStyle-TTS: Retrieval-Augmented Generation based Automatic Style Matching Text-to-Speech Synthesis
di: Luo, Dan, et al.
Pubblicazione: (2025)
di: Luo, Dan, et al.
Pubblicazione: (2025)
Drum Synthesis from Expressive Drum Grids via Neural Audio Codecs
di: Soiledis, Konstantinos, et al.
Pubblicazione: (2026)
di: Soiledis, Konstantinos, et al.
Pubblicazione: (2026)
TokenSynth: A Token-based Neural Synthesizer for Instrument Cloning and Text-to-Instrument
di: Kim, Kyungsu, et al.
Pubblicazione: (2025)
di: Kim, Kyungsu, et al.
Pubblicazione: (2025)
Comparative Study of State-based Neural Networks for Virtual Analog Audio Effects Modeling
di: Simionato, Riccardo, et al.
Pubblicazione: (2024)
di: Simionato, Riccardo, et al.
Pubblicazione: (2024)
Detecting abnormal heart sound using mobile phones and on-device IConNet
di: Vu, Linh, et al.
Pubblicazione: (2024)
di: Vu, Linh, et al.
Pubblicazione: (2024)
MindVoice: Reconstructing Intelligible Speech from Non-invasive Neural Signals with Pretrained Priors
di: Bao, Guangyin, et al.
Pubblicazione: (2026)
di: Bao, Guangyin, et al.
Pubblicazione: (2026)
ELLA-V: Stable Neural Codec Language Modeling with Alignment-guided Sequence Reordering
di: Song, Yakun, et al.
Pubblicazione: (2024)
di: Song, Yakun, et al.
Pubblicazione: (2024)
PSCodec: A Series of High-Fidelity Low-bitrate Neural Speech Codecs Leveraging Prompt Encoders
di: Pan, Yu, et al.
Pubblicazione: (2024)
di: Pan, Yu, et al.
Pubblicazione: (2024)
CodecFlow: Efficient Bandwidth Extension via Conditional Flow Matching in Neural Codec Latent Space
di: Zhang, Bowen, et al.
Pubblicazione: (2026)
di: Zhang, Bowen, et al.
Pubblicazione: (2026)
PTS-SNN: A Prompt-Tuned Temporal Shift Spiking Neural Networks for Efficient Speech Emotion Recognition
di: Su, Xun, et al.
Pubblicazione: (2026)
di: Su, Xun, et al.
Pubblicazione: (2026)
YMIR: A new Benchmark Dataset and Model for Arabic Yemeni Music Genre Classification Using Convolutional Neural Networks
di: AL-Makhlafi, Moeen, et al.
Pubblicazione: (2026)
di: AL-Makhlafi, Moeen, et al.
Pubblicazione: (2026)
Graph Embedding with Mel-spectrograms for Underwater Acoustic Target Recognition
di: Feng, Sheng, et al.
Pubblicazione: (2025)
di: Feng, Sheng, et al.
Pubblicazione: (2025)
Speech Emotion Recognition via Entropy-Aware Score Selection
di: Chua, ChenYi, et al.
Pubblicazione: (2025)
di: Chua, ChenYi, et al.
Pubblicazione: (2025)
CleanMel: Mel-Spectrogram Enhancement for Improving Both Speech Quality and ASR
di: Shao, Nian, et al.
Pubblicazione: (2025)
di: Shao, Nian, et al.
Pubblicazione: (2025)
Tutti: Expressive Multi-Singer Synthesis via Structure-Level Timbre Control and Vocal Texture Modeling
di: Chen, Jiatao, et al.
Pubblicazione: (2026)
di: Chen, Jiatao, et al.
Pubblicazione: (2026)
EvMic: Event-based Non-contact sound recovery from effective spatial-temporal modeling
di: Yin, Hao, et al.
Pubblicazione: (2025)
di: Yin, Hao, et al.
Pubblicazione: (2025)
A sound description: Exploring prompt templates and class descriptions to enhance zero-shot audio classification
di: Olvera, Michel, et al.
Pubblicazione: (2024)
di: Olvera, Michel, et al.
Pubblicazione: (2024)
ATIR: Towards Audio-Text Interleaved Contextual Retrieval
di: Zhao, Tong, et al.
Pubblicazione: (2026)
di: Zhao, Tong, et al.
Pubblicazione: (2026)
Exploring Speaker Diarization with Mixture of Experts
di: Yang, Gaobin, et al.
Pubblicazione: (2025)
di: Yang, Gaobin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LSZone: A Lightweight Spatial Information Modeling Architecture for Real-time In-car Multi-zone Speech Separation
di: Chen, Jun, et al.
Pubblicazione: (2025) -
Comparison of window shapes and lengths in short-time feature extraction for classification of heart sound signals
di: Fakhry, Mahmoud, et al.
Pubblicazione: (2026) -
Multi-modal expressive personality recognition in data non-ideal audiovisual based on multi-scale feature enhancement and modal augment
di: Kong, Weixuan, et al.
Pubblicazione: (2025) -
An investigation of AI integration in sound designer workflows and experiences
di: Garcia, Nelly, et al.
Pubblicazione: (2026) -
Multi-Task Learning for Lung sound & Lung disease classification
di: K V, Suma, et al.
Pubblicazione: (2024)