Physics-Informed Neural Networks for Speech Production
Fuente:
arXiv
Salvato in:
| Autori principali: | Yokota, Kazuya, Harakawa, Ryosuke, Baba, Masaaki, Iwahashi, Masahiro |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Identification of Physical Properties in Acoustic Tubes Using Physics-Informed Neural Networks
di: Yokota, Kazuya, et al.
Pubblicazione: (2024)
di: Yokota, Kazuya, et al.
Pubblicazione: (2024)
Acoustic Field Reconstruction in Tubes via Physics-Informed Neural Networks
di: Luan, Xinmeng, et al.
Pubblicazione: (2025)
di: Luan, Xinmeng, et al.
Pubblicazione: (2025)
Physics-informed neural network for acoustic resonance analysis in a one-dimensional acoustic tube
di: Yokota, Kazuya, et al.
Pubblicazione: (2023)
di: Yokota, Kazuya, et al.
Pubblicazione: (2023)
End-to-End Integration of Speech Emotion Recognition with Voice Activity Detection using Self-Supervised Learning Features
di: Yamashita, Natsuo, et al.
Pubblicazione: (2024)
di: Yamashita, Natsuo, et al.
Pubblicazione: (2024)
AffectCodec: Emotion-Preserving Neural Speech Codec for Expressive Speech Modeling
di: Shi, Jiacheng, et al.
Pubblicazione: (2026)
di: Shi, Jiacheng, et al.
Pubblicazione: (2026)
Phase-Retrieval-Based Physics-Informed Neural Networks For Acoustic Magnitude Field Reconstruction
di: Schrader, Karl, et al.
Pubblicazione: (2026)
di: Schrader, Karl, et al.
Pubblicazione: (2026)
Diffusion-based Signal Refiner for Speech Enhancement and Separation
di: Hirano, Masato, et al.
Pubblicazione: (2023)
di: Hirano, Masato, et al.
Pubblicazione: (2023)
Plugin Speech Enhancement: A Universal Speech Enhancement Framework Inspired by Dynamic Neural Network
di: Chen, Yanan, et al.
Pubblicazione: (2024)
di: Chen, Yanan, et al.
Pubblicazione: (2024)
ParaGSE: Parallel Generative Speech Enhancement with Group-Vector-Quantization-based Neural Speech Codec
di: Liu, Fei, et al.
Pubblicazione: (2026)
di: Liu, Fei, et al.
Pubblicazione: (2026)
EmoHRNet: High-Resolution Neural Network Based Speech Emotion Recognition
di: Muppidi, Akshay, et al.
Pubblicazione: (2025)
di: Muppidi, Akshay, et al.
Pubblicazione: (2025)
Evaluating Objective Speech Quality Metrics for Neural Audio Codecs
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
Neural Speech Separation with Parallel Amplitude and Phase Spectrum Estimation
di: Liu, Fei, et al.
Pubblicazione: (2025)
di: Liu, Fei, et al.
Pubblicazione: (2025)
Neural Speech Embeddings for Speech Synthesis Based on Deep Generative Networks
di: Lee, Seo-Hyun, et al.
Pubblicazione: (2023)
di: Lee, Seo-Hyun, et al.
Pubblicazione: (2023)
Recreating Neural Activity During Speech Production with Language and Speech Model Embeddings
di: Khanday, Owais Mujtaba, et al.
Pubblicazione: (2025)
di: Khanday, Owais Mujtaba, et al.
Pubblicazione: (2025)
Optimising Neural Speech Codecs for 300bps Communication using Reinforcement Learning
di: Wang, Junyi, et al.
Pubblicazione: (2026)
di: Wang, Junyi, et al.
Pubblicazione: (2026)
SuperCodec: A Neural Speech Codec with Selective Back-Projection Network
di: Zheng, Youqiang, et al.
Pubblicazione: (2024)
di: Zheng, Youqiang, et al.
Pubblicazione: (2024)
Auditory Attention Decoding without Spatial Information: A Diotic EEG Study
di: Yoshino, Masahiro, et al.
Pubblicazione: (2026)
di: Yoshino, Masahiro, et al.
Pubblicazione: (2026)
Neural Vocoders as Speech Enhancers
di: Li, Andong, et al.
Pubblicazione: (2025)
di: Li, Andong, et al.
Pubblicazione: (2025)
Personalized Neural Speech Codec
di: Jang, Inseon, et al.
Pubblicazione: (2024)
di: Jang, Inseon, et al.
Pubblicazione: (2024)
A Neural Speech Codec for Noise Robust Speech Coding
di: Huang, Jiayi, et al.
Pubblicazione: (2023)
di: Huang, Jiayi, et al.
Pubblicazione: (2023)
P2Mark: Plug-and-play Parameter-level Watermarking for Neural Speech Generation
di: Ren, Yong, et al.
Pubblicazione: (2025)
di: Ren, Yong, et al.
Pubblicazione: (2025)
AffectCodec: Emotion-Preserving Neural Speech Codec with Block-Diagonal Residual FSQ
di: Meng, Zhaoyang, et al.
Pubblicazione: (2026)
di: Meng, Zhaoyang, et al.
Pubblicazione: (2026)
Towards Orthographically-Informed Evaluation of Speech Recognition Systems for Indian Languages
di: Bhogale, Kaushal Santosh, et al.
Pubblicazione: (2026)
di: Bhogale, Kaushal Santosh, et al.
Pubblicazione: (2026)
Point Neuron Learning: A New Physics-Informed Neural Network Architecture
di: Bi, Hanwen, et al.
Pubblicazione: (2024)
di: Bi, Hanwen, et al.
Pubblicazione: (2024)
SACodec: Asymmetric Quantization with Semantic Anchoring for Low-Bitrate High-Fidelity Neural Speech Codecs
di: Dong, Zhongren, et al.
Pubblicazione: (2025)
di: Dong, Zhongren, et al.
Pubblicazione: (2025)
Quantifying Quanvolutional Neural Networks Robustness for Speech in Healthcare Applications
di: Tran, Ha, et al.
Pubblicazione: (2026)
di: Tran, Ha, et al.
Pubblicazione: (2026)
Physics-Informed Direction-Aware Neural Acoustic Fields
di: Masuyama, Yoshiki, et al.
Pubblicazione: (2025)
di: Masuyama, Yoshiki, et al.
Pubblicazione: (2025)
Distinguishing Neural Speech Synthesis Models Through Fingerprints in Speech Waveforms
di: Zhang, Chu Yuan, et al.
Pubblicazione: (2023)
di: Zhang, Chu Yuan, et al.
Pubblicazione: (2023)
PTS-SNN: A Prompt-Tuned Temporal Shift Spiking Neural Networks for Efficient Speech Emotion Recognition
di: Su, Xun, et al.
Pubblicazione: (2026)
di: Su, Xun, et al.
Pubblicazione: (2026)
Error-Resilient Semantic Communication for Speech Transmission over Packet-Loss Networks
di: Han, Zhuohang, et al.
Pubblicazione: (2025)
di: Han, Zhuohang, et al.
Pubblicazione: (2025)
Spectral Masking with Explicit Time-Context Windowing for Neural Network-Based Monaural Speech Enhancement
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2024)
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2024)
Speech-XL: Towards Long-Form Speech Understanding in Large Speech Language Models
di: Sun, Haoqin, et al.
Pubblicazione: (2026)
di: Sun, Haoqin, et al.
Pubblicazione: (2026)
Investigating Neural Audio Codecs for Speech Language Model-Based Speech Generation
di: Li, Jiaqi, et al.
Pubblicazione: (2024)
di: Li, Jiaqi, et al.
Pubblicazione: (2024)
A Dual-Stage Time-Context Network for Speech-Based Alzheimer's Disease Detection
di: Gao, Yifan, et al.
Pubblicazione: (2025)
di: Gao, Yifan, et al.
Pubblicazione: (2025)
DisCo-Speech: Controllable Zero-Shot Speech Generation with A Disentangled Speech Codec
di: Li, Tao, et al.
Pubblicazione: (2025)
di: Li, Tao, et al.
Pubblicazione: (2025)
Speech Synthesis By Unrolling Diffusion Process using Neural Network Layers
di: Ochieng, Peter
Pubblicazione: (2023)
di: Ochieng, Peter
Pubblicazione: (2023)
Dynamic Gated Recurrent Neural Network for Compute-efficient Speech Enhancement
di: Cheng, Longbiao, et al.
Pubblicazione: (2024)
di: Cheng, Longbiao, et al.
Pubblicazione: (2024)
Investigation of Deep Neural Network Acoustic Modelling Approaches for Low Resource Accented Mandarin Speech Recognition
di: Xie, Xurong, et al.
Pubblicazione: (2022)
di: Xie, Xurong, et al.
Pubblicazione: (2022)
Probing the Robustness Properties of Neural Speech Codecs
di: Tseng, Wei-Cheng, et al.
Pubblicazione: (2025)
di: Tseng, Wei-Cheng, et al.
Pubblicazione: (2025)
Fine-Grained and Interpretable Neural Speech Editing
di: Morrison, Max, et al.
Pubblicazione: (2024)
di: Morrison, Max, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Identification of Physical Properties in Acoustic Tubes Using Physics-Informed Neural Networks
di: Yokota, Kazuya, et al.
Pubblicazione: (2024) -
Acoustic Field Reconstruction in Tubes via Physics-Informed Neural Networks
di: Luan, Xinmeng, et al.
Pubblicazione: (2025) -
Physics-informed neural network for acoustic resonance analysis in a one-dimensional acoustic tube
di: Yokota, Kazuya, et al.
Pubblicazione: (2023) -
End-to-End Integration of Speech Emotion Recognition with Voice Activity Detection using Self-Supervised Learning Features
di: Yamashita, Natsuo, et al.
Pubblicazione: (2024) -
AffectCodec: Emotion-Preserving Neural Speech Codec for Expressive Speech Modeling
di: Shi, Jiacheng, et al.
Pubblicazione: (2026)