Continuous Telemonitoring of Heart Failure using Personalised Speech Dynamics
Fuente:
arXiv
Guardado en:
| Autores principales: | Pan, Yue, Wang, Xingyao, Zhang, Hanyue, Liu, Liwei, Li, Changxin, Yang, Gang, Sheng, Rong, Xia, Yili, Chu, Ming |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Chinese Heart Failure Status Speech Database with Universal and Personalised Classification
por: Pan, Yue, et al.
Publicado: (2025)
por: Pan, Yue, et al.
Publicado: (2025)
SyncSpeech: Efficient and Low-Latency Text-to-Speech based on Temporal Masked Transformer
por: Sheng, Zhengyan, et al.
Publicado: (2025)
por: Sheng, Zhengyan, et al.
Publicado: (2025)
Dynamic Fusion Multimodal Network for SpeechWellness Detection
por: Sun, Wenqiang, et al.
Publicado: (2025)
por: Sun, Wenqiang, et al.
Publicado: (2025)
WESR: Scaling and Evaluating Word-level Event-Speech Recognition
por: Yang, Chenchen, et al.
Publicado: (2026)
por: Yang, Chenchen, et al.
Publicado: (2026)
Predicting Heart Activity from Speech using Data-driven and Knowledge-based features
por: Elbanna, Gasser, et al.
Publicado: (2024)
por: Elbanna, Gasser, et al.
Publicado: (2024)
Elastic Net Regularization and Gabor Dictionary for Classification of Heart Sound Signals using Deep Learning
por: Fakhry, Mahmoud, et al.
Publicado: (2026)
por: Fakhry, Mahmoud, et al.
Publicado: (2026)
SOLIDO: A Robust Watermarking Method for Speech Synthesis via Low-Rank Adaptation
por: Li, Yue, et al.
Publicado: (2025)
por: Li, Yue, et al.
Publicado: (2025)
Quantize More, Lose Less: Autoregressive Generation from Residually Quantized Speech Representations
por: Han, Yichen, et al.
Publicado: (2025)
por: Han, Yichen, et al.
Publicado: (2025)
Content-based Controls For Music Large Language Modeling
por: Lin, Liwei, et al.
Publicado: (2023)
por: Lin, Liwei, et al.
Publicado: (2023)
Arrange, Inpaint, and Refine: Steerable Long-term Music Audio Generation and Editing via Content-based Controls
por: Lin, Liwei, et al.
Publicado: (2024)
por: Lin, Liwei, et al.
Publicado: (2024)
PSCodec: A Series of High-Fidelity Low-bitrate Neural Speech Codecs Leveraging Prompt Encoders
por: Pan, Yu, et al.
Publicado: (2024)
por: Pan, Yu, et al.
Publicado: (2024)
DDSP-QbE++: Improving Speech Quality for Speech Anonymisation for Atypical Speech
por: Ghosh, Suhita, et al.
Publicado: (2026)
por: Ghosh, Suhita, et al.
Publicado: (2026)
GSRM: Generative Speech Reward Model for Speech RLHF
por: Shen, Maohao, et al.
Publicado: (2026)
por: Shen, Maohao, et al.
Publicado: (2026)
Compose Yourself: Average-Velocity Flow Matching for One-Step Speech Enhancement
por: Yang, Gang, et al.
Publicado: (2025)
por: Yang, Gang, et al.
Publicado: (2025)
AudioCapBench: Quick Evaluation on Audio Captioning across Sound, Music, and Speech
por: Qiu, Jielin, et al.
Publicado: (2026)
por: Qiu, Jielin, et al.
Publicado: (2026)
Understanding Frechet Speech Distance for Synthetic Speech Quality Evaluation
por: Kim, June-Woo, et al.
Publicado: (2026)
por: Kim, June-Woo, et al.
Publicado: (2026)
SLM-SS: Speech Language Model for Generative Speech Separation
por: Li, Tianhua, et al.
Publicado: (2026)
por: Li, Tianhua, et al.
Publicado: (2026)
TopSeg: A Multi-Scale Topological Framework for Data-Efficient Heart Sound Segmentation
por: Zhang, Peihong, et al.
Publicado: (2025)
por: Zhang, Peihong, et al.
Publicado: (2025)
Fake Speech Wild: Detecting Deepfake Speech on Social Media Platform
por: Xie, Yuankun, et al.
Publicado: (2025)
por: Xie, Yuankun, et al.
Publicado: (2025)
SpeechQualityLLM: LLM-Based Multimodal Assessment of Speech Quality
por: Monjur, Mahathir, et al.
Publicado: (2025)
por: Monjur, Mahathir, et al.
Publicado: (2025)
SlimSpeech: Lightweight and Efficient Text-to-Speech with Slim Rectified Flow
por: Wang, Kaidi, et al.
Publicado: (2025)
por: Wang, Kaidi, et al.
Publicado: (2025)
UniSS: Unified Expressive Speech-to-Speech Translation with Your Voice
por: Cheng, Sitong, et al.
Publicado: (2025)
por: Cheng, Sitong, et al.
Publicado: (2025)
Human or Machine? A Preliminary Turing Test for Speech-to-Speech Interaction
por: Li, Xiang, et al.
Publicado: (2026)
por: Li, Xiang, et al.
Publicado: (2026)
Emotional Text-To-Speech Based on Mutual-Information-Guided Emotion-Timbre Disentanglement
por: Yang, Jianing, et al.
Publicado: (2025)
por: Yang, Jianing, et al.
Publicado: (2025)
Enabling Automatic Disordered Speech Recognition: An Impaired Speech Dataset in the Akan Language
por: Wiafe, Isaac, et al.
Publicado: (2026)
por: Wiafe, Isaac, et al.
Publicado: (2026)
Facial Expression-Enhanced TTS: Combining Face Representation and Emotion Intensity for Adaptive Speech
por: Chu, Yunji, et al.
Publicado: (2024)
por: Chu, Yunji, et al.
Publicado: (2024)
Flamed-TTS: Flow Matching Attention-Free Models for Efficient Generating and Dynamic Pacing Zero-shot Text-to-Speech
por: Huynh-Nguyen, Hieu-Nghia, et al.
Publicado: (2025)
por: Huynh-Nguyen, Hieu-Nghia, et al.
Publicado: (2025)
An Investigation of Incorporating Mamba for Speech Enhancement
por: Chao, Rong, et al.
Publicado: (2024)
por: Chao, Rong, et al.
Publicado: (2024)
Speech Recognition on TV Series with Video-guided Post-ASR Correction
por: Yang, Haoyuan, et al.
Publicado: (2025)
por: Yang, Haoyuan, et al.
Publicado: (2025)
MF-Speech: Achieving Fine-Grained and Compositional Control in Speech Generation via Factor Disentanglement
por: Yu, Xinyue, et al.
Publicado: (2025)
por: Yu, Xinyue, et al.
Publicado: (2025)
MultiAPI Spoof: A Multi-API Dataset and Local-Attention Network for Speech Anti-spoofing Detection
por: Zhang, Xueping, et al.
Publicado: (2025)
por: Zhang, Xueping, et al.
Publicado: (2025)
Beyond Fixed Frames: Dynamic Character-Aligned Speech Tokenization
por: Della Libera, Luca, et al.
Publicado: (2026)
por: Della Libera, Luca, et al.
Publicado: (2026)
MTAVG-Bench 2.0: Diagnosing Failure Modes of Cinematic Expressiveness in Multi-Talker Audio-Video Generation
por: Li, Haitian, et al.
Publicado: (2026)
por: Li, Haitian, et al.
Publicado: (2026)
EZhouNet:A framework based on graph neural network and anchor interval for the respiratory sound event detection
por: Chu, Yun, et al.
Publicado: (2025)
por: Chu, Yun, et al.
Publicado: (2025)
Speech-Audio Compositional Attacks on Multimodal LLMs and Their Mitigation with SALMONN-Guard
por: Yang, Yudong, et al.
Publicado: (2025)
por: Yang, Yudong, et al.
Publicado: (2025)
ArtiFree: Detecting and Reducing Generative Artifacts in Diffusion-based Speech Enhancement
por: Chhaglani, Bhawana, et al.
Publicado: (2025)
por: Chhaglani, Bhawana, et al.
Publicado: (2025)
VividVoice: A Unified Framework for Scene-Aware Visually-Driven Speech Synthesis
por: Ma, Chengyuan, et al.
Publicado: (2026)
por: Ma, Chengyuan, et al.
Publicado: (2026)
MERaLiON-SER: Robust Speech Emotion Recognition Model for English and SEA Languages
por: Sailor, Hardik B., et al.
Publicado: (2025)
por: Sailor, Hardik B., et al.
Publicado: (2025)
A Novel Automatic Framework for Speaker Drift Detection in Synthesized Speech
por: Huang, Jia-Hong, et al.
Publicado: (2026)
por: Huang, Jia-Hong, et al.
Publicado: (2026)
Accelerating Autoregressive Speech Synthesis Inference With Speech Speculative Decoding
por: Lin, Zijian, et al.
Publicado: (2025)
por: Lin, Zijian, et al.
Publicado: (2025)
Ejemplares similares
-
A Chinese Heart Failure Status Speech Database with Universal and Personalised Classification
por: Pan, Yue, et al.
Publicado: (2025) -
SyncSpeech: Efficient and Low-Latency Text-to-Speech based on Temporal Masked Transformer
por: Sheng, Zhengyan, et al.
Publicado: (2025) -
Dynamic Fusion Multimodal Network for SpeechWellness Detection
por: Sun, Wenqiang, et al.
Publicado: (2025) -
WESR: Scaling and Evaluating Word-level Event-Speech Recognition
por: Yang, Chenchen, et al.
Publicado: (2026) -
Predicting Heart Activity from Speech using Data-driven and Knowledge-based features
por: Elbanna, Gasser, et al.
Publicado: (2024)