Salvato in:
| Autori principali: | Myrgyyassov, Alisher, Wang, Bruce Xiao, Sun, Yu, Huang, Shuming, Song, Zhen, Wong, Min Ney, Zheng, Yongping |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2603.03350 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Anonymising Elderly and Pathological Speech: Voice Conversion Using DDSP and Query-by-Example
di: Ghosh, Suhita, et al.
Pubblicazione: (2024)
di: Ghosh, Suhita, et al.
Pubblicazione: (2024)
Temporal Feature Learning in Weakly Labelled Bioacoustic Cetacean Datasets via a Variational Autoencoder and Temporal Convolutional Network: An Interdisciplinary Approach
di: Fonollosa, Laia Garrobé, et al.
Pubblicazione: (2024)
di: Fonollosa, Laia Garrobé, et al.
Pubblicazione: (2024)
Computational bioacoustics with deep learning: a review and roadmap
di: Stowell, Dan
Pubblicazione: (2021)
di: Stowell, Dan
Pubblicazione: (2021)
Adaptive Representations of Sound for Automatic Insect Recognition
di: Faiß, Marius, et al.
Pubblicazione: (2023)
di: Faiß, Marius, et al.
Pubblicazione: (2023)
Learning to detect an animal sound from five examples
di: Nolasco, Inês, et al.
Pubblicazione: (2023)
di: Nolasco, Inês, et al.
Pubblicazione: (2023)
Fish Tracking, Counting, and Behaviour Analysis in Digital Aquaculture: A Comprehensive Survey
di: Cui, Meng, et al.
Pubblicazione: (2024)
di: Cui, Meng, et al.
Pubblicazione: (2024)
Learning to rumble: Automated elephant call classification, detection and endpointing using deep architectures
di: Geldenhuys, Christiaan M., et al.
Pubblicazione: (2024)
di: Geldenhuys, Christiaan M., et al.
Pubblicazione: (2024)
Cochlear Wave Propagation and Dynamics in the Human Base and Apex: Model-Based Estimates from Noninvasive Measurements
di: Alkhairy, Samiya A
Pubblicazione: (2024)
di: Alkhairy, Samiya A
Pubblicazione: (2024)
Rene: A Pre-trained Multi-modal Architecture for Auscultation of Respiratory Diseases
di: Zhang, Pengfei, et al.
Pubblicazione: (2024)
di: Zhang, Pengfei, et al.
Pubblicazione: (2024)
A Classification Benchmark for Artificial Intelligence Detection of Laryngeal Cancer from Patient Voice
di: Paterson, Mary, et al.
Pubblicazione: (2024)
di: Paterson, Mary, et al.
Pubblicazione: (2024)
Which Augmentation Should I Use? An Empirical Investigation of Augmentations for Self-Supervised Phonocardiogram Representation Learning
di: Ballas, Aristotelis, et al.
Pubblicazione: (2023)
di: Ballas, Aristotelis, et al.
Pubblicazione: (2023)
Automatic detection of Mild Cognitive Impairment using high-dimensional acoustic features in spontaneous speech
di: Zhang, Cong, et al.
Pubblicazione: (2024)
di: Zhang, Cong, et al.
Pubblicazione: (2024)
Screening method for early dementia using sound objects as voice biomarkers
di: Pluta, Adam, et al.
Pubblicazione: (2024)
di: Pluta, Adam, et al.
Pubblicazione: (2024)
Foundation Models for Bioacoustics -- a Comparative Review
di: Schwinger, Raphael, et al.
Pubblicazione: (2025)
di: Schwinger, Raphael, et al.
Pubblicazione: (2025)
From Birdsong to Rumbles: Classifying Elephant Calls with Out-of-Species Embeddings
di: Geldenhuys, Christiaan M., et al.
Pubblicazione: (2026)
di: Geldenhuys, Christiaan M., et al.
Pubblicazione: (2026)
Prosody of speech production in latent post-stroke aphasia
di: Zhang, Cong, et al.
Pubblicazione: (2024)
di: Zhang, Cong, et al.
Pubblicazione: (2024)
All Thresholds Barred: Direct Estimation of Call Density in Bioacoustic Data
di: Navine, Amanda K., et al.
Pubblicazione: (2024)
di: Navine, Amanda K., et al.
Pubblicazione: (2024)
Multi Modal Information Fusion of Acoustic and Linguistic Data for Decoding Dairy Cow Vocalizations in Animal Welfare Assessment
di: Jobarteh, Bubacarr, et al.
Pubblicazione: (2024)
di: Jobarteh, Bubacarr, et al.
Pubblicazione: (2024)
animal2vec and MeerKAT: A self-supervised transformer for rare-event raw audio input and a large-scale reference dataset for bioacoustics
di: Schäfer-Zimmermann, Julian C., et al.
Pubblicazione: (2024)
di: Schäfer-Zimmermann, Julian C., et al.
Pubblicazione: (2024)
Chunked Attention-based Encoder-Decoder Model for Streaming Speech Recognition
di: Zeineldeen, Mohammad, et al.
Pubblicazione: (2023)
di: Zeineldeen, Mohammad, et al.
Pubblicazione: (2023)
Sequence-Level Unsupervised Training in Speech Recognition: A Theoretical Study
di: Yang, Zijian, et al.
Pubblicazione: (2026)
di: Yang, Zijian, et al.
Pubblicazione: (2026)
Right Label Context in End-to-End Training of Time-Synchronous ASR Models
di: Raissi, Tina, et al.
Pubblicazione: (2025)
di: Raissi, Tina, et al.
Pubblicazione: (2025)
Atrial Fibrillation Detection System via Acoustic Sensing for Mobile Phones
di: Liu, Xuanyu, et al.
Pubblicazione: (2024)
di: Liu, Xuanyu, et al.
Pubblicazione: (2024)
WhaleVAD-BPN: Improving Baleen Whale Call Detection with Boundary Proposal Networks and Post-processing Optimisation
di: Geldenhuys, Christiaan M., et al.
Pubblicazione: (2025)
di: Geldenhuys, Christiaan M., et al.
Pubblicazione: (2025)
Vision-Integrated High-Quality Neural Speech Coding
di: Guo, Yao, et al.
Pubblicazione: (2025)
di: Guo, Yao, et al.
Pubblicazione: (2025)
Conformer-based Ultrasound-to-Speech Conversion
di: Ibrahimov, Ibrahim, et al.
Pubblicazione: (2025)
di: Ibrahimov, Ibrahim, et al.
Pubblicazione: (2025)
SpeechEditBench: A Bilingual Multi-Attribute Benchmark for Instruction-Guided Speech Editing
di: Zhang, Hanlin, et al.
Pubblicazione: (2026)
di: Zhang, Hanlin, et al.
Pubblicazione: (2026)
Multi-Stage Speech Bandwidth Extension with Flexible Sampling Rate Control
di: Lu, Ye-Xin, et al.
Pubblicazione: (2024)
di: Lu, Ye-Xin, et al.
Pubblicazione: (2024)
Investigating the Effect of Label Topology and Training Criterion on ASR Performance and Alignment Quality
di: Raissi, Tina, et al.
Pubblicazione: (2024)
di: Raissi, Tina, et al.
Pubblicazione: (2024)
Low-Latency Neural Speech Phase Prediction based on Parallel Estimation Architecture and Anti-Wrapping Losses for Speech Generation Tasks
di: Ai, Yang, et al.
Pubblicazione: (2024)
di: Ai, Yang, et al.
Pubblicazione: (2024)
SuperCodec: A Neural Speech Codec with Selective Back-Projection Network
di: Zheng, Youqiang, et al.
Pubblicazione: (2024)
di: Zheng, Youqiang, et al.
Pubblicazione: (2024)
AntiDeepFake: AI for Deep Fake Speech Recognition
di: Togootogtokh, Enkhtogtokh, et al.
Pubblicazione: (2024)
di: Togootogtokh, Enkhtogtokh, et al.
Pubblicazione: (2024)
All Neural Low-latency Directional Speech Extraction
di: Pandey, Ashutosh, et al.
Pubblicazione: (2024)
di: Pandey, Ashutosh, et al.
Pubblicazione: (2024)
Investigating Neural Audio Codecs for Speech Language Model-Based Speech Generation
di: Li, Jiaqi, et al.
Pubblicazione: (2024)
di: Li, Jiaqi, et al.
Pubblicazione: (2024)
On the Importance of Neural Wiener Filter for Resource Efficient Multichannel Speech Enhancement
di: Hsieh, Tsun-An, et al.
Pubblicazione: (2024)
di: Hsieh, Tsun-An, et al.
Pubblicazione: (2024)
Universal Preference-Score-based Pairwise Speech Quality Assessment
di: Shi, Yu-Fei, et al.
Pubblicazione: (2025)
di: Shi, Yu-Fei, et al.
Pubblicazione: (2025)
Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora
di: Suda, Hitoshi, et al.
Pubblicazione: (2025)
di: Suda, Hitoshi, et al.
Pubblicazione: (2025)
Regularizing Learnable Feature Extraction for Automatic Speech Recognition
di: Vieting, Peter, et al.
Pubblicazione: (2025)
di: Vieting, Peter, et al.
Pubblicazione: (2025)
Deep Speech Synthesis from Multimodal Articulatory Representations
di: Wu, Peter, et al.
Pubblicazione: (2024)
di: Wu, Peter, et al.
Pubblicazione: (2024)
ToneUnit: A Speech Discretization Approach for Tonal Language Speech Synthesis
di: Tao, Dehua, et al.
Pubblicazione: (2024)
di: Tao, Dehua, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Anonymising Elderly and Pathological Speech: Voice Conversion Using DDSP and Query-by-Example
di: Ghosh, Suhita, et al.
Pubblicazione: (2024) -
Temporal Feature Learning in Weakly Labelled Bioacoustic Cetacean Datasets via a Variational Autoencoder and Temporal Convolutional Network: An Interdisciplinary Approach
di: Fonollosa, Laia Garrobé, et al.
Pubblicazione: (2024) -
Computational bioacoustics with deep learning: a review and roadmap
di: Stowell, Dan
Pubblicazione: (2021) -
Adaptive Representations of Sound for Automatic Insect Recognition
di: Faiß, Marius, et al.
Pubblicazione: (2023) -
Learning to detect an animal sound from five examples
di: Nolasco, Inês, et al.
Pubblicazione: (2023)