Vocal Tract Length Warped Features for Spoken Keyword Spotting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sarkar, Achintya kr., Dwivedi, Priyanka, Tan, Zheng-Hua |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Quantization-Based Score Calibration for Few-Shot Keyword Spotting with Dynamic Time Warping in Noisy Environments
par: Wilkinghoff, Kevin, et autres
Publié: (2025)
par: Wilkinghoff, Kevin, et autres
Publié: (2025)
Keyword Mamba: Spoken Keyword Spotting with State Space Models
par: Ding, Hanyu, et autres
Publié: (2025)
par: Ding, Hanyu, et autres
Publié: (2025)
SLiCK: Exploiting Subsequences for Length-Constrained Keyword Spotting
par: Nishu, Kumari, et autres
Publié: (2024)
par: Nishu, Kumari, et autres
Publié: (2024)
A Literature Review of Keyword Spotting Technologies for Urdu
par: Rizvi, Syed Muhammad Aqdas
Publié: (2024)
par: Rizvi, Syed Muhammad Aqdas
Publié: (2024)
Sparse Binarization for Fast Keyword Spotting
par: Svirsky, Jonathan, et autres
Publié: (2024)
par: Svirsky, Jonathan, et autres
Publié: (2024)
Feature Representations for Automatic Meerkat Vocalization Classification
par: Mahmoud, Imen Ben, et autres
Publié: (2024)
par: Mahmoud, Imen Ben, et autres
Publié: (2024)
Disentangled Training with Adversarial Examples For Robust Small-footprint Keyword Spotting
par: Wang, Zhenyu, et autres
Publié: (2024)
par: Wang, Zhenyu, et autres
Publié: (2024)
Contrastive Augmentation: An Unsupervised Learning Approach for Keyword Spotting in Speech Technology
par: Dai, Weinan, et autres
Publié: (2024)
par: Dai, Weinan, et autres
Publié: (2024)
Keyword Spotting with Hyper-Matched Filters for Small Footprint Devices
par: Segal-Feldman, Yael, et autres
Publié: (2025)
par: Segal-Feldman, Yael, et autres
Publié: (2025)
Adversarial training of Keyword Spotting to Minimize TTS Data Overfitting
par: Park, Hyun Jin, et autres
Publié: (2024)
par: Park, Hyun Jin, et autres
Publié: (2024)
Enhancing Neural Spoken Language Recognition: An Exploration with Multilingual Datasets
par: Anidjar, Or Haim, et autres
Publié: (2025)
par: Anidjar, Or Haim, et autres
Publié: (2025)
Recognizing Ornaments in Vocal Indian Art Music with Active Annotation
par: Kumar, Sumit, et autres
Publié: (2025)
par: Kumar, Sumit, et autres
Publié: (2025)
End-to-End User-Defined Keyword Spotting using Shifted Delta Coefficients
par: V, Kesavaraj, et autres
Publié: (2024)
par: V, Kesavaraj, et autres
Publié: (2024)
CTC-aligned Audio-Text Embedding for Streaming Open-vocabulary Keyword Spotting
par: Jin, Sichen, et autres
Publié: (2024)
par: Jin, Sichen, et autres
Publié: (2024)
Hierarchical Generative Modeling of Melodic Vocal Contours in Hindustani Classical Music
par: Shikarpur, Nithya, et autres
Publié: (2024)
par: Shikarpur, Nithya, et autres
Publié: (2024)
Adaptive Noise Resilient Keyword Spotting Using One-Shot Learning
par: Martinez-Rau, Luciano Sebastian, et autres
Publié: (2025)
par: Martinez-Rau, Luciano Sebastian, et autres
Publié: (2025)
Utilizing TTS Synthesized Data for Efficient Development of Keyword Spotting Model
par: Park, Hyun Jin, et autres
Publié: (2024)
par: Park, Hyun Jin, et autres
Publié: (2024)
OnDA: On-device Channel Pruning for Efficient Personalized Keyword Spotting
par: Risso, Matteo, et autres
Publié: (2026)
par: Risso, Matteo, et autres
Publié: (2026)
MADUV: The 1st INTERSPEECH Mice Autism Detection via Ultrasound Vocalization Challenge
par: Yang, Zijiang, et autres
Publié: (2025)
par: Yang, Zijiang, et autres
Publié: (2025)
Frequency & Channel Attention Network for Small Footprint Noisy Spoken Keyword Spotting
par: Lin, Yuanxi, et autres
Publié: (2024)
par: Lin, Yuanxi, et autres
Publié: (2024)
Self-Learning for Personalized Keyword Spotting on Ultra-Low-Power Audio Sensors
par: Rusci, Manuele, et autres
Publié: (2024)
par: Rusci, Manuele, et autres
Publié: (2024)
WavReward: Spoken Dialogue Models With Generalist Reward Evaluators
par: Ji, Shengpeng, et autres
Publié: (2025)
par: Ji, Shengpeng, et autres
Publié: (2025)
On-Device Domain Learning for Keyword Spotting on Low-Power Extreme Edge Embedded Systems
par: Cioflan, Cristian, et autres
Publié: (2024)
par: Cioflan, Cristian, et autres
Publié: (2024)
ED-sKWS: Early-Decision Spiking Neural Networks for Rapid,and Energy-Efficient Keyword Spotting
par: Song, Zeyang, et autres
Publié: (2024)
par: Song, Zeyang, et autres
Publié: (2024)
Coding Speech through Vocal Tract Kinematics
par: Cho, Cheol Jun, et autres
Publié: (2024)
par: Cho, Cheol Jun, et autres
Publié: (2024)
AnalyticKWS: Towards Exemplar-Free Analytic Class Incremental Learning for Small-footprint Keyword Spotting
par: Xiao, Yang, et autres
Publié: (2025)
par: Xiao, Yang, et autres
Publié: (2025)
Noise-Robust Keyword Spotting through Self-supervised Pretraining
par: Mørk, Jacob, et autres
Publié: (2024)
par: Mørk, Jacob, et autres
Publié: (2024)
Vocoder-Projected Feature Discriminator
par: Kaneko, Takuhiro, et autres
Publié: (2025)
par: Kaneko, Takuhiro, et autres
Publié: (2025)
Multi-Sample Dynamic Time Warping for Few-Shot Keyword Spotting
par: Wilkinghoff, Kevin, et autres
Publié: (2024)
par: Wilkinghoff, Kevin, et autres
Publié: (2024)
Steering Autoregressive Music Generation with Recursive Feature Machines
par: Zhao, Daniel, et autres
Publié: (2025)
par: Zhao, Daniel, et autres
Publié: (2025)
Pre-training Feature Guided Diffusion Model for Speech Enhancement
par: Yang, Yiyuan, et autres
Publié: (2024)
par: Yang, Yiyuan, et autres
Publié: (2024)
Predicting Individual Depression Symptoms from Acoustic Features During Speech
par: Rodriguez, Sebastian, et autres
Publié: (2024)
par: Rodriguez, Sebastian, et autres
Publié: (2024)
Spoken Language Intelligence of Large Language Models for Language Learning
par: Peng, Linkai, et autres
Publié: (2023)
par: Peng, Linkai, et autres
Publié: (2023)
ProKWS: Personalized Keyword Spotting via Collaborative Learning of Phonemes and Prosody
par: Pan, Jianan, et autres
Publié: (2026)
par: Pan, Jianan, et autres
Publié: (2026)
VocalAgent: Large Language Models for Vocal Health Diagnostics with Safety-Aware Evaluation
par: Kim, Yubin, et autres
Publié: (2025)
par: Kim, Yubin, et autres
Publié: (2025)
Reproducible Machine Learning-based Voice Pathology Detection: Introducing the Pitch Difference Feature
par: Vrba, Jan, et autres
Publié: (2024)
par: Vrba, Jan, et autres
Publié: (2024)
A Variational Framework for Improving Naturalness in Generative Spoken Language Models
par: Chen, Li-Wei, et autres
Publié: (2025)
par: Chen, Li-Wei, et autres
Publié: (2025)
A Novel Hybrid Deep Learning Technique for Speech Emotion Detection using Feature Engineering
par: Chowdhury, Shahana Yasmin, et autres
Publié: (2025)
par: Chowdhury, Shahana Yasmin, et autres
Publié: (2025)
Multiple-Instance, Cascaded Classification for Keyword Spotting in Narrow-Band Audio
par: AbdulKader, Ahmad, et autres
Publié: (2017)
par: AbdulKader, Ahmad, et autres
Publié: (2017)
DSpAST: Disentangled Representations for Spatial Audio Reasoning with Large Language Models
par: Wilkinghoff, Kevin, et autres
Publié: (2025)
par: Wilkinghoff, Kevin, et autres
Publié: (2025)
Documents similaires
-
Quantization-Based Score Calibration for Few-Shot Keyword Spotting with Dynamic Time Warping in Noisy Environments
par: Wilkinghoff, Kevin, et autres
Publié: (2025) -
Keyword Mamba: Spoken Keyword Spotting with State Space Models
par: Ding, Hanyu, et autres
Publié: (2025) -
SLiCK: Exploiting Subsequences for Length-Constrained Keyword Spotting
par: Nishu, Kumari, et autres
Publié: (2024) -
A Literature Review of Keyword Spotting Technologies for Urdu
par: Rizvi, Syed Muhammad Aqdas
Publié: (2024) -
Sparse Binarization for Fast Keyword Spotting
par: Svirsky, Jonathan, et autres
Publié: (2024)