SLiCK: Exploiting Subsequences for Length-Constrained Keyword Spotting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nishu, Kumari, Cho, Minsik, Naik, Devang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving vision-inspired keyword spotting using dynamic module skipping in streaming conformer encoder
par: Bittar, Alexandre, et autres
Publié: (2023)
par: Bittar, Alexandre, et autres
Publié: (2023)
Sparse Binarization for Fast Keyword Spotting
par: Svirsky, Jonathan, et autres
Publié: (2024)
par: Svirsky, Jonathan, et autres
Publié: (2024)
Lightweight DNN for Full-Band Speech Denoising on Mobile Devices: Exploiting Long and Short Temporal Patterns
par: Drossos, Konstantinos, et autres
Publié: (2025)
par: Drossos, Konstantinos, et autres
Publié: (2025)
Vocal Tract Length Warped Features for Spoken Keyword Spotting
par: Sarkar, Achintya kr., et autres
Publié: (2025)
par: Sarkar, Achintya kr., et autres
Publié: (2025)
Adversarial training of Keyword Spotting to Minimize TTS Data Overfitting
par: Park, Hyun Jin, et autres
Publié: (2024)
par: Park, Hyun Jin, et autres
Publié: (2024)
Keyword Spotting with Hyper-Matched Filters for Small Footprint Devices
par: Segal-Feldman, Yael, et autres
Publié: (2025)
par: Segal-Feldman, Yael, et autres
Publié: (2025)
Utilizing TTS Synthesized Data for Efficient Development of Keyword Spotting Model
par: Park, Hyun Jin, et autres
Publié: (2024)
par: Park, Hyun Jin, et autres
Publié: (2024)
Adaptive Noise Resilient Keyword Spotting Using One-Shot Learning
par: Martinez-Rau, Luciano Sebastian, et autres
Publié: (2025)
par: Martinez-Rau, Luciano Sebastian, et autres
Publié: (2025)
OnDA: On-device Channel Pruning for Efficient Personalized Keyword Spotting
par: Risso, Matteo, et autres
Publié: (2026)
par: Risso, Matteo, et autres
Publié: (2026)
Self-Learning for Personalized Keyword Spotting on Ultra-Low-Power Audio Sensors
par: Rusci, Manuele, et autres
Publié: (2024)
par: Rusci, Manuele, et autres
Publié: (2024)
On-Device Domain Learning for Keyword Spotting on Low-Power Extreme Edge Embedded Systems
par: Cioflan, Cristian, et autres
Publié: (2024)
par: Cioflan, Cristian, et autres
Publié: (2024)
AnalyticKWS: Towards Exemplar-Free Analytic Class Incremental Learning for Small-footprint Keyword Spotting
par: Xiao, Yang, et autres
Publié: (2025)
par: Xiao, Yang, et autres
Publié: (2025)
Self-Tuning Spectral Clustering for Speaker Diarization
par: Raghav, Nikhil, et autres
Publié: (2024)
par: Raghav, Nikhil, et autres
Publié: (2024)
Point Neuron Learning: A New Physics-Informed Neural Network Architecture
par: Bi, Hanwen, et autres
Publié: (2024)
par: Bi, Hanwen, et autres
Publié: (2024)
GLA-Grad: A Griffin-Lim Extended Waveform Generation Diffusion Model
par: Liu, Haocheng, et autres
Publié: (2024)
par: Liu, Haocheng, et autres
Publié: (2024)
Blind Estimation of Sub-band Acoustic Parameters from Ambisonics Recordings using Spectro-Spatial Covariance Features
par: Meng, Hanyu, et autres
Publié: (2024)
par: Meng, Hanyu, et autres
Publié: (2024)
Speech Watermarking with Discrete Intermediate Representations
par: Ji, Shengpeng, et autres
Publié: (2024)
par: Ji, Shengpeng, et autres
Publié: (2024)
Listenable Maps for Zero-Shot Audio Classifiers
par: Paissan, Francesco, et autres
Publié: (2024)
par: Paissan, Francesco, et autres
Publié: (2024)
PeriodGrad: Towards Pitch-Controllable Neural Vocoder Based on a Diffusion Probabilistic Model
par: Hono, Yukiya, et autres
Publié: (2024)
par: Hono, Yukiya, et autres
Publié: (2024)
EmotionCaps: Enhancing Audio Captioning Through Emotion-Augmented Data Generation
par: Manivannan, Mithun, et autres
Publié: (2024)
par: Manivannan, Mithun, et autres
Publié: (2024)
FunnelNet: An End-to-End Deep Learning Framework to Monitor Digital Heart Murmur in Real-Time
par: Jobayer, Md, et autres
Publié: (2024)
par: Jobayer, Md, et autres
Publié: (2024)
Online speaker diarization of meetings guided by speech separation
par: Gruttadauria, Elio, et autres
Publié: (2024)
par: Gruttadauria, Elio, et autres
Publié: (2024)
Listenable Maps for Audio Classifiers
par: Paissan, Francesco, et autres
Publié: (2024)
par: Paissan, Francesco, et autres
Publié: (2024)
Intelligent Fault Diagnosis of Type and Severity in Low-Frequency, Low Bit-Depth Signals
par: Spadini, Tito, et autres
Publié: (2024)
par: Spadini, Tito, et autres
Publié: (2024)
Remixing Music for Hearing Aids Using Ensemble of Fine-Tuned Source Separators
par: Daly, Matthew
Publié: (2024)
par: Daly, Matthew
Publié: (2024)
A Physics-Informed Neural Network-Based Approach for the Spatial Upsampling of Spherical Microphone Arrays
par: Miotello, Federico, et autres
Publié: (2024)
par: Miotello, Federico, et autres
Publié: (2024)
SpecDiff-GAN: A Spectrally-Shaped Noise Diffusion GAN for Speech and Music Synthesis
par: Baoueb, Teysir, et autres
Publié: (2024)
par: Baoueb, Teysir, et autres
Publié: (2024)
CochCeps-Augment: A Novel Self-Supervised Contrastive Learning Using Cochlear Cepstrum-based Masking for Speech Emotion Recognition
par: Ziogas, Ioannis, et autres
Publié: (2024)
par: Ziogas, Ioannis, et autres
Publié: (2024)
Room Transfer Function Reconstruction Using Complex-valued Neural Networks and Irregularly Distributed Microphones
par: Ronchini, Francesca, et autres
Publié: (2024)
par: Ronchini, Francesca, et autres
Publié: (2024)
Resampling Filter Design for Multirate Neural Audio Effect Processing
par: Carson, Alistair, et autres
Publié: (2025)
par: Carson, Alistair, et autres
Publié: (2025)
Joint Source-Environment Adaptation for Deep Learning-Based Underwater Acoustic Source Ranging
par: Kari, Dariush, et autres
Publié: (2025)
par: Kari, Dariush, et autres
Publié: (2025)
Adaptive Control Attention Network for Underwater Acoustic Localization and Domain Adaptation
par: Vo, Quoc Thinh, et autres
Publié: (2025)
par: Vo, Quoc Thinh, et autres
Publié: (2025)
Resource-Efficient Separation Transformer
par: Della Libera, Luca, et autres
Publié: (2022)
par: Della Libera, Luca, et autres
Publié: (2022)
A Power-Weighted Noncentral Complex Gaussian Distribution
par: Nakashika, Toru
Publié: (2026)
par: Nakashika, Toru
Publié: (2026)
Reconstruction of Sound Field through Diffusion Models
par: Miotello, Federico, et autres
Publié: (2023)
par: Miotello, Federico, et autres
Publié: (2023)
FlowDec: A flow-based full-band general audio codec with high perceptual quality
par: Welker, Simon, et autres
Publié: (2025)
par: Welker, Simon, et autres
Publié: (2025)
Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models
par: Baoueb, Teysir, et autres
Publié: (2025)
par: Baoueb, Teysir, et autres
Publié: (2025)
A Generalized Bandsplit Neural Network for Cinematic Audio Source Separation
par: Watcharasupat, Karn N., et autres
Publié: (2023)
par: Watcharasupat, Karn N., et autres
Publié: (2023)
Mismatch-Robust Underwater Acoustic Localization Using A Differentiable Modular Forward Model
par: Kari, Dariush, et autres
Publié: (2025)
par: Kari, Dariush, et autres
Publié: (2025)
A DNN Based Post-Filter to Enhance the Quality of Coded Speech in MDCT Domain
par: Gupta, Kishan, et autres
Publié: (2022)
par: Gupta, Kishan, et autres
Publié: (2022)
Documents similaires
-
Improving vision-inspired keyword spotting using dynamic module skipping in streaming conformer encoder
par: Bittar, Alexandre, et autres
Publié: (2023) -
Sparse Binarization for Fast Keyword Spotting
par: Svirsky, Jonathan, et autres
Publié: (2024) -
Lightweight DNN for Full-Band Speech Denoising on Mobile Devices: Exploiting Long and Short Temporal Patterns
par: Drossos, Konstantinos, et autres
Publié: (2025) -
Vocal Tract Length Warped Features for Spoken Keyword Spotting
par: Sarkar, Achintya kr., et autres
Publié: (2025) -
Adversarial training of Keyword Spotting to Minimize TTS Data Overfitting
par: Park, Hyun Jin, et autres
Publié: (2024)