A Feature Engineering Approach for Literary and Colloquial Tamil Speech Classification using 1D-CNN
Fuente:
arXiv
Salvato in:
| Autori principali: | Nanmalar, M., Joysingh, S. Johanan, Vijayalakshmi, P., Nagarajan, T. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Literary and Colloquial Tamil Dialect Identification
di: Nanmalar, M., et al.
Pubblicazione: (2024)
di: Nanmalar, M., et al.
Pubblicazione: (2024)
Literary and Colloquial Dialect Identification for Tamil using Acoustic Features
di: Nanmalar, M., et al.
Pubblicazione: (2024)
di: Nanmalar, M., et al.
Pubblicazione: (2024)
Development of Large Annotated Music Datasets using HMM-based Forced Viterbi Alignment
di: Joysingh, S. Johanan, et al.
Pubblicazione: (2024)
di: Joysingh, S. Johanan, et al.
Pubblicazione: (2024)
Quartered Spectral Envelope and 1D-CNN-based Classification of Normally Phonated and Whispered Speech
di: Joysingh, S. Johanan, et al.
Pubblicazione: (2024)
di: Joysingh, S. Johanan, et al.
Pubblicazione: (2024)
Significance of Chirp MFCC as a Feature in Speech and Audio Applications
di: Joysingh, S. Johanan, et al.
Pubblicazione: (2024)
di: Joysingh, S. Johanan, et al.
Pubblicazione: (2024)
Quartered Chirp Spectral Envelope for Whispered vs Normal Speech Classification
di: Joysingh, S. Johanan, et al.
Pubblicazione: (2024)
di: Joysingh, S. Johanan, et al.
Pubblicazione: (2024)
MaskCycleGAN-based Whisper to Normal Speech Conversion
di: Gupta, K. Rohith, et al.
Pubblicazione: (2024)
di: Gupta, K. Rohith, et al.
Pubblicazione: (2024)
Chirp Group Delay based Onset Detection in Instruments with Fast Attack
di: Joysingh, S. Johanan, et al.
Pubblicazione: (2024)
di: Joysingh, S. Johanan, et al.
Pubblicazione: (2024)
Speech Emotion Detection Based on MFCC and CNN-LSTM Architecture
di: Ouyang, Qianhe
Pubblicazione: (2025)
di: Ouyang, Qianhe
Pubblicazione: (2025)
Enhancing Speech Emotion Recognition using Dynamic Spectral Features and Kalman Smoothing
di: Hizabri, Marouane El, et al.
Pubblicazione: (2026)
di: Hizabri, Marouane El, et al.
Pubblicazione: (2026)
AutoProsody: A Prosodic Feature Extraction Tool for Indian Languages
di: Thinakaran, Preethi, et al.
Pubblicazione: (2025)
di: Thinakaran, Preethi, et al.
Pubblicazione: (2025)
emoDARTS: Joint Optimisation of CNN & Sequential Neural Network Architectures for Superior Speech Emotion Recognition
di: Rajapakshe, Thejan, et al.
Pubblicazione: (2024)
di: Rajapakshe, Thejan, et al.
Pubblicazione: (2024)
Advanced Framework for Animal Sound Classification With Features Optimization
di: Yang, Qiang, et al.
Pubblicazione: (2024)
di: Yang, Qiang, et al.
Pubblicazione: (2024)
Multimodal Attention Merging for Improved Speech Recognition and Audio Event Classification
di: Sundar, Anirudh S., et al.
Pubblicazione: (2023)
di: Sundar, Anirudh S., et al.
Pubblicazione: (2023)
Feature Representations for Automatic Meerkat Vocalization Classification
di: Mahmoud, Imen Ben, et al.
Pubblicazione: (2024)
di: Mahmoud, Imen Ben, et al.
Pubblicazione: (2024)
RevRIR: Joint Reverberant Speech and Room Impulse Response Embedding using Contrastive Learning with Application to Room Shape Classification
di: Bitterman, Jacob, et al.
Pubblicazione: (2024)
di: Bitterman, Jacob, et al.
Pubblicazione: (2024)
The 2025 PNPL Competition: Speech Detection and Phoneme Classification in the LibriBrain Dataset
di: Landau, Gilad, et al.
Pubblicazione: (2025)
di: Landau, Gilad, et al.
Pubblicazione: (2025)
A Novel Hybrid Deep Learning Technique for Speech Emotion Detection using Feature Engineering
di: Chowdhury, Shahana Yasmin, et al.
Pubblicazione: (2025)
di: Chowdhury, Shahana Yasmin, et al.
Pubblicazione: (2025)
Feature Aggregation in Joint Sound Classification and Localization Neural Networks
di: Healy, Brendan, et al.
Pubblicazione: (2023)
di: Healy, Brendan, et al.
Pubblicazione: (2023)
WhiSQA: Non-Intrusive Speech Quality Prediction Using Whisper Encoder Features
di: Close, George, et al.
Pubblicazione: (2025)
di: Close, George, et al.
Pubblicazione: (2025)
Spectrotemporal Modulation: Efficient and Interpretable Feature Representation for Classifying Speech, Music, and Environmental Sounds
di: Chang, Andrew, et al.
Pubblicazione: (2025)
di: Chang, Andrew, et al.
Pubblicazione: (2025)
Audio Classification of Low Feature Spectrograms Utilizing Convolutional Neural Networks
di: Elias, Noel
Pubblicazione: (2024)
di: Elias, Noel
Pubblicazione: (2024)
Deep Learning-based Non-Intrusive Multi-Objective Speech Assessment Model with Cross-Domain Features
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2021)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2021)
Optimizing Multi-Stuttered Speech Classification: Leveraging Whisper's Encoder for Efficient Parameter Reduction in Automated Assessment
di: Ameer, Huma, et al.
Pubblicazione: (2024)
di: Ameer, Huma, et al.
Pubblicazione: (2024)
Multi-Channel Replay Speech Detection using Acoustic Maps
di: Neri, Michael, et al.
Pubblicazione: (2026)
di: Neri, Michael, et al.
Pubblicazione: (2026)
Noise-aware Speech Enhancement using Diffusion Probabilistic Model
di: Hu, Yuchen, et al.
Pubblicazione: (2023)
di: Hu, Yuchen, et al.
Pubblicazione: (2023)
Speech Diarization and ASR with GMM
di: Sharma, Aayush Kumar, et al.
Pubblicazione: (2023)
di: Sharma, Aayush Kumar, et al.
Pubblicazione: (2023)
Recovering Performance in Speech Emotion Recognition from Discrete Tokens via Multi-Layer Fusion and Paralinguistic Feature Integration
di: Sun, Esther, et al.
Pubblicazione: (2026)
di: Sun, Esther, et al.
Pubblicazione: (2026)
Speech to Speech Synthesis for Voice Impersonation
di: Johnson, Bjorn, et al.
Pubblicazione: (2026)
di: Johnson, Bjorn, et al.
Pubblicazione: (2026)
Whilter: A Whisper-based Data Filter for "In-the-Wild" Speech Corpora Using Utterance-level Multi-Task Classification
di: Ravenscroft, William, et al.
Pubblicazione: (2025)
di: Ravenscroft, William, et al.
Pubblicazione: (2025)
Patient-Aware Feature Alignment for Robust Lung Sound Classification:Cohesion-Separation and Global Alignment Losses
di: Jeong, Seung Gyu, et al.
Pubblicazione: (2025)
di: Jeong, Seung Gyu, et al.
Pubblicazione: (2025)
Acoustic Classification of Maritime Vessels using Learnable Filterbanks
di: Elsborg, Jonas, et al.
Pubblicazione: (2025)
di: Elsborg, Jonas, et al.
Pubblicazione: (2025)
Explainability of CNN Based Classification Models for Acoustic Signal
di: Faruqui, Zubair, et al.
Pubblicazione: (2025)
di: Faruqui, Zubair, et al.
Pubblicazione: (2025)
Non-Intrusive Speech Intelligibility Prediction for Hearing Aids using Whisper and Metadata
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2023)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2023)
Machine Learning Approaches to Vocal Register Classification in Contemporary Male Pop Music
di: Kim, Alexander, et al.
Pubblicazione: (2025)
di: Kim, Alexander, et al.
Pubblicazione: (2025)
Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM
di: Sun, Zhaokai, et al.
Pubblicazione: (2025)
di: Sun, Zhaokai, et al.
Pubblicazione: (2025)
A Recall-First CNN for Sleep Apnea Screening from Snoring Audio
di: Mallick, Anushka, et al.
Pubblicazione: (2025)
di: Mallick, Anushka, et al.
Pubblicazione: (2025)
Impact of Speech Mode in Automatic Pathological Speech Detection
di: Sheikh, Shakeel A., et al.
Pubblicazione: (2024)
di: Sheikh, Shakeel A., et al.
Pubblicazione: (2024)
Diffusion Synthesizer for Efficient Multilingual Speech to Speech Translation
di: Hirschkind, Nameer, et al.
Pubblicazione: (2024)
di: Hirschkind, Nameer, et al.
Pubblicazione: (2024)
TextrolSpeech: A Text Style Control Speech Corpus With Codec Language Text-to-Speech Models
di: Ji, Shengpeng, et al.
Pubblicazione: (2023)
di: Ji, Shengpeng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Literary and Colloquial Tamil Dialect Identification
di: Nanmalar, M., et al.
Pubblicazione: (2024) -
Literary and Colloquial Dialect Identification for Tamil using Acoustic Features
di: Nanmalar, M., et al.
Pubblicazione: (2024) -
Development of Large Annotated Music Datasets using HMM-based Forced Viterbi Alignment
di: Joysingh, S. Johanan, et al.
Pubblicazione: (2024) -
Quartered Spectral Envelope and 1D-CNN-based Classification of Normally Phonated and Whispered Speech
di: Joysingh, S. Johanan, et al.
Pubblicazione: (2024) -
Significance of Chirp MFCC as a Feature in Speech and Audio Applications
di: Joysingh, S. Johanan, et al.
Pubblicazione: (2024)