Infant Cry Detection Using Causal Temporal Representation
Fuente:
arXiv
Salvato in:
| Autori principali: | Fu, Minghao, Li, Danning, Gadhiya, Aryan, Lambright, Benjamin, Alowais, Mohamed, Bahnassy, Mohab, Elletter, Saad El Dine, Toyin, Hawau Olamide, Jiang, Haiyan, Zhang, Kun, Aldarmaki, Hanan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Are LLMs Good Text Diacritizers? An Arabic and Yoruba Case Study
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2025)
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2025)
STTATTS: Unified Speech-To-Text And Text-To-Speech Model
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2024)
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2024)
Dialectal Coverage And Generalization in Arabic Speech Recognition
di: Djanibekov, Amirbek, et al.
Pubblicazione: (2024)
di: Djanibekov, Amirbek, et al.
Pubblicazione: (2024)
ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2025)
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2025)
Voice of a Continent: Mapping Africa's Speech Technology Frontier
di: Elmadany, AbdelRahim, et al.
Pubblicazione: (2025)
di: Elmadany, AbdelRahim, et al.
Pubblicazione: (2025)
Aligning Stuttered-Speech Research with End-User Needs: Scoping Review, Survey, and Guidelines
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2026)
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2026)
Clinical Annotations for Automatic Stuttering Severity Assessment
di: Valente, Ana Rita, et al.
Pubblicazione: (2025)
di: Valente, Ana Rita, et al.
Pubblicazione: (2025)
NADI 2025: The First Multidialectal Arabic Speech Processing Shared Task
di: Talafha, Bashar, et al.
Pubblicazione: (2025)
di: Talafha, Bashar, et al.
Pubblicazione: (2025)
Where Are We? Evaluating LLM Performance on African Languages
di: Adebara, Ife, et al.
Pubblicazione: (2025)
di: Adebara, Ife, et al.
Pubblicazione: (2025)
Exploring the Limitations of Detecting Machine-Generated Text
di: Doughman, Jad, et al.
Pubblicazione: (2024)
di: Doughman, Jad, et al.
Pubblicazione: (2024)
SparQLe: Speech Queries to Text Translation Through LLMs
di: Djanibekov, Amirbek, et al.
Pubblicazione: (2025)
di: Djanibekov, Amirbek, et al.
Pubblicazione: (2025)
RelUNet: Relative Channel Fusion U-Net for Multichannel Speech Enhancement
di: Aldarmaki, Ibrahim, et al.
Pubblicazione: (2024)
di: Aldarmaki, Ibrahim, et al.
Pubblicazione: (2024)
Station list and links to master tracks in different resolutions of POLARSTERN cruise ANT-XXII/1, Bremerhaven - Cape Town, 2004-10-12 - 2004-11-04
di: El Naggar, Saad El Dine
Pubblicazione: (2015)
di: El Naggar, Saad El Dine
Pubblicazione: (2015)
Station list and links to master tracks in different resolutions of POLARSTERN cruise ANT-XV/1, Bremerhaven - Cape Town, 1997-10-15 - 1997-11-07
di: El Naggar, Saad El Dine
Pubblicazione: (2015)
di: El Naggar, Saad El Dine
Pubblicazione: (2015)
Station list and links to master tracks in different resolutions of POLARSTERN cruise ANT-XXVII/4, Cape Town - Bremerhaven, 2011-04-20 - 2011-05-20
di: El Naggar, Saad El Dine
Pubblicazione: (2015)
di: El Naggar, Saad El Dine
Pubblicazione: (2015)
Station list and links to master tracks in different resolutions of POLARSTERN cruise ANT-XXVIII/1, Bremerhaven - Cape Town, 2011-10-28 - 2011-11-30
di: El Naggar, Saad El Dine
Pubblicazione: (2015)
di: El Naggar, Saad El Dine
Pubblicazione: (2015)
Station list and links to master tracks in different resolutions of POLARSTERN cruise ANT-XVIII/1, Bremerhaven - Cape Town, 2000-09-29 - 2000-10-24
di: El Naggar, Saad El Dine
Pubblicazione: (2015)
di: El Naggar, Saad El Dine
Pubblicazione: (2015)
Station list and links to master tracks in different resolutions of POLARSTERN cruise ANT-XVI/1, Bremerhaven - Cape Town, 1998-12-15 - 1999-01-06
di: El Naggar, Saad El Dine
Pubblicazione: (2015)
di: El Naggar, Saad El Dine
Pubblicazione: (2015)
Mixat: A Data Set of Bilingual Emirati-English Speech
di: Ali, Maryam Al, et al.
Pubblicazione: (2024)
di: Ali, Maryam Al, et al.
Pubblicazione: (2024)
Spoken Word2Vec: Learning Skipgram Embeddings from Speech
di: Sayeed, Mohammad Amaan, et al.
Pubblicazione: (2023)
di: Sayeed, Mohammad Amaan, et al.
Pubblicazione: (2023)
Automatic Restoration of Diacritics for Speech Data Sets
di: Shatnawi, Sara, et al.
Pubblicazione: (2023)
di: Shatnawi, Sara, et al.
Pubblicazione: (2023)
Domain-Agnostic Causal-Aware Audio Transformer for Infant Cry Classification
di: Owino, Geofrey, et al.
Pubblicazione: (2025)
di: Owino, Geofrey, et al.
Pubblicazione: (2025)
InfantCryNet: A Data-driven Framework for Intelligent Analysis of Infant Cries
di: Hong, Mengze, et al.
Pubblicazione: (2024)
di: Hong, Mengze, et al.
Pubblicazione: (2024)
Continuous thermosalinograph oceanography along POLARSTERN cruise track ANT-XXVII/4
di: El Naggar, Saad El Dine, et al.
Pubblicazione: (2011)
di: El Naggar, Saad El Dine, et al.
Pubblicazione: (2011)
Continuous thermosalinograph oceanography along POLARSTERN cruise track ANT-XV/1
di: El Naggar, Saad El Dine, et al.
Pubblicazione: (1998)
di: El Naggar, Saad El Dine, et al.
Pubblicazione: (1998)
Continuous thermosalinograph oceanography along POLARSTERN cruise track ANT-XXII/1
di: El Naggar, Saad El Dine, et al.
Pubblicazione: (2007)
di: El Naggar, Saad El Dine, et al.
Pubblicazione: (2007)
Continuous thermosalinograph oceanography along POLARSTERN cruise track ANT-XXVIII/1
di: El Naggar, Saad El Dine, et al.
Pubblicazione: (2012)
di: El Naggar, Saad El Dine, et al.
Pubblicazione: (2012)
Analysis of UVB irradiance during cruise ANT-XXII/1 (Table 10.1)
di: El Naggar, Saad El Dine, et al.
Pubblicazione: (2007)
di: El Naggar, Saad El Dine, et al.
Pubblicazione: (2007)
Continuous thermosalinograph oceanography along POLARSTERN cruise track ANT-XVI/1
di: El Naggar, Saad El Dine, et al.
Pubblicazione: (2007)
di: El Naggar, Saad El Dine, et al.
Pubblicazione: (2007)
On Exact Reznick, Hilbert-Artin and Putinar's Representations
di: Magron, Victor, et al.
Pubblicazione: (2018)
di: Magron, Victor, et al.
Pubblicazione: (2018)
Towards Identifiability of Hierarchical Temporal Causal Representation Learning
di: Li, Zijian, et al.
Pubblicazione: (2025)
di: Li, Zijian, et al.
Pubblicazione: (2025)
CryCeleb: A Speaker Verification Dataset Based on Infant Cry Sounds
di: Budaghyan, David, et al.
Pubblicazione: (2023)
di: Budaghyan, David, et al.
Pubblicazione: (2023)
Unrequited Emotions: Investigating the Gaps in Motivation and Practice in Speech Emotion Recognition Research
di: Wong, Taryn, et al.
Pubblicazione: (2026)
di: Wong, Taryn, et al.
Pubblicazione: (2026)
Morphemes Without Borders: Evaluating Root-Pattern Morphology in Arabic Tokenizers and LLMs
di: Alakeel, Yara, et al.
Pubblicazione: (2026)
di: Alakeel, Yara, et al.
Pubblicazione: (2026)
Linear Semantic Segmentation for Low-Resource Spoken Dialects
di: Chirkunov, Kirill, et al.
Pubblicazione: (2026)
di: Chirkunov, Kirill, et al.
Pubblicazione: (2026)
SPIRIT: Patching Speech Language Models against Jailbreak Attacks
di: Djanibekov, Amirbek, et al.
Pubblicazione: (2025)
di: Djanibekov, Amirbek, et al.
Pubblicazione: (2025)
PALM: Few-Shot Prompt Learning for Audio Language Models
di: Hanif, Asif, et al.
Pubblicazione: (2024)
di: Hanif, Asif, et al.
Pubblicazione: (2024)
ICSD: An Open-source Dataset for Infant Cry and Snoring Detection
di: Liu, Qingyu, et al.
Pubblicazione: (2024)
di: Liu, Qingyu, et al.
Pubblicazione: (2024)
Father Trait Anger and Exposure to Infant Cry: Effects on Emotion, Appraisals of Infants, and Cognitive Performance
di: Lauren M. Francis, et al.
Pubblicazione: (2025)
di: Lauren M. Francis, et al.
Pubblicazione: (2025)
Privacy-Enhancing Infant Cry Classification with Federated Transformers and Denoising Regularization
di: Owino, Geofrey, et al.
Pubblicazione: (2025)
di: Owino, Geofrey, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Are LLMs Good Text Diacritizers? An Arabic and Yoruba Case Study
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2025) -
STTATTS: Unified Speech-To-Text And Text-To-Speech Model
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2024) -
Dialectal Coverage And Generalization in Arabic Speech Recognition
di: Djanibekov, Amirbek, et al.
Pubblicazione: (2024) -
ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis
di: Toyin, Hawau Olamide, et al.
Pubblicazione: (2025) -
Voice of a Continent: Mapping Africa's Speech Technology Frontier
di: Elmadany, AbdelRahim, et al.
Pubblicazione: (2025)