Domain-Agnostic Causal-Aware Audio Transformer for Infant Cry Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Owino, Geofrey, Kasamani, Bernard Shibwabo, Abdelmoniem, Ahmed M., Wornyo, Edem |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Privacy-Enhancing Infant Cry Classification with Federated Transformers and Denoising Regularization
par: Owino, Geofrey, et autres
Publié: (2025)
par: Owino, Geofrey, et autres
Publié: (2025)
Infant Cry Detection Using Causal Temporal Representation
par: Fu, Minghao, et autres
Publié: (2025)
par: Fu, Minghao, et autres
Publié: (2025)
CryCeleb: A Speaker Verification Dataset Based on Infant Cry Sounds
par: Budaghyan, David, et autres
Publié: (2023)
par: Budaghyan, David, et autres
Publié: (2023)
InfantCryNet: A Data-driven Framework for Intelligent Analysis of Infant Cries
par: Hong, Mengze, et autres
Publié: (2024)
par: Hong, Mengze, et autres
Publié: (2024)
Fairness-Aware Partial-label Domain Adaptation for Voice Classification of Parkinson's and ALS
par: Francesconi, Arianna, et autres
Publié: (2026)
par: Francesconi, Arianna, et autres
Publié: (2026)
Audio-Guided Dynamic Modality Fusion with Stereo-Aware Attention for Audio-Visual Navigation
par: Li, Jia, et autres
Publié: (2025)
par: Li, Jia, et autres
Publié: (2025)
HarmonicAttack: An Adaptive Cross-Domain Audio Watermark Removal
par: Li, Kexin, et autres
Publié: (2025)
par: Li, Kexin, et autres
Publié: (2025)
Masked Latent Prediction and Classification for Self-Supervised Audio Representation Learning
par: Quelennec, Aurian, et autres
Publié: (2025)
par: Quelennec, Aurian, et autres
Publié: (2025)
Full-Frequency Temporal Patching and Structured Masking for Enhanced Audio Classification
par: Makineni, Aditya, et autres
Publié: (2025)
par: Makineni, Aditya, et autres
Publié: (2025)
OWL: Geometry-Aware Spatial Reasoning for Audio Large Language Models
par: Biswas, Subrata, et autres
Publié: (2025)
par: Biswas, Subrata, et autres
Publié: (2025)
MSMT-FN: Multi-segment Multi-task Fusion Network for Marketing Audio Classification
par: Liu, HongYu, et autres
Publié: (2025)
par: Liu, HongYu, et autres
Publié: (2025)
Hijacking Large Audio-Language Models via Context-Agnostic and Imperceptible Auditory Prompt Injection
par: Chen, Meng, et autres
Publié: (2026)
par: Chen, Meng, et autres
Publié: (2026)
Geometry-Aware Optimization for Respiratory Sound Classification: Enhancing Sensitivity with SAM-Optimized Audio Spectrogram Transformers
par: Işık, Atakan, et autres
Publié: (2025)
par: Işık, Atakan, et autres
Publié: (2025)
Domain Adaptation Method and Modality Gap Impact in Audio-Text Models for Prototypical Sound Classification
par: Acevedo, Emiliano, et autres
Publié: (2025)
par: Acevedo, Emiliano, et autres
Publié: (2025)
Toward Noise-Aware Audio Deepfake Detection: Survey, SNR-Benchmarks, and Practical Recipes
par: Sen, Udayon, et autres
Publié: (2025)
par: Sen, Udayon, et autres
Publié: (2025)
GRM: Utility-Aware Jailbreak Attacks on Audio LLMs via Gradient-Ratio Masking
par: Wang, Yunqiang, et autres
Publié: (2026)
par: Wang, Yunqiang, et autres
Publié: (2026)
PhaseCoder: Microphone Geometry-Agnostic Spatial Audio Understanding for Multimodal LLMs
par: Dementyev, Artem, et autres
Publié: (2026)
par: Dementyev, Artem, et autres
Publié: (2026)
DegDiT: Controllable Audio Generation with Dynamic Event Graph Guided Diffusion Transformer
par: Liu, Yisu, et autres
Publié: (2025)
par: Liu, Yisu, et autres
Publié: (2025)
Beyond Monologue: Interactive Talking-Listening Avatar Generation with Conversational Audio Context-Aware Kernels
par: Weng, Yuzhe, et autres
Publié: (2026)
par: Weng, Yuzhe, et autres
Publié: (2026)
Bridging Biological Hearing and Neuromorphic Computing: End-to-End Time-Domain Audio Signal Processing with Reservoir Computing
par: Sebastian, Rinku, et autres
Publié: (2026)
par: Sebastian, Rinku, et autres
Publié: (2026)
Are Audio-Language Models Listening? Audio-Specialist Heads for Adaptive Audio Steering
par: Glazer, Neta, et autres
Publié: (2026)
par: Glazer, Neta, et autres
Publié: (2026)
Structured-Noise Masked Modeling for Video, Audio and Beyond
par: Bhowmik, Aritra, et autres
Publié: (2025)
par: Bhowmik, Aritra, et autres
Publié: (2025)
HRTFformer: A Spatially-Aware Transformer for Individual HRTF Upsampling in Immersive Audio Rendering
par: Hu, Xuyi, et autres
Publié: (2025)
par: Hu, Xuyi, et autres
Publié: (2025)
Representation-Regularized Convolutional Audio Transformer for Audio Understanding
par: Han, Bing, et autres
Publié: (2026)
par: Han, Bing, et autres
Publié: (2026)
AudioMoG: Guiding Audio Generation with Mixture-of-Guidance
par: Wang, Junyou, et autres
Publié: (2025)
par: Wang, Junyou, et autres
Publié: (2025)
Eureka-Audio: Triggering Audio Intelligence in Compact Language Models
par: Zhang, Dan, et autres
Publié: (2026)
par: Zhang, Dan, et autres
Publié: (2026)
Multimodal Emotion Regression with Multi-Objective Optimization and VAD-Aware Audio Modeling for the 10th ABAW EMI Track
par: Huang, Jiawen, et autres
Publié: (2026)
par: Huang, Jiawen, et autres
Publié: (2026)
MeanAudio: Fast and Faithful Text-to-Audio Generation with Mean Flows
par: Li, Xiquan, et autres
Publié: (2025)
par: Li, Xiquan, et autres
Publié: (2025)
AudioMotionBench: Evaluating Auditory Motion Perception in Audio LLMs
par: Sun, Zhe, et autres
Publié: (2025)
par: Sun, Zhe, et autres
Publié: (2025)
The Sonar Moment: Benchmarking Audio-Language Models in Audio Geo-Localization
par: Zhang, Ruixing, et autres
Publié: (2026)
par: Zhang, Ruixing, et autres
Publié: (2026)
Audio Jailbreaks in Large Audio-Language Models: Taxonomy, Attack-Defense Analysis, and Cost-Aware Evaluation
par: Feng, Bo-Han, et autres
Publié: (2026)
par: Feng, Bo-Han, et autres
Publié: (2026)
Mitigating Stethoscope-Induced Shortcuts in Respiratory Sound Classification under Federated Domain Generalization with Causality-Inspired Interventions
par: Koo, Heejoon, et autres
Publié: (2026)
par: Koo, Heejoon, et autres
Publié: (2026)
Stable Audio 3
par: Evans, Zach, et autres
Publié: (2026)
par: Evans, Zach, et autres
Publié: (2026)
Audio-Maestro: Enhancing Large Audio-Language Models with Tool-Augmented Reasoning
par: Lee, Kuan-Yi, et autres
Publié: (2025)
par: Lee, Kuan-Yi, et autres
Publié: (2025)
AudioSAE: Towards Understanding of Audio-Processing Models with Sparse AutoEncoders
par: Aparin, Georgii, et autres
Publié: (2026)
par: Aparin, Georgii, et autres
Publié: (2026)
DDSC: Dynamic Dual-Signal Curriculum for Data-Efficient Acoustic Scene Classification under Domain Shift
par: Zhang, Peihong, et autres
Publié: (2025)
par: Zhang, Peihong, et autres
Publié: (2025)
An Entropy-Guided Curriculum Learning Strategy for Data-Efficient Acoustic Scene Classification under Domain Shift
par: Zhang, Peihong, et autres
Publié: (2025)
par: Zhang, Peihong, et autres
Publié: (2025)
Generating Synthetic Doctor-Patient Conversations for Long-form Audio Summarization
par: Labrak, Yanis, et autres
Publié: (2026)
par: Labrak, Yanis, et autres
Publié: (2026)
Improving Respiratory Sound Classification with Architecture-Agnostic Knowledge Distillation from Ensembles
par: Toikkanen, Miika, et autres
Publié: (2025)
par: Toikkanen, Miika, et autres
Publié: (2025)
RepAugment: Input-Agnostic Representation-Level Augmentation for Respiratory Sound Classification
par: Kim, June-Woo, et autres
Publié: (2024)
par: Kim, June-Woo, et autres
Publié: (2024)
Documents similaires
-
Privacy-Enhancing Infant Cry Classification with Federated Transformers and Denoising Regularization
par: Owino, Geofrey, et autres
Publié: (2025) -
Infant Cry Detection Using Causal Temporal Representation
par: Fu, Minghao, et autres
Publié: (2025) -
CryCeleb: A Speaker Verification Dataset Based on Infant Cry Sounds
par: Budaghyan, David, et autres
Publié: (2023) -
InfantCryNet: A Data-driven Framework for Intelligent Analysis of Infant Cries
par: Hong, Mengze, et autres
Publié: (2024) -
Fairness-Aware Partial-label Domain Adaptation for Voice Classification of Parkinson's and ALS
par: Francesconi, Arianna, et autres
Publié: (2026)