Resultados de búsqueda - Coler, Matt
- Mostrando 1 - 11 Resultados de 11
-
1
Spoken in Jest, Detected in Earnest: A Systematic Review of Sarcasm Recognition -- Multimodal Fusion, Challenges, and Future Prospects Autoría: Gao, Xiyuan, Nayak, Shekhar, Coler, Matt
Publicado 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
2
Overcoming Data Scarcity in Multi-Dialectal Arabic ASR via Whisper Fine-Tuning Autoría: Özyilmaz, Ömer Tarik, Coler, Matt, Valdenegro-Toro, Matias
Publicado 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
3
A Functional Trade-off between Prosodic and Semantic Cues in Conveying Sarcasm Autoría: Li, Zhu, Gao, Xiyuan, Zhang, Yuqing, Nayak, Shekhar, Coler, Matt
Publicado 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
4
Leveraging Large Language Models for Sarcastic Speech Annotation in Sarcasm Detection Autoría: Li, Zhu, Zhang, Yuqing, Gao, Xiyuan, Nayak, Shekhar, Coler, Matt
Publicado 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
5
Evaluating Multimodal Large Language Models on Spoken Sarcasm Understanding Autoría: Li, Zhu, Gao, Xiyuan, Zhang, Yuqing, Nayak, Shekhar, Coler, Matt
Publicado 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
6
Modeling Sarcastic Speech: Semantic and Prosodic Cues in a Speech Synthesis Framework Autoría: Li, Zhu, Zhang, Yuqing, Gao, Xiyuan, Nayak, Shekhar, Coler, Matt
Publicado 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
7
SarcasmMiner: A Dual-Track Post-Training Framework for Robust Audio-Visual Sarcasm Reasoning Autoría: Li, Zhu, Chen, Yongjian, Lai, Huiyuan, Gao, Xiyuan, Nayak, Shekhar, Coler, Matt
Publicado 2026Fuente: arXivTipo de material: PreprintAcceso al recurso -
8
Evaluating Standard and Dialectal Frisian ASR: Multilingual Fine-tuning and Language Identification for Improved Low-resource Performance Autoría: Amooie, Reihaneh, de Vries, Wietse, Hao, Yun, Dijkstra, Jelske, Coler, Matt, Wieling, Martijn
Publicado 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
9
AMuSeD: An Attentive Deep Neural Network for Multimodal Sarcasm Detection Incorporating Bi-modal Data Augmentation Autoría: Gao, Xiyuan, Bansal, Shubhi, Gowda, Kushaan, Li, Zhu, Nayak, Shekhar, Kumar, Nagendra, Coler, Matt
Publicado 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
10
Integrating Feedback Loss from Bi-modal Sarcasm Detector for Sarcastic Speech Synthesis Autoría: Li, Zhu, Zhang, Yuqing, Gao, Xiyuan, Raghuvanshi, Devraj, Kumar, Nagendra, Nayak, Shekhar, Coler, Matt
Publicado 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
11
Meta Learning Text-to-Speech Synthesis in over 7000 Languages Autoría: Lux, Florian, Meyer, Sarina, Behringer, Lyonel, Zalkow, Frank, Do, Phat, Coler, Matt, Habets, Emanuël A. P., Vu, Ngoc Thang
Publicado 2024Fuente: arXivTipo de material: PreprintAcceso al recurso