iMiGUE-Speech: A Spontaneous Speech Dataset for Affective Analysis
Fuente:
arXiv
Guardado en:
| Autores principales: | Kakouros, Sofoklis, Kang, Fang, Chen, Haoyu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Investigating the Impact of Word Informativeness on Speech Emotion Recognition
por: Kakouros, Sofoklis
Publicado: (2025)
por: Kakouros, Sofoklis
Publicado: (2025)
Sounding Like a Winner? Prosodic Differences in Post-Match Interviews
por: Kakouros, Sofoklis, et al.
Publicado: (2025)
por: Kakouros, Sofoklis, et al.
Publicado: (2025)
Cross-linguistic Prosodic Analysis of Autistic and Non-autistic Child Speech in Finnish, French and Slovak
por: Myllylä, Ida-Lotta, et al.
Publicado: (2026)
por: Myllylä, Ida-Lotta, et al.
Publicado: (2026)
Classification of Autistic and Non-Autistic Children's Speech: A Cross-Linguistic Study in Finnish, French, and Slovak
por: Kakouros, Sofoklis, et al.
Publicado: (2026)
por: Kakouros, Sofoklis, et al.
Publicado: (2026)
A Large Dataset of Spontaneous Speech with the Accent Spoken in São Paulo for Automatic Speech Recognition Evaluation
por: Lima, Rodrigo, et al.
Publicado: (2024)
por: Lima, Rodrigo, et al.
Publicado: (2024)
LearnerVoice: A Dataset of Non-Native English Learners' Spontaneous Speech
por: Kim, Haechan, et al.
Publicado: (2024)
por: Kim, Haechan, et al.
Publicado: (2024)
CASPER: A Large Scale Spontaneous Speech Dataset
por: Xiao, Cihan, et al.
Publicado: (2025)
por: Xiao, Cihan, et al.
Publicado: (2025)
Emilia: An Extensive, Multilingual, and Diverse Speech Dataset for Large-Scale Speech Generation
por: He, Haorui, et al.
Publicado: (2024)
por: He, Haorui, et al.
Publicado: (2024)
DisfluencySpeech -- Single-Speaker Conversational Speech Dataset with Paralanguage
por: Wang, Kyra, et al.
Publicado: (2024)
por: Wang, Kyra, et al.
Publicado: (2024)
Classification of Spontaneous and Scripted Speech for Multilingual Audio
por: Elisha, Shahar, et al.
Publicado: (2024)
por: Elisha, Shahar, et al.
Publicado: (2024)
Measuring Entrainment in Spontaneous Code-switched Speech
por: Bhattacharya, Debasmita, et al.
Publicado: (2023)
por: Bhattacharya, Debasmita, et al.
Publicado: (2023)
Speech-MASSIVE: A Multilingual Speech Dataset for SLU and Beyond
por: Lee, Beomseok, et al.
Publicado: (2024)
por: Lee, Beomseok, et al.
Publicado: (2024)
CS-Dialogue: A 104-Hour Dataset of Spontaneous Mandarin-English Code-Switching Dialogues for Speech Recognition
por: Zhou, Jiaming, et al.
Publicado: (2025)
por: Zhou, Jiaming, et al.
Publicado: (2025)
Linguistic Changes in Spontaneous Speech for Detecting Parkinsons Disease Using Large Language Models
por: Crawford, Jonathan
Publicado: (2024)
por: Crawford, Jonathan
Publicado: (2024)
Continuous Speech Tokenizer in Text To Speech
por: Li, Yixing, et al.
Publicado: (2024)
por: Li, Yixing, et al.
Publicado: (2024)
YODAS: Youtube-Oriented Dataset for Audio and Speech
por: Li, Xinjian, et al.
Publicado: (2024)
por: Li, Xinjian, et al.
Publicado: (2024)
Sagalee: an Open Source Automatic Speech Recognition Dataset for Oromo Language
por: Abu, Turi, et al.
Publicado: (2025)
por: Abu, Turi, et al.
Publicado: (2025)
Granary: Speech Recognition and Translation Dataset in 25 European Languages
por: Koluguri, Nithin Rao, et al.
Publicado: (2025)
por: Koluguri, Nithin Rao, et al.
Publicado: (2025)
Bailing-TTS: Chinese Dialectal Speech Synthesis Towards Human-like Spontaneous Representation
por: Di, Xinhan, et al.
Publicado: (2024)
por: Di, Xinhan, et al.
Publicado: (2024)
Spontaneous Speech-Based Suicide Risk Detection Using Whisper and Large Language Models
por: Cui, Ziyun, et al.
Publicado: (2024)
por: Cui, Ziyun, et al.
Publicado: (2024)
Streaming Speech-to-Confusion Network Speech Recognition
por: Filimonov, Denis, et al.
Publicado: (2023)
por: Filimonov, Denis, et al.
Publicado: (2023)
MAD Speech: Measures of Acoustic Diversity of Speech
por: Futeral, Matthieu, et al.
Publicado: (2024)
por: Futeral, Matthieu, et al.
Publicado: (2024)
SpeechColab Leaderboard: An Open-Source Platform for Automatic Speech Recognition Evaluation
por: Du, Jiayu, et al.
Publicado: (2024)
por: Du, Jiayu, et al.
Publicado: (2024)
Early Dementia Detection Using Multiple Spontaneous Speech Prompts: The PROCESS Challenge
por: Tao, Fuxiang, et al.
Publicado: (2024)
por: Tao, Fuxiang, et al.
Publicado: (2024)
SLIDE: Integrating Speech Language Model with LLM for Spontaneous Spoken Dialogue Generation
por: Lu, Haitian, et al.
Publicado: (2025)
por: Lu, Haitian, et al.
Publicado: (2025)
Leveraging Large Language Models for Spontaneous Speech-Based Suicide Risk Detection
por: Gao, Yifan, et al.
Publicado: (2025)
por: Gao, Yifan, et al.
Publicado: (2025)
Prompting Large Language Models with Audio for General-Purpose Speech Summarization
por: Kang, Wonjune, et al.
Publicado: (2024)
por: Kang, Wonjune, et al.
Publicado: (2024)
SpeechCT-CLIP: Distilling Text-Image Knowledge to Speech for Voice-Native Multimodal CT Analysis
por: Buess, Lukas, et al.
Publicado: (2025)
por: Buess, Lukas, et al.
Publicado: (2025)
A Preliminary Analysis of Automatic Word and Syllable Prominence Detection in Non-Native Speech With Text-to-Speech Prosody Embeddings
por: Mondal, Anindita, et al.
Publicado: (2024)
por: Mondal, Anindita, et al.
Publicado: (2024)
Spontaneous Informal Speech Dataset for Punctuation Restoration
por: Liu, Xing Yi, et al.
Publicado: (2024)
por: Liu, Xing Yi, et al.
Publicado: (2024)
Textless Speech-to-Speech Translation With Limited Parallel Data
por: Diwan, Anuj, et al.
Publicado: (2023)
por: Diwan, Anuj, et al.
Publicado: (2023)
SimulS2S-LLM: Unlocking Simultaneous Inference of Speech LLMs for Speech-to-Speech Translation
por: Deng, Keqi, et al.
Publicado: (2025)
por: Deng, Keqi, et al.
Publicado: (2025)
A Multi-Dialectal Dataset for German Dialect ASR and Dialect-to-Standard Speech Translation
por: Blaschke, Verena, et al.
Publicado: (2025)
por: Blaschke, Verena, et al.
Publicado: (2025)
S2SBench: A Benchmark for Quantifying Intelligence Degradation in Speech-to-Speech Large Language Models
por: Fang, Yuanbo, et al.
Publicado: (2025)
por: Fang, Yuanbo, et al.
Publicado: (2025)
nEMO: Dataset of Emotional Speech in Polish
por: Christop, Iwona
Publicado: (2024)
por: Christop, Iwona
Publicado: (2024)
HAFFormer: A Hierarchical Attention-Free Framework for Alzheimer's Disease Detection From Spontaneous Speech
por: Dong, Zhongren, et al.
Publicado: (2024)
por: Dong, Zhongren, et al.
Publicado: (2024)
CS-FLEURS: A Massively Multilingual and Code-Switched Speech Dataset
por: Yan, Brian, et al.
Publicado: (2025)
por: Yan, Brian, et al.
Publicado: (2025)
DeSTA: Enhancing Speech Language Models through Descriptive Speech-Text Alignment
por: Lu, Ke-Han, et al.
Publicado: (2024)
por: Lu, Ke-Han, et al.
Publicado: (2024)
Task-Agnostic Structured Pruning of Speech Representation Models
por: Wang, Haoyu, et al.
Publicado: (2023)
por: Wang, Haoyu, et al.
Publicado: (2023)
Emilia: A Large-Scale, Extensive, Multilingual, and Diverse Dataset for Speech Generation
por: He, Haorui, et al.
Publicado: (2025)
por: He, Haorui, et al.
Publicado: (2025)
Ejemplares similares
-
Investigating the Impact of Word Informativeness on Speech Emotion Recognition
por: Kakouros, Sofoklis
Publicado: (2025) -
Sounding Like a Winner? Prosodic Differences in Post-Match Interviews
por: Kakouros, Sofoklis, et al.
Publicado: (2025) -
Cross-linguistic Prosodic Analysis of Autistic and Non-autistic Child Speech in Finnish, French and Slovak
por: Myllylä, Ida-Lotta, et al.
Publicado: (2026) -
Classification of Autistic and Non-Autistic Children's Speech: A Cross-Linguistic Study in Finnish, French, and Slovak
por: Kakouros, Sofoklis, et al.
Publicado: (2026) -
A Large Dataset of Spontaneous Speech with the Accent Spoken in São Paulo for Automatic Speech Recognition Evaluation
por: Lima, Rodrigo, et al.
Publicado: (2024)