DEBATE: A Dataset for Disentangling Textual Ambiguity in Mandarin Through Speech
Fuente:
arXiv
Guardado en:
| Autores principales: | Guo, Haotian, Han, Jing, Tu, Yongfeng, Gao, Shihao, Shen, Shengfan, Xiang, Wulong, Gan, Weihao, Zhang, Zixing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Structured Prompting and LLM Ensembling for Multimodal Conversational Aspect-based Sentiment Analysis
por: Gao, Zhiqiang, et al.
Publicado: (2025)
por: Gao, Zhiqiang, et al.
Publicado: (2025)
Re-Parameterization of Lightweight Transformer for On-Device Speech Emotion Recognition
por: Zhang, Zixing, et al.
Publicado: (2024)
por: Zhang, Zixing, et al.
Publicado: (2024)
TEG-DB: A Comprehensive Dataset and Benchmark of Textual-Edge Graphs
por: Li, Zhuofeng, et al.
Publicado: (2024)
por: Li, Zhuofeng, et al.
Publicado: (2024)
Disentangling Textual and Acoustic Features of Neural Speech Representations
por: Mohebbi, Hosein, et al.
Publicado: (2024)
por: Mohebbi, Hosein, et al.
Publicado: (2024)
Mandarin Chinese Words and Parts of Speech
por: Huang, Chu-Ren, et al.
Publicado: (2021)
por: Huang, Chu-Ren, et al.
Publicado: (2021)
Uncovering the Fragility of Trustworthy LLMs through Chinese Textual Ambiguity
por: Wu, Xinwei, et al.
Publicado: (2025)
por: Wu, Xinwei, et al.
Publicado: (2025)
Foundation Model-based Evaluation of Neuropsychiatric Disorders: A Lifespan-Inclusive, Multi-Modal, and Multi-Lingual Study
por: Dong, Zhongren, et al.
Publicado: (2025)
por: Dong, Zhongren, et al.
Publicado: (2025)
Semi-Supervised Cognitive State Classification from Speech with Multi-View Pseudo-Labeling
por: Li, Yuanchao, et al.
Publicado: (2024)
por: Li, Yuanchao, et al.
Publicado: (2024)
Enhancing Voice Wake-Up for Dysarthria: Mandarin Dysarthria Speech Corpus Release and Customized System Design
por: Gao, Ming, et al.
Publicado: (2024)
por: Gao, Ming, et al.
Publicado: (2024)
Quantity Convergence, Quality Divergence: Disentangling Fluency and Accuracy in L2 Mandarin Prosody
por: Shi, Yuqi, et al.
Publicado: (2026)
por: Shi, Yuqi, et al.
Publicado: (2026)
CS-Dialogue: A 104-Hour Dataset of Spontaneous Mandarin-English Code-Switching Dialogues for Speech Recognition
por: Zhou, Jiaming, et al.
Publicado: (2025)
por: Zhou, Jiaming, et al.
Publicado: (2025)
RedNote-Vibe: A Dataset for Capturing Temporal Dynamics of AI-Generated Text in Lifestyle Social Media
por: Li, Yudong, et al.
Publicado: (2025)
por: Li, Yudong, et al.
Publicado: (2025)
CS3-Bench: Evaluating and Enhancing Speech-to-Speech LLMs for Mandarin-English Code-Switching
por: Liu, Heyang, et al.
Publicado: (2025)
por: Liu, Heyang, et al.
Publicado: (2025)
StoryTTS: A Highly Expressive Text-to-Speech Dataset with Rich Textual Expressiveness Annotations
por: Liu, Sen, et al.
Publicado: (2024)
por: Liu, Sen, et al.
Publicado: (2024)
HAFFormer: A Hierarchical Attention-Free Framework for Alzheimer's Disease Detection From Spontaneous Speech
por: Dong, Zhongren, et al.
Publicado: (2024)
por: Dong, Zhongren, et al.
Publicado: (2024)
Developing Second Language Mandarin Fluency Through Pedagogic Intervention and Study Abroad: Planning Time, Speech Rate, and Response Duration
por: Jiayi Wang, et al.
Publicado: (2024)
por: Jiayi Wang, et al.
Publicado: (2024)
Advancing Speech Translation: A Corpus of Mandarin-English Conversational Telephone Speech
por: Wotherspoon, Shannon, et al.
Publicado: (2024)
por: Wotherspoon, Shannon, et al.
Publicado: (2024)
Textually Pretrained Speech Language Models
por: Hassid, Michael, et al.
Publicado: (2023)
por: Hassid, Michael, et al.
Publicado: (2023)
VocalBench-zh: Decomposing and Benchmarking the Speech Conversational Abilities in Mandarin Context
por: Liu, Heyang, et al.
Publicado: (2025)
por: Liu, Heyang, et al.
Publicado: (2025)
Multilingual Stutter Event Detection for English, German, and Mandarin Speech
por: Haas, Felix, et al.
Publicado: (2026)
por: Haas, Felix, et al.
Publicado: (2026)
ToxicTone: A Mandarin Audio Dataset Annotated for Toxicity and Toxic Utterance Tonality
por: Luo, Yu-Xiang, et al.
Publicado: (2025)
por: Luo, Yu-Xiang, et al.
Publicado: (2025)
INMS: Memory Sharing for Large Language Model based Agents
por: Gao, Hang, et al.
Publicado: (2024)
por: Gao, Hang, et al.
Publicado: (2024)
Lexical Tone is Hard to Quantize: Probing Discrete Speech Units in Mandarin and Yorùbá
por: Osakuade, Opeyemi, et al.
Publicado: (2026)
por: Osakuade, Opeyemi, et al.
Publicado: (2026)
Exploring Gender Bias in Alzheimer's Disease Detection: Insights from Mandarin and Greek Speech Perception
por: He, Liu, et al.
Publicado: (2025)
por: He, Liu, et al.
Publicado: (2025)
Direct Preference Optimization for English-Mandarin Code-Switching Speech Recognition in Audio LLMs
por: Quang, Trung Nguyen, et al.
Publicado: (2026)
por: Quang, Trung Nguyen, et al.
Publicado: (2026)
Automatic Textual Normalization for Hate Speech Detection
por: Nguyen, Anh Thi-Hoang, et al.
Publicado: (2023)
por: Nguyen, Anh Thi-Hoang, et al.
Publicado: (2023)
Detection and Positive Reconstruction of Cognitive Distortion sentences: Mandarin Dataset and Evaluation
por: Lin, Shuya, et al.
Publicado: (2024)
por: Lin, Shuya, et al.
Publicado: (2024)
Developing and Validating Accurate Test Scale for Mandarin Vocabulary Comprehension Ability of Preschool Children
por: Jing Zhou, et al.
Publicado: (2025)
por: Jing Zhou, et al.
Publicado: (2025)
Sigmoid Head for Quality Estimation under Language Ambiguity
por: Dinh, Tu Anh, et al.
Publicado: (2026)
por: Dinh, Tu Anh, et al.
Publicado: (2026)
Task-Aligned Tool Recommendation for Large Language Models
por: Gao, Hang, et al.
Publicado: (2024)
por: Gao, Hang, et al.
Publicado: (2024)
ProsodyFM: Unsupervised Phrasing and Intonation Control for Intelligible Speech Synthesis
por: He, Xiangheng, et al.
Publicado: (2024)
por: He, Xiangheng, et al.
Publicado: (2024)
A Survey of Machine Learning Models and Datasets for the Multi-label Classification of Textual Hate Speech in English
por: Bäumler, Julian, et al.
Publicado: (2025)
por: Bäumler, Julian, et al.
Publicado: (2025)
Chapter Appendix VI: A Complete List of Parts of Speech in Mandarin Chinese
por: Huang, Chu-Ren, et al.
Publicado: (2021)
por: Huang, Chu-Ren, et al.
Publicado: (2021)
Quantifying the Role of Textual Predictability in Automatic Speech Recognition
por: Robertson, Sean, et al.
Publicado: (2024)
por: Robertson, Sean, et al.
Publicado: (2024)
Impact of Frame Rates on Speech Tokenizer: A Case Study on Mandarin and English
por: Zhang, Haoyang, et al.
Publicado: (2025)
por: Zhang, Haoyang, et al.
Publicado: (2025)
LinTO Audio and Textual Datasets to Train and Evaluate Automatic Speech Recognition in Tunisian Arabic Dialect
por: Naouara, Hedi, et al.
Publicado: (2025)
por: Naouara, Hedi, et al.
Publicado: (2025)
Increments in Mandarin Chinese
por: Lim, Ni Eng
Publicado: (2025)
por: Lim, Ni Eng
Publicado: (2025)
Word-specific tonal realizations in Mandarin
por: Chuang, Yu-Ying, et al.
Publicado: (2024)
por: Chuang, Yu-Ying, et al.
Publicado: (2024)
Measuring Taiwanese Mandarin Language Understanding
por: Chen, Po-Heng, et al.
Publicado: (2024)
por: Chen, Po-Heng, et al.
Publicado: (2024)
DepFlow: Disentangled Speech Generation to Mitigate Semantic Bias in Depression Detection
por: Li, Yuxin, et al.
Publicado: (2026)
por: Li, Yuxin, et al.
Publicado: (2026)
Ejemplares similares
-
Structured Prompting and LLM Ensembling for Multimodal Conversational Aspect-based Sentiment Analysis
por: Gao, Zhiqiang, et al.
Publicado: (2025) -
Re-Parameterization of Lightweight Transformer for On-Device Speech Emotion Recognition
por: Zhang, Zixing, et al.
Publicado: (2024) -
TEG-DB: A Comprehensive Dataset and Benchmark of Textual-Edge Graphs
por: Li, Zhuofeng, et al.
Publicado: (2024) -
Disentangling Textual and Acoustic Features of Neural Speech Representations
por: Mohebbi, Hosein, et al.
Publicado: (2024) -
Mandarin Chinese Words and Parts of Speech
por: Huang, Chu-Ren, et al.
Publicado: (2021)