MELD-ST: An Emotion-aware Speech Translation Dataset
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Sirou, Yahata, Sakiko, Shimizu, Shuichiro, Yang, Zhengdong, Li, Yihang, Chu, Chenhui, Kurohashi, Sadao |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Rapidly Developing High-quality Instruction Data and Evaluation Benchmark for Large Language Models with Minimal Human Effort: A Case Study on Japanese
by: Sun, Yikun, et al.
Published: (2024)
by: Sun, Yikun, et al.
Published: (2024)
When Large Language Models Meet Speech: A Survey on Integration Approaches
by: Yang, Zhengdong, et al.
Published: (2025)
by: Yang, Zhengdong, et al.
Published: (2025)
Causal Tree Extraction from Medical Case Reports: A Novel Task for Experts-like Text Comprehension
by: Yahata, Sakiko, et al.
Published: (2025)
by: Yahata, Sakiko, et al.
Published: (2025)
EMS: Efficient and Effective Massively Multilingual Sentence Embedding Learning
by: Mao, Zhuoyuan, et al.
Published: (2022)
by: Mao, Zhuoyuan, et al.
Published: (2022)
Language Lives in Sparse Dimensions: Toward Interpretable and Efficient Multilingual Control for Large Language Models
by: Zhong, Chengzhi, et al.
Published: (2025)
by: Zhong, Chengzhi, et al.
Published: (2025)
EmplifAI: a Fine-grained Dataset for Japanese Empathetic Medical Dialogues in 28 Emotion Labels
by: She, Wan Jou, et al.
Published: (2026)
by: She, Wan Jou, et al.
Published: (2026)
A Joint Neural Baseline for Concept, Assertion, and Relation Extraction from Clinical Text
by: Cheng, Fei, et al.
Published: (2026)
by: Cheng, Fei, et al.
Published: (2026)
Rethinking Meeting Effectiveness: A Benchmark and Framework for Temporal Fine-grained Automatic Meeting Effectiveness Evaluation
by: Li, Yihang, et al.
Published: (2026)
by: Li, Yihang, et al.
Published: (2026)
SpeechIQ: Speech-Agentic Intelligence Quotient Across Cognitive Levels in Voice Understanding by Large Language Models
by: Wan, Zhen, et al.
Published: (2025)
by: Wan, Zhen, et al.
Published: (2025)
Cross-lingual Embedding Clustering for Hierarchical Softmax in Low-Resource Multilingual Speech Recognition
by: Yang, Zhengdong, et al.
Published: (2025)
by: Yang, Zhengdong, et al.
Published: (2025)
Beyond English-Centric LLMs: What Language Do Multilingual Language Models Think in?
by: Zhong, Chengzhi, et al.
Published: (2024)
by: Zhong, Chengzhi, et al.
Published: (2024)
RecMind: Japanese Movie Recommendation Dialogue with Seeker's Internal State
by: Kodama, Takashi, et al.
Published: (2024)
by: Kodama, Takashi, et al.
Published: (2024)
Assessing Agentic Large Language Models in Multilingual National Bias
by: Liu, Qianying, et al.
Published: (2025)
by: Liu, Qianying, et al.
Published: (2025)
Reformulating Domain Adaptation of Large Language Models as Adapt-Retrieve-Revise: A Case Study on Chinese Legal Domain
by: wan, Zhen, et al.
Published: (2023)
by: wan, Zhen, et al.
Published: (2023)
J-CRe3: A Japanese Conversation Dataset for Real-world Reference Resolution
by: Ueda, Nobuhiro, et al.
Published: (2024)
by: Ueda, Nobuhiro, et al.
Published: (2024)
DiariST: Streaming Speech Translation with Speaker Diarization
by: Yang, Mu, et al.
Published: (2023)
by: Yang, Mu, et al.
Published: (2023)
AcTED: Automatic Acquisition of Typical Event Duration for Semi-supervised Temporal Commonsense QA
by: Virgo, Felix, et al.
Published: (2024)
by: Virgo, Felix, et al.
Published: (2024)
Reading Comprehension using Entity-based Memory Network
by: Wang, Xun, et al.
Published: (2016)
by: Wang, Xun, et al.
Published: (2016)
MELD: Mel-Spectrogram-Based Speech Language Modeling with Discrete Latent Variables
by: Yeh, Sung-Lin, et al.
Published: (2026)
by: Yeh, Sung-Lin, et al.
Published: (2026)
LLaST: Improved End-to-end Speech Translation System Leveraged by Large Language Models
by: Chen, Xi, et al.
Published: (2024)
by: Chen, Xi, et al.
Published: (2024)
Reasoning Depth and Environment Complexity: A Controlled Study of RLVR Data Allocation across Logical Reasoning Tasks
by: Zhu, Yihua, et al.
Published: (2026)
by: Zhu, Yihua, et al.
Published: (2026)
Memorization, Emergence, and Explaining Reversal Failures: A Controlled Study of Relational Semantics in LLMs
by: Zhu, Yihua, et al.
Published: (2026)
by: Zhu, Yihua, et al.
Published: (2026)
Do LLMs Align Human Values Regarding Social Biases? Judging and Explaining Social Biases with LLMs
by: Liu, Yang, et al.
Published: (2025)
by: Liu, Yang, et al.
Published: (2025)
Understanding the Prompt Sensitivity
by: Liu, Yang, et al.
Published: (2026)
by: Liu, Yang, et al.
Published: (2026)
Dub-S2ST: Textless Speech-to-Speech Translation for Seamless Dubbing
by: Choi, Jeongsoo, et al.
Published: (2025)
by: Choi, Jeongsoo, et al.
Published: (2025)
BIS Reasoning 1.0: The First Large-Scale Japanese Benchmark for Belief-Inconsistent Syllogistic Reasoning
by: Nguyen, Ha-Thanh, et al.
Published: (2025)
by: Nguyen, Ha-Thanh, et al.
Published: (2025)
Mechanistic Diagnostics of Spatial Lexical Bias in Multimodal Large Language Model Spatial Reasoning
by: Ma, Chuang, et al.
Published: (2026)
by: Ma, Chuang, et al.
Published: (2026)
MSLM-S2ST: A Multitask Speech Language Model for Textless Speech-to-Speech Translation with Speaker Style Preservation
by: Peng, Yifan, et al.
Published: (2024)
by: Peng, Yifan, et al.
Published: (2024)
MELD: Multi-Task Equilibrated Learning Detector for AI-Generated Text
by: Li, Chenjun, et al.
Published: (2026)
by: Li, Chenjun, et al.
Published: (2026)
EmoHopeSpeech: An Annotated Dataset of Emotions and Hope Speech in English and Arabic
by: Zaghouani, Wajdi, et al.
Published: (2025)
by: Zaghouani, Wajdi, et al.
Published: (2025)
On the Alignment of Large Language Models with Global Human Opinion
by: Liu, Yang, et al.
Published: (2025)
by: Liu, Yang, et al.
Published: (2025)
EmoAra: Emotion-Preserving English Speech Transcription and Cross-Lingual Translation with Arabic Text-to-Speech
by: Hassan, Besher, et al.
Published: (2026)
by: Hassan, Besher, et al.
Published: (2026)
Scalable Multilingual Multimodal Machine Translation with Speech-Text Fusion
by: Du, Yexing, et al.
Published: (2026)
by: Du, Yexing, et al.
Published: (2026)
TeluguST-46: A Benchmark Corpus and Comprehensive Evaluation for Telugu-English Speech Translation
by: Akkiraju, Bhavana, et al.
Published: (2025)
by: Akkiraju, Bhavana, et al.
Published: (2025)
SinFoS: A Parallel Dataset for Translating Sinhala Figures of Speech
by: Sofalas, Johan, et al.
Published: (2026)
by: Sofalas, Johan, et al.
Published: (2026)
nEMO: Dataset of Emotional Speech in Polish
by: Christop, Iwona
Published: (2024)
by: Christop, Iwona
Published: (2024)
Chain-of-Thought Prompting for Speech Translation
by: Hu, Ke, et al.
Published: (2024)
by: Hu, Ke, et al.
Published: (2024)
AdaST: Dynamically Adapting Encoder States in the Decoder for End-to-End Speech-to-Text Translation
by: Huang, Wuwei, et al.
Published: (2025)
by: Huang, Wuwei, et al.
Published: (2025)
StyEmp: Stylizing Empathetic Response Generation via Multi-Grained Prefix Encoder and Personality Reinforcement
by: Fu, Yahui, et al.
Published: (2024)
by: Fu, Yahui, et al.
Published: (2024)
On the Emotion Understanding of Synthesized Speech
by: Ge, Yuan, et al.
Published: (2026)
by: Ge, Yuan, et al.
Published: (2026)
Similar Items
-
Rapidly Developing High-quality Instruction Data and Evaluation Benchmark for Large Language Models with Minimal Human Effort: A Case Study on Japanese
by: Sun, Yikun, et al.
Published: (2024) -
When Large Language Models Meet Speech: A Survey on Integration Approaches
by: Yang, Zhengdong, et al.
Published: (2025) -
Causal Tree Extraction from Medical Case Reports: A Novel Task for Experts-like Text Comprehension
by: Yahata, Sakiko, et al.
Published: (2025) -
EMS: Efficient and Effective Massively Multilingual Sentence Embedding Learning
by: Mao, Zhuoyuan, et al.
Published: (2022) -
Language Lives in Sparse Dimensions: Toward Interpretable and Efficient Multilingual Control for Large Language Models
by: Zhong, Chengzhi, et al.
Published: (2025)