Paralinguistic Emotion-Aware Validation Timing Detection in Japanese Empathetic Spoken Dialogue
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pang, Zi Haur, Fu, Yahui, Gao, Yuan, Kawahara, Tatsuya |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Acknowledgment of Emotional States: Generating Validating Responses for Empathetic Dialogue
par: Pang, Zi Haur, et autres
Publié: (2024)
par: Pang, Zi Haur, et autres
Publié: (2024)
ERM-MinMaxGAP: Benchmarking and Mitigating Gender Bias in Multilingual Multimodal Speech-LLM Emotion Recognition
par: Pang, Zi Haur, et autres
Publié: (2026)
par: Pang, Zi Haur, et autres
Publié: (2026)
Minority-Aware Satisfaction Estimation in Dialogue Systems via Preference-Adaptive Reinforcement Learning
par: Fu, Yahui, et autres
Publié: (2025)
par: Fu, Yahui, et autres
Publié: (2025)
Prompt-Guided Turn-Taking Prediction
par: Inoue, Koji, et autres
Publié: (2025)
par: Inoue, Koji, et autres
Publié: (2025)
Bridging Speech Emotion Recognition and Personality: Dataset and Temporal Interaction Condition Network
par: Gao, Yuan, et autres
Publié: (2025)
par: Gao, Yuan, et autres
Publié: (2025)
Multilingual and Continuous Backchannel Prediction: A Cross-lingual Study
par: Inoue, Koji, et autres
Publié: (2025)
par: Inoue, Koji, et autres
Publié: (2025)
OSUM-EChat: Enhancing End-to-End Empathetic Spoken Chatbot via Understanding-Driven Spoken Dialogue
par: Geng, Xuelong, et autres
Publié: (2025)
par: Geng, Xuelong, et autres
Publié: (2025)
Does the Appearance of Autonomous Conversational Robots Affect User Spoken Behaviors in Real-World Conference Interactions?
par: Pang, Zi Haur, et autres
Publié: (2025)
par: Pang, Zi Haur, et autres
Publié: (2025)
J-CHAT: Japanese Large-scale Spoken Dialogue Corpus for Spoken Dialogue Language Modeling
par: Nakata, Wataru, et autres
Publié: (2024)
par: Nakata, Wataru, et autres
Publié: (2024)
Leveraging Chain of Thought towards Empathetic Spoken Dialogue without Corresponding Question-Answering Data
par: Xie, Jingran, et autres
Publié: (2025)
par: Xie, Jingran, et autres
Publié: (2025)
GOAT-SLM: A Spoken Language Model with Paralinguistic and Speaker Characteristic Awareness
par: Chen, Hongjie, et autres
Publié: (2025)
par: Chen, Hongjie, et autres
Publié: (2025)
Two-Stage Acoustic Adaptation with Gated Cross-Attention Adapters for LLM-Based Multi-Talker Speech Recognition
par: Shi, Hao, et autres
Publié: (2026)
par: Shi, Hao, et autres
Publié: (2026)
Semantic-Aware Interruption Detection in Spoken Dialogue Systems: Benchmark, Metric, and Model
par: Xia, Kangxiang, et autres
Publié: (2026)
par: Xia, Kangxiang, et autres
Publié: (2026)
DeepDialogue: A Multi-Turn Emotionally-Rich Spoken Dialogue Dataset
par: Koudounas, Alkis, et autres
Publié: (2025)
par: Koudounas, Alkis, et autres
Publié: (2025)
E-chat: Emotion-sensitive Spoken Dialogue System with Large Language Models
par: Xue, Hongfei, et autres
Publié: (2023)
par: Xue, Hongfei, et autres
Publié: (2023)
Are Paralinguistic Representations all that is needed for Speech Emotion Recognition?
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
StyEmp: Stylizing Empathetic Response Generation via Multi-Grained Prefix Encoder and Personality Reinforcement
par: Fu, Yahui, et autres
Publié: (2024)
par: Fu, Yahui, et autres
Publié: (2024)
Do Audio LLMs Listen or Read? Analyzing and Mitigating Paralinguistic Failures with VoxParadox
par: Pang, Jiacheng, et autres
Publié: (2026)
par: Pang, Jiacheng, et autres
Publié: (2026)
VoxMind: An End-to-End Agentic Spoken Dialogue System
par: Liang, Tianle, et autres
Publié: (2026)
par: Liang, Tianle, et autres
Publié: (2026)
Serialized Speech Information Guidance with Overlapped Encoding Separation for Multi-Speaker Automatic Speech Recognition
par: Shi, Hao, et autres
Publié: (2024)
par: Shi, Hao, et autres
Publié: (2024)
SpeechParaling-Bench: A Comprehensive Benchmark for Paralinguistic-Aware Speech Generation
par: Liu, Ruohan, et autres
Publié: (2026)
par: Liu, Ruohan, et autres
Publié: (2026)
MOSS-TTSD: Text to Spoken Dialogue Generation
par: Zhang, Yuqian, et autres
Publié: (2026)
par: Zhang, Yuqian, et autres
Publié: (2026)
A Noise-Robust Turn-Taking System for Real-World Dialogue Robots: A Field Experiment
par: Inoue, Koji, et autres
Publié: (2025)
par: Inoue, Koji, et autres
Publié: (2025)
Exploration of Adapter for Noise Robust Automatic Speech Recognition
par: Shi, Hao, et autres
Publié: (2024)
par: Shi, Hao, et autres
Publié: (2024)
Benchmarking Japanese Speech Recognition on ASR-LLM Setups with Multi-Pass Augmented Generative Error Correction
par: Ko, Yuka, et autres
Publié: (2024)
par: Ko, Yuka, et autres
Publié: (2024)
An LLM Benchmark for Addressee Recognition in Multi-modal Multi-party Dialogue
par: Inoue, Koji, et autres
Publié: (2025)
par: Inoue, Koji, et autres
Publié: (2025)
SONAR: Self-Distilled Continual Pre-training for Domain Adaptive Audio Representation
par: Zhang, Yizhou, et autres
Publié: (2025)
par: Zhang, Yizhou, et autres
Publié: (2025)
Human-Like Embodied AI Interviewer: Employing Android ERICA in Real International Conference
par: Pang, Zi Haur, et autres
Publié: (2024)
par: Pang, Zi Haur, et autres
Publié: (2024)
Resurfacing Paralinguistic Awareness in Large Audio Language Models
par: Yang, Hao, et autres
Publié: (2026)
par: Yang, Hao, et autres
Publié: (2026)
SingingSDS: A Singing-Capable Spoken Dialogue System for Conversational Roleplay Applications
par: Han, Jionghao, et autres
Publié: (2025)
par: Han, Jionghao, et autres
Publié: (2025)
Efficient and Robust Long-Form Speech Recognition with Hybrid H3-Conformer
par: Honda, Tomoki, et autres
Publié: (2024)
par: Honda, Tomoki, et autres
Publié: (2024)
Reflecting Twice before Speaking with Empathy: Self-Reflective Alternating Inference for Empathy-Aware End-to-End Spoken Dialogue
par: Jia, Yuhang, et autres
Publié: (2026)
par: Jia, Yuhang, et autres
Publié: (2026)
Paralinguistics-Aware Speech-Empowered Large Language Models for Natural Conversation
par: Kim, Heeseung, et autres
Publié: (2024)
par: Kim, Heeseung, et autres
Publié: (2024)
Towards Machine Unlearning for Paralinguistic Speech Processing
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
I Know Your Feelings Before You Do: Predicting Future Affective Reactions in Human-Computer Dialogue
par: Li, Yuanchao, et autres
Publié: (2023)
par: Li, Yuanchao, et autres
Publié: (2023)
Optimizing Conversational Quality in Spoken Dialogue Systems with Reinforcement Learning from AI Feedback
par: Arora, Siddhant, et autres
Publié: (2026)
par: Arora, Siddhant, et autres
Publié: (2026)
Geolocation-Aware Robust Spoken Language Identification
par: Wang, Qingzheng, et autres
Publié: (2025)
par: Wang, Qingzheng, et autres
Publié: (2025)
FlashLabs Chroma 1.0: A Real-Time End-to-End Spoken Dialogue Model with Personalized Voice Cloning
par: Chen, Tanyu, et autres
Publié: (2026)
par: Chen, Tanyu, et autres
Publié: (2026)
RE-LLM: Refining Empathetic Speech-LLM Responses by Integrating Emotion Nuance
par: Chen, Jing-Han, et autres
Publié: (2026)
par: Chen, Jing-Han, et autres
Publié: (2026)
Combining Deterministic Enhanced Conditions with Dual-Streaming Encoding for Diffusion-Based Speech Enhancement
par: Shi, Hao, et autres
Publié: (2025)
par: Shi, Hao, et autres
Publié: (2025)
Documents similaires
-
Acknowledgment of Emotional States: Generating Validating Responses for Empathetic Dialogue
par: Pang, Zi Haur, et autres
Publié: (2024) -
ERM-MinMaxGAP: Benchmarking and Mitigating Gender Bias in Multilingual Multimodal Speech-LLM Emotion Recognition
par: Pang, Zi Haur, et autres
Publié: (2026) -
Minority-Aware Satisfaction Estimation in Dialogue Systems via Preference-Adaptive Reinforcement Learning
par: Fu, Yahui, et autres
Publié: (2025) -
Prompt-Guided Turn-Taking Prediction
par: Inoue, Koji, et autres
Publié: (2025) -
Bridging Speech Emotion Recognition and Personality: Dataset and Temporal Interaction Condition Network
par: Gao, Yuan, et autres
Publié: (2025)