Humane Speech Synthesis through Zero-Shot Emotion and Disfluency Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chaudhury, Rohan, Godbole, Mihir, Garg, Aakash, Seo, Jinsil Hwaryoung |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HARGPT: Are LLMs Zero-Shot Human Activity Recognizers?
par: Ji, Sijie, et autres
Publié: (2024)
par: Ji, Sijie, et autres
Publié: (2024)
Role-Play Zero-Shot Prompting with Large Language Models for Open-Domain Human-Machine Conversation
par: Njifenjou, Ahmed, et autres
Publié: (2024)
par: Njifenjou, Ahmed, et autres
Publié: (2024)
Towards Human-like Multimodal Conversational Agent by Generating Engaging Speech
par: Kim, Taesoo, et autres
Publié: (2025)
par: Kim, Taesoo, et autres
Publié: (2025)
Why Would You Suggest That? Human Trust in Language Model Responses
par: Sharma, Manasi, et autres
Publié: (2024)
par: Sharma, Manasi, et autres
Publié: (2024)
Language Models as Zero-Shot Trajectory Generators
par: Kwon, Teyun, et autres
Publié: (2023)
par: Kwon, Teyun, et autres
Publié: (2023)
The Good, The Bad, and Why: Unveiling Emotions in Generative AI
par: Li, Cheng, et autres
Publié: (2023)
par: Li, Cheng, et autres
Publié: (2023)
GPT-4 Emulates Average-Human Emotional Cognition from a Third-Person Perspective
par: Tak, Ala N., et autres
Publié: (2024)
par: Tak, Ala N., et autres
Publié: (2024)
Persona-E$^2$: A Human-Grounded Dataset for Personality-Shaped Emotional Responses to Textual Events
par: Yang, Yuqin, et autres
Publié: (2026)
par: Yang, Yuqin, et autres
Publié: (2026)
Fakes of Varying Shades: How Warning Affects Human Perception and Engagement Regarding LLM Hallucinations
par: Nahar, Mahjabin, et autres
Publié: (2024)
par: Nahar, Mahjabin, et autres
Publié: (2024)
Human and LLM Biases in Hate Speech Annotations: A Socio-Demographic Analysis of Annotators and Targets
par: Giorgi, Tommaso, et autres
Publié: (2024)
par: Giorgi, Tommaso, et autres
Publié: (2024)
The Emotional Spectrum of LLMs: Leveraging Empathy and Emotion-Based Markers for Mental Health Support
par: De Grandi, Alessandro, et autres
Publié: (2024)
par: De Grandi, Alessandro, et autres
Publié: (2024)
A Generalized LLM-Augmented BIM Framework: Application to a Speech-to-BIM system
par: Lee, Ghang, et autres
Publié: (2024)
par: Lee, Ghang, et autres
Publié: (2024)
Tackling Cooperative Incompatibility for Zero-Shot Human-AI Coordination
par: Li, Yang, et autres
Publié: (2023)
par: Li, Yang, et autres
Publié: (2023)
Human Bias in the Face of AI: Examining Human Judgment Against Text Labeled as AI Generated
par: Zhu, Tiffany, et autres
Publié: (2024)
par: Zhu, Tiffany, et autres
Publié: (2024)
Cross-Lingual Speech Emotion Recognition: Humans vs. Self-Supervised Models
par: Han, Zhichen, et autres
Publié: (2024)
par: Han, Zhichen, et autres
Publié: (2024)
Are You Being Tracked? Discover the Power of Zero-Shot Trajectory Tracing with LLMs!
par: Yang, Huanqi, et autres
Publié: (2024)
par: Yang, Huanqi, et autres
Publié: (2024)
Layout Agnostic Human Activity Recognition in Smart Homes through Textual Descriptions Of Sensor Triggers (TDOST)
par: Thukral, Megha, et autres
Publié: (2024)
par: Thukral, Megha, et autres
Publié: (2024)
Advancing Speech Language Models by Scaling Supervised Fine-Tuning with Over 60,000 Hours of Synthetic Speech Dialogue Data
par: Zhao, Shuaijiang, et autres
Publié: (2024)
par: Zhao, Shuaijiang, et autres
Publié: (2024)
A Survey on Human-AI Collaboration with Large Foundation Models
par: Vats, Vanshika, et autres
Publié: (2024)
par: Vats, Vanshika, et autres
Publié: (2024)
Generation Z's Ability to Discriminate Between AI-generated and Human-Authored Text on Discord
par: Ramu, Dhruv, et autres
Publié: (2023)
par: Ramu, Dhruv, et autres
Publié: (2023)
Dyadic: A Scalable Platform for Human-Human and Human-AI Conversation Research
par: Markowitz, David M.
Publié: (2026)
par: Markowitz, David M.
Publié: (2026)
Efficient Machine Translation Corpus Generation: Integrating Human-in-the-Loop Post-Editing with Large Language Models
par: Yuksel, Kamer Ali, et autres
Publié: (2025)
par: Yuksel, Kamer Ali, et autres
Publié: (2025)
Mind What You Ask For: Emotional and Rational Faces of Persuasion by Large Language Models
par: Mieleszczenko-Kowszewicz, Wiktoria, et autres
Publié: (2025)
par: Mieleszczenko-Kowszewicz, Wiktoria, et autres
Publié: (2025)
Through the Lens of Human-Human Collaboration: A Configurable Research Platform for Exploring Human-Agent Collaboration
par: Yao, Bingsheng, et autres
Publié: (2025)
par: Yao, Bingsheng, et autres
Publié: (2025)
Exploring Human Perceptions of AI Responses: Insights from a Mixed-Methods Study on Risk Mitigation in Generative Models
par: Candello, Heloisa, et autres
Publié: (2025)
par: Candello, Heloisa, et autres
Publié: (2025)
Performance Gains of LLMs With Humans in a World of LLMs Versus Humans
par: McCullum, Lucas, et autres
Publié: (2025)
par: McCullum, Lucas, et autres
Publié: (2025)
AI on My Shoulder: Supporting Emotional Labor in Front-Office Roles with an LLM-based Empathetic Coworker
par: Swain, Vedant Das, et autres
Publié: (2024)
par: Swain, Vedant Das, et autres
Publié: (2024)
Socio-Emotional Response Generation: A Human Evaluation Protocol for LLM-Based Conversational Systems
par: Vanel, Lorraine, et autres
Publié: (2024)
par: Vanel, Lorraine, et autres
Publié: (2024)
Do We Talk to Robots Like Therapists, and Do They Respond Accordingly? Language Alignment in AI Emotional Support
par: Chiang, Sophie, et autres
Publié: (2025)
par: Chiang, Sophie, et autres
Publié: (2025)
CALLM: Understanding Cancer Survivors' Emotions and Intervention Opportunities via Mobile Diaries and Context-Aware Language Models
par: Wang, Zhiyuan, et autres
Publié: (2025)
par: Wang, Zhiyuan, et autres
Publié: (2025)
Can Good Writing Be Generative? Expert-Level AI Writing Emerges through Fine-Tuning on High-Quality Books
par: Chakrabarty, Tuhin, et autres
Publié: (2026)
par: Chakrabarty, Tuhin, et autres
Publié: (2026)
Game Development as Human-LLM Interaction
par: Hong, Jiale, et autres
Publié: (2024)
par: Hong, Jiale, et autres
Publié: (2024)
How Do AI Agents Do Human Work? Comparing AI and Human Workflows Across Diverse Occupations
par: Wang, Zora Zhiruo, et autres
Publié: (2025)
par: Wang, Zora Zhiruo, et autres
Publié: (2025)
Human-AI Interaction Alignment: Designing, Evaluating, and Evolving Value-Centered AI For Reciprocal Human-AI Futures
par: Shen, Hua, et autres
Publié: (2025)
par: Shen, Hua, et autres
Publié: (2025)
Is ChatGPT More Empathetic than Humans?
par: Welivita, Anuradha, et autres
Publié: (2024)
par: Welivita, Anuradha, et autres
Publié: (2024)
Position: Towards Bidirectional Human-AI Alignment
par: Shen, Hua, et autres
Publié: (2024)
par: Shen, Hua, et autres
Publié: (2024)
LVLMs and Humans Ground Differently in Referential Communication
par: Zeng, Peter, et autres
Publié: (2026)
par: Zeng, Peter, et autres
Publié: (2026)
Evaluating LLMs as Human Surrogates in Controlled Experiments
par: Hoq, Adnan, et autres
Publié: (2026)
par: Hoq, Adnan, et autres
Publié: (2026)
On the Role of Artificial Intelligence in Human-Machine Symbiosis
par: Chang, Ching-Chun, et autres
Publié: (2026)
par: Chang, Ching-Chun, et autres
Publié: (2026)
Human Latency Conversational Turns for Spoken Avatar Systems
par: Jacoby, Derek, et autres
Publié: (2024)
par: Jacoby, Derek, et autres
Publié: (2024)
Documents similaires
-
HARGPT: Are LLMs Zero-Shot Human Activity Recognizers?
par: Ji, Sijie, et autres
Publié: (2024) -
Role-Play Zero-Shot Prompting with Large Language Models for Open-Domain Human-Machine Conversation
par: Njifenjou, Ahmed, et autres
Publié: (2024) -
Towards Human-like Multimodal Conversational Agent by Generating Engaging Speech
par: Kim, Taesoo, et autres
Publié: (2025) -
Why Would You Suggest That? Human Trust in Language Model Responses
par: Sharma, Manasi, et autres
Publié: (2024) -
Language Models as Zero-Shot Trajectory Generators
par: Kwon, Teyun, et autres
Publié: (2023)