A Scalable Approach to Benchmarking the In-Conversation Differential Diagnostic Accuracy of a Health AI
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bhatt, Deep, Ayyagari, Surya, Mishra, Anuruddh |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Dyadic: A Scalable Platform for Human-Human and Human-AI Conversation Research
par: Markowitz, David M.
Publié: (2026)
par: Markowitz, David M.
Publié: (2026)
MHDash: An Online Platform for Benchmarking Mental Health-Aware AI Assistants
par: Zhang, Yihe, et autres
Publié: (2026)
par: Zhang, Yihe, et autres
Publié: (2026)
Optimizing Generative AI's Accuracy and Transparency in Inductive Thematic Analysis: A Human-AI Comparison
par: Nyaaba, Matthew, et autres
Publié: (2025)
par: Nyaaba, Matthew, et autres
Publié: (2025)
From Accuracy to Readiness: Metrics and Benchmarks for Human-AI Decision-Making
par: Lee, Min Hun
Publié: (2026)
par: Lee, Min Hun
Publié: (2026)
Beyond Accuracy: How AI Metacognitive Sensitivity improves AI-assisted Decision Making
par: Li, ZhaoBin, et autres
Publié: (2025)
par: Li, ZhaoBin, et autres
Publié: (2025)
Conversational Agents for Older Adults' Health: A Systematic Literature Review
par: An, Jiaxin, et autres
Publié: (2025)
par: An, Jiaxin, et autres
Publié: (2025)
Conversational Explanations: Discussing Explainable AI with Non-AI Experts
par: Zhang, Tong, et autres
Publié: (2025)
par: Zhang, Tong, et autres
Publié: (2025)
Is Conversational XAI All You Need? Human-AI Decision Making With a Conversational XAI Assistant
par: He, Gaole, et autres
Publié: (2025)
par: He, Gaole, et autres
Publié: (2025)
Toward Safe Evolution of Artificial Intelligence (AI) based Conversational Agents to Support Adolescent Mental and Sexual Health Knowledge Discovery
par: Park, Jinkyung, et autres
Publié: (2024)
par: Park, Jinkyung, et autres
Publié: (2024)
A LLM-based Controllable, Scalable, Human-Involved User Simulator Framework for Conversational Recommender Systems
par: Zhu, Lixi, et autres
Publié: (2024)
par: Zhu, Lixi, et autres
Publié: (2024)
Belief Offloading in Human-AI Interaction
par: Guingrich, Rose E., et autres
Publié: (2026)
par: Guingrich, Rose E., et autres
Publié: (2026)
VenusBench-Mobile: A Challenging and User-Centric Benchmark for Mobile GUI Agents with Capability Diagnostics
par: Gong, Yichen, et autres
Publié: (2026)
par: Gong, Yichen, et autres
Publié: (2026)
PASTA: A Scalable Framework for Multi-Policy AI Compliance Evaluation
par: Yang, Yu, et autres
Publié: (2026)
par: Yang, Yu, et autres
Publié: (2026)
"She was useful, but a bit too optimistic": Augmenting Design with Interactive Virtual Personas
par: Deep, Paluck, et autres
Publié: (2025)
par: Deep, Paluck, et autres
Publié: (2025)
Conversational Crowdsensing: A Parallel Intelligence Powered Novel Sensing Approach
par: Zhu, Zhengqiu, et autres
Publié: (2024)
par: Zhu, Zhengqiu, et autres
Publié: (2024)
Accuracy-Time Tradeoffs in AI-Assisted Decision Making under Time Pressure
par: Swaroop, Siddharth, et autres
Publié: (2023)
par: Swaroop, Siddharth, et autres
Publié: (2023)
Impact of Multimodal and Conversational AI on Learning Outcomes and Experience
par: Taneja, Karan, et autres
Publié: (2026)
par: Taneja, Karan, et autres
Publié: (2026)
Exploring Emotion-Sensitive LLM-Based Conversational AI
par: Brun, Antonin, et autres
Publié: (2025)
par: Brun, Antonin, et autres
Publié: (2025)
A Framework for Longitudinal Health AI Agents
par: Lin, Georgianna, et autres
Publié: (2026)
par: Lin, Georgianna, et autres
Publié: (2026)
Seeking Late Night Life Lines: Experiences of Conversational AI Use in Mental Health Crisis
par: Ajmani, Leah Hope, et autres
Publié: (2025)
par: Ajmani, Leah Hope, et autres
Publié: (2025)
The Illusion of Empathy: How AI Chatbots Shape Conversation Perception
par: Liu, Tingting, et autres
Publié: (2024)
par: Liu, Tingting, et autres
Publié: (2024)
A Framework for Leveraging Human Computation Gaming to Enhance Knowledge Graphs for Accuracy Critical Generative AI Applications
par: Buongiorno, Steph, et autres
Publié: (2024)
par: Buongiorno, Steph, et autres
Publié: (2024)
A Scalable Framework for Evaluating Health Language Models
par: Mallinar, Neil, et autres
Publié: (2025)
par: Mallinar, Neil, et autres
Publié: (2025)
More Isn't Always Better: Balancing Decision Accuracy and Conformity Pressures in Multi-AI Advice
par: Tsuchiya, Yuta, et autres
Publié: (2026)
par: Tsuchiya, Yuta, et autres
Publié: (2026)
AI-Enabled Conversational Journaling for Advancing Parkinson's Disease Symptom Tracking
par: Rashik, Mashrur, et autres
Publié: (2025)
par: Rashik, Mashrur, et autres
Publié: (2025)
Personalized to Persuade: The Effects of Contextualization and Warmth on Trust and Reliance in Conversational AI
par: Yazan, Mert, et autres
Publié: (2026)
par: Yazan, Mert, et autres
Publié: (2026)
AI Standardized Patient Improves Human Conversations in Advanced Cancer Care
par: Haut, Kurtis, et autres
Publié: (2025)
par: Haut, Kurtis, et autres
Publié: (2025)
How Managers Perceive AI-Assisted Conversational Training for Workplace Communication
par: Wilhelm, Lance T., et autres
Publié: (2025)
par: Wilhelm, Lance T., et autres
Publié: (2025)
Exploring Teachers' Perspectives on Using Conversational AI Agents for Group Collaboration
par: Ravi, Prerna, et autres
Publié: (2026)
par: Ravi, Prerna, et autres
Publié: (2026)
Trusting Your AI Agent Emotionally and Cognitively: Development and Validation of a Semantic Differential Scale for AI Trust
par: Shang, Ruoxi, et autres
Publié: (2024)
par: Shang, Ruoxi, et autres
Publié: (2024)
AI persuading AI vs AI persuading Humans: LLMs' Differential Effectiveness in Promoting Pro-Environmental Behavior
par: Doudkin, Alexander, et autres
Publié: (2025)
par: Doudkin, Alexander, et autres
Publié: (2025)
Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning
par: Lee, Dong Won, et autres
Publié: (2025)
par: Lee, Dong Won, et autres
Publié: (2025)
Designing Gaze Analytics for ELA Instruction: A User-Centered Dashboard with Conversational AI Support
par: Davalos, Eduardo, et autres
Publié: (2025)
par: Davalos, Eduardo, et autres
Publié: (2025)
When Generative AI Meets Extended Reality: Enabling Scalable and Natural Interactions
par: Zhu, Mingyu, et autres
Publié: (2026)
par: Zhu, Mingyu, et autres
Publié: (2026)
Beyond Passive Viewing: A Pilot Study of a Hybrid Learning Platform Augmenting Video Lectures with Conversational AI
par: Abraar, Mohammed, et autres
Publié: (2026)
par: Abraar, Mohammed, et autres
Publié: (2026)
WhiteTesseract: Reframing the Interpretation of Cultural Heritage through XR and Conversational AI
par: Li, Jingjing, et autres
Publié: (2026)
par: Li, Jingjing, et autres
Publié: (2026)
Decoding Workload and Agreement From EEG During Spoken Dialogue With Conversational AI
par: Zidar, Lucija Mihić, et autres
Publié: (2026)
par: Zidar, Lucija Mihić, et autres
Publié: (2026)
A Multi-Agent Conversational Bandit Approach to Online Evaluation and Selection of User-Aligned LLM Responses
par: Dai, Xiangxiang, et autres
Publié: (2025)
par: Dai, Xiangxiang, et autres
Publié: (2025)
Towards interactive evaluations for interaction harms in human-AI systems
par: Ibrahim, Lujain, et autres
Publié: (2024)
par: Ibrahim, Lujain, et autres
Publié: (2024)
Authors' Values and Attitudes Towards AI-bridged Scalable Personalization of Creative Language Arts
par: Kim, Taewook, et autres
Publié: (2024)
par: Kim, Taewook, et autres
Publié: (2024)
Documents similaires
-
Dyadic: A Scalable Platform for Human-Human and Human-AI Conversation Research
par: Markowitz, David M.
Publié: (2026) -
MHDash: An Online Platform for Benchmarking Mental Health-Aware AI Assistants
par: Zhang, Yihe, et autres
Publié: (2026) -
Optimizing Generative AI's Accuracy and Transparency in Inductive Thematic Analysis: A Human-AI Comparison
par: Nyaaba, Matthew, et autres
Publié: (2025) -
From Accuracy to Readiness: Metrics and Benchmarks for Human-AI Decision-Making
par: Lee, Min Hun
Publié: (2026) -
Beyond Accuracy: How AI Metacognitive Sensitivity improves AI-assisted Decision Making
par: Li, ZhaoBin, et autres
Publié: (2025)