Testing the Testers: Human-Driven Quality Assessment of Voice AI Testing Platforms
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Andres, Miguel E., Fedorov, Vadim, Sadek, Rida, Spagnolo-Arrizabalaga, Enric, Trudel, Nadescha |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AI-Assisted Visual Test and Bug Management Platform for Manual Testers
par: Mansi Rajgopal Kulkarni
Publié: (2026)
par: Mansi Rajgopal Kulkarni
Publié: (2026)
DriveTester: A Unified Platform for Simulation-Based Autonomous Driving Testing
par: Cheng, Mingfei, et autres
Publié: (2024)
par: Cheng, Mingfei, et autres
Publié: (2024)
HPCAgentTester: A Multi-Agent LLM Approach for Enhanced HPC Unit Test Generation
par: Karanjai, Rabimba, et autres
Publié: (2025)
par: Karanjai, Rabimba, et autres
Publié: (2025)
AI-Driven Agents with Prompts Designed for High Agreeableness Increase the Likelihood of Being Mistaken for a Human in the Turing Test
par: León-Domínguez, U., et autres
Publié: (2024)
par: León-Domínguez, U., et autres
Publié: (2024)
AI-Assisted Unit Test Writing and Test-Driven Code Refactoring: A Case Study
par: Smolic, Ema, et autres
Publié: (2026)
par: Smolic, Ema, et autres
Publié: (2026)
AI-driven Java Performance Testing: Balancing Result Quality with Testing Time
par: Traini, Luca, et autres
Publié: (2024)
par: Traini, Luca, et autres
Publié: (2024)
Responsible AI for Test Equity and Quality: The Duolingo English Test as a Case Study
par: Burstein, Jill, et autres
Publié: (2024)
par: Burstein, Jill, et autres
Publié: (2024)
TRACER: Trace-Based Adaptive Cost-Efficient Routing for LLM Classification
par: Rida, Adam
Publié: (2026)
par: Rida, Adam
Publié: (2026)
Position: Stop Evaluating AI with Human Tests, Develop Principled, AI-specific Tests instead
par: Sühr, Tom, et autres
Publié: (2025)
par: Sühr, Tom, et autres
Publié: (2025)
TestAgent: An Adaptive and Intelligent Expert for Human Assessment
par: Yu, Junhao, et autres
Publié: (2025)
par: Yu, Junhao, et autres
Publié: (2025)
WiFiPenTester: Advancing Wireless Ethical Hacking with Governed GenAI
par: Al-Sinani, Haitham S., et autres
Publié: (2026)
par: Al-Sinani, Haitham S., et autres
Publié: (2026)
Breaking Barriers in Software Testing: The Power of AI-Driven Automation
par: Naqvi, Saba, et autres
Publié: (2025)
par: Naqvi, Saba, et autres
Publié: (2025)
LADEV: A Language-Driven Testing and Evaluation Platform for Vision-Language-Action Models in Robotic Manipulation
par: Wang, Zhijie, et autres
Publié: (2024)
par: Wang, Zhijie, et autres
Publié: (2024)
AiraXiv: An AI-Driven Open-Access Platform for Human and AI Scientists
par: Pan, Junshu, et autres
Publié: (2026)
par: Pan, Junshu, et autres
Publié: (2026)
"Turing Tests" For An AI Scientist
par: Yin, Xiaoxin
Publié: (2024)
par: Yin, Xiaoxin
Publié: (2024)
SkillTester: Benchmarking Utility and Security of Agent Skills
par: Wang, Leye, et autres
Publié: (2026)
par: Wang, Leye, et autres
Publié: (2026)
Human-AI Collaborative Game Testing with Vision Language Models
par: Zhang, Boran, et autres
Publié: (2025)
par: Zhang, Boran, et autres
Publié: (2025)
Unit Testing in ASP Revisited: Language and Test-Driven Development Environment
par: Amendola, Giovanni, et autres
Publié: (2024)
par: Amendola, Giovanni, et autres
Publié: (2024)
Automated Self-Testing as a Quality Gate: Evidence-Driven Release Management for LLM Applications
par: Maiorano, Alexandre Cristovão
Publié: (2026)
par: Maiorano, Alexandre Cristovão
Publié: (2026)
Automated Red Teaming with GOAT: the Generative Offensive Agent Tester
par: Pavlova, Maya, et autres
Publié: (2024)
par: Pavlova, Maya, et autres
Publié: (2024)
BreachSeek: A Multi-Agent Automated Penetration Tester
par: Alshehri, Ibrahim, et autres
Publié: (2024)
par: Alshehri, Ibrahim, et autres
Publié: (2024)
LLMs for Automated Unit Test Generation and Assessment in Java: The AgoneTest Framework
par: Lops, Andrea, et autres
Publié: (2025)
par: Lops, Andrea, et autres
Publié: (2025)
Tests as Prompt: A Test-Driven-Development Benchmark for LLM Code Generation
par: Cui, Yi
Publié: (2025)
par: Cui, Yi
Publié: (2025)
Test-Driven Development for Code Generation
par: Mathews, Noble Saji, et autres
Publié: (2024)
par: Mathews, Noble Saji, et autres
Publié: (2024)
An Internet of Intelligent Things Framework for Decentralized Heterogeneous Platforms
par: Allayev, Vadim, et autres
Publié: (2025)
par: Allayev, Vadim, et autres
Publié: (2025)
Voice Mapping of Text-to-Speech Systems: A Metric-Based Approach for Voice Quality Assessment
par: Cai, Huanchen, et autres
Publié: (2026)
par: Cai, Huanchen, et autres
Publié: (2026)
The Future of Software Testing: AI-Powered Test Case Generation and Validation
par: Baqar, Mohammad, et autres
Publié: (2024)
par: Baqar, Mohammad, et autres
Publié: (2024)
From Test-Taking to Test-Making: Examining LLM Authoring of Commonsense Assessment Items
par: Roemmele, Melissa, et autres
Publié: (2024)
par: Roemmele, Melissa, et autres
Publié: (2024)
LLMs May Not Be Human-Level Players, But They Can Be Testers: Measuring Game Difficulty with LLM Agents
par: Xiao, Chang, et autres
Publié: (2024)
par: Xiao, Chang, et autres
Publié: (2024)
AI-Driven Tools in Modern Software Quality Assurance: An Assessment of Benefits, Challenges, and Future Directions
par: Pysmennyi, Ihor, et autres
Publié: (2025)
par: Pysmennyi, Ihor, et autres
Publié: (2025)
What Understanding Means in AI-Laden Astronomy
par: Ting, Yuan-Sen, et autres
Publié: (2026)
par: Ting, Yuan-Sen, et autres
Publié: (2026)
Expert Evaluation and the Limits of Human Feedback in Mental Health AI Safety Testing
par: Jafari, Kiana, et autres
Publié: (2026)
par: Jafari, Kiana, et autres
Publié: (2026)
MetAdv: A Unified and Interactive Adversarial Testing Platform for Autonomous Driving
par: Liu, Aishan, et autres
Publié: (2025)
par: Liu, Aishan, et autres
Publié: (2025)
Comparing Human Expertise and Large Language Models Embeddings in Content Validity Assessment of Personality Tests
par: Milano, Nicola, et autres
Publié: (2025)
par: Milano, Nicola, et autres
Publié: (2025)
PyGen: A Collaborative Human-AI Approach to Python Package Creation
par: Barua, Saikat, et autres
Publié: (2024)
par: Barua, Saikat, et autres
Publié: (2024)
Disrupting Test Development with AI Assistants
par: Joshi, Vijay, et autres
Publié: (2024)
par: Joshi, Vijay, et autres
Publié: (2024)
Agentic AI for Human Resources: LLM-Driven Candidate Assessment
par: Yuksel, Kamer Ali, et autres
Publié: (2026)
par: Yuksel, Kamer Ali, et autres
Publié: (2026)
Digital Health and Indoor Air Quality: An IoT-Driven Human-Centred Visualisation Platform for Behavioural Change and Technology Acceptance
par: Kureshi, Rameez Raja, et autres
Publié: (2024)
par: Kureshi, Rameez Raja, et autres
Publié: (2024)
Impatient Users Confuse AI Agents: High-fidelity Simulations of Human Traits for Testing Agents
par: He, Muyu, et autres
Publié: (2025)
par: He, Muyu, et autres
Publié: (2025)
Evaluating Human Trajectory Prediction with Metamorphic Testing
par: Spieker, Helge, et autres
Publié: (2024)
par: Spieker, Helge, et autres
Publié: (2024)
Documents similaires
-
AI-Assisted Visual Test and Bug Management Platform for Manual Testers
par: Mansi Rajgopal Kulkarni
Publié: (2026) -
DriveTester: A Unified Platform for Simulation-Based Autonomous Driving Testing
par: Cheng, Mingfei, et autres
Publié: (2024) -
HPCAgentTester: A Multi-Agent LLM Approach for Enhanced HPC Unit Test Generation
par: Karanjai, Rabimba, et autres
Publié: (2025) -
AI-Driven Agents with Prompts Designed for High Agreeableness Increase the Likelihood of Being Mistaken for a Human in the Turing Test
par: León-Domínguez, U., et autres
Publié: (2024) -
AI-Assisted Unit Test Writing and Test-Driven Code Refactoring: A Case Study
par: Smolic, Ema, et autres
Publié: (2026)