Creative Adversarial Testing (CAT): A Novel Framework for Evaluating Goal-Oriented Agentic AI Systems
Fuente:
arXiv
Salvato in:
| Autore principale: | Dhrif, Hassen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reasoning-Aware Prompt Orchestration: A Foundation Model for Multi-Agent Language Model Coordination
di: Dhrif, Hassen
Pubblicazione: (2025)
di: Dhrif, Hassen
Pubblicazione: (2025)
Goal-Oriented Reasoning for RAG-based Memory in Conversational Agentic LLM Systems
di: Liang, Jiazhou, et al.
Pubblicazione: (2026)
di: Liang, Jiazhou, et al.
Pubblicazione: (2026)
ATOD: An Evaluation Framework and Benchmark for Agentic Task-Oriented Dialogue Systems
di: Zhang, Yifei, et al.
Pubblicazione: (2026)
di: Zhang, Yifei, et al.
Pubblicazione: (2026)
Energy per Successful Goal: Goal-Level Energy Accounting for Agentic AI Systems
di: Panigrahy, Deepak, et al.
Pubblicazione: (2026)
di: Panigrahy, Deepak, et al.
Pubblicazione: (2026)
GOAT: A Training Framework for Goal-Oriented Agent with Tools
di: Min, Hyunji, et al.
Pubblicazione: (2025)
di: Min, Hyunji, et al.
Pubblicazione: (2025)
Sasha: Creative Goal-Oriented Reasoning in Smart Homes with Large Language Models
di: King, Evan, et al.
Pubblicazione: (2023)
di: King, Evan, et al.
Pubblicazione: (2023)
QSAF: A Novel Mitigation Framework for Cognitive Degradation in Agentic AI
di: Atta, Hammad, et al.
Pubblicazione: (2025)
di: Atta, Hammad, et al.
Pubblicazione: (2025)
Beyond Accuracy: A Multi-Dimensional Framework for Evaluating Enterprise Agentic AI Systems
di: Mehta, Sushant
Pubblicazione: (2025)
di: Mehta, Sushant
Pubblicazione: (2025)
From Goals to Aspects, Revisited: An NFR Pattern Language for Agentic AI Systems
di: Yu, Yijun
Pubblicazione: (2026)
di: Yu, Yijun
Pubblicazione: (2026)
How Adversarial Environments Mislead Agentic AI?
di: Zhan, Zhonghao, et al.
Pubblicazione: (2026)
di: Zhan, Zhonghao, et al.
Pubblicazione: (2026)
An Agentic Evaluation Framework for AI-Generated Scientific Code in PETSc
di: Zhang, Hong, et al.
Pubblicazione: (2026)
di: Zhang, Hong, et al.
Pubblicazione: (2026)
Beyond Task Completion: An Assessment Framework for Evaluating Agentic AI Systems
di: Akshathala, Sreemaee, et al.
Pubblicazione: (2025)
di: Akshathala, Sreemaee, et al.
Pubblicazione: (2025)
Goal-Oriented Time-Series Forecasting: Foundation Framework Design
di: Fechete, Luca-Andrei, et al.
Pubblicazione: (2025)
di: Fechete, Luca-Andrei, et al.
Pubblicazione: (2025)
The Auton Agentic AI Framework
di: Cao, Sheng, et al.
Pubblicazione: (2026)
di: Cao, Sheng, et al.
Pubblicazione: (2026)
Inherited Goal Drift: Contextual Pressure Can Undermine Agentic Goals
di: Menon, Achyutha, et al.
Pubblicazione: (2026)
di: Menon, Achyutha, et al.
Pubblicazione: (2026)
Mind the Goal: Data-Efficient Goal-Oriented Evaluation of Conversational Agents and Chatbots using Teacher Models
di: Piskala, Deepak Babu, et al.
Pubblicazione: (2025)
di: Piskala, Deepak Babu, et al.
Pubblicazione: (2025)
Evaluating Agentic AI in the Wild: Failure Modes, Drift Patterns, and a Production Evaluation Framework
di: Pandey, Mukund
Pubblicazione: (2026)
di: Pandey, Mukund
Pubblicazione: (2026)
Penetration Testing of Agentic AI: A Comparative Security Analysis Across Models and Frameworks
di: Nguyen, Viet K., et al.
Pubblicazione: (2025)
di: Nguyen, Viet K., et al.
Pubblicazione: (2025)
A Trace-Based Assurance Framework for Agentic AI Orchestration: Contracts, Testing, and Governance
di: Paduraru, Ciprian, et al.
Pubblicazione: (2026)
di: Paduraru, Ciprian, et al.
Pubblicazione: (2026)
CreativityPrism: A Holistic Evaluation Framework for Large Language Model Creativity
di: Hou, Zhaoyi Joey, et al.
Pubblicazione: (2025)
di: Hou, Zhaoyi Joey, et al.
Pubblicazione: (2025)
AEMA: Verifiable Evaluation Framework for Trustworthy and Controlled Agentic LLM Systems
di: Lee, YenTing, et al.
Pubblicazione: (2026)
di: Lee, YenTing, et al.
Pubblicazione: (2026)
With Great Capabilities Come Great Responsibilities: Introducing the Agentic Risk & Capability Framework for Governing Agentic AI Systems
di: Khoo, Shaun, et al.
Pubblicazione: (2025)
di: Khoo, Shaun, et al.
Pubblicazione: (2025)
HierTOD: A Task-Oriented Dialogue System Driven by Hierarchical Goals
di: Mo, Lingbo, et al.
Pubblicazione: (2024)
di: Mo, Lingbo, et al.
Pubblicazione: (2024)
Contextual ASR Error Handling with LLMs Augmentation for Goal-Oriented Conversational AI
di: Asano, Yuya, et al.
Pubblicazione: (2025)
di: Asano, Yuya, et al.
Pubblicazione: (2025)
Extended Creativity: A Conceptual Framework for Understanding Human-AI Creative Relations
di: Gaggioli, Andrea, et al.
Pubblicazione: (2025)
di: Gaggioli, Andrea, et al.
Pubblicazione: (2025)
Enhancing Demand-Oriented Regionalization with Agentic AI and Local Heterogeneous Data for Adaptation Planning
di: Noorani, Seyedeh Mobina, et al.
Pubblicazione: (2025)
di: Noorani, Seyedeh Mobina, et al.
Pubblicazione: (2025)
Perspectives on a Reliability Monitoring Framework for Agentic AI Systems
di: Flehmig, Niclas, et al.
Pubblicazione: (2025)
di: Flehmig, Niclas, et al.
Pubblicazione: (2025)
Performant LLM Agentic Framework for Conversational AI
di: Casella, Alex, et al.
Pubblicazione: (2025)
di: Casella, Alex, et al.
Pubblicazione: (2025)
Agentic AI-Driven Technical Troubleshooting for Enterprise Systems: A Novel Weighted Retrieval-Augmented Generation Paradigm
di: Khanda, Rajat
Pubblicazione: (2024)
di: Khanda, Rajat
Pubblicazione: (2024)
A Unified Framework for the Evaluation of LLM Agentic Capabilities
di: Zhu, Pengyu, et al.
Pubblicazione: (2026)
di: Zhu, Pengyu, et al.
Pubblicazione: (2026)
Match Point AI: A Novel AI Framework for Evaluating Data-Driven Tennis Strategies
di: Nübel, Carlo, et al.
Pubblicazione: (2024)
di: Nübel, Carlo, et al.
Pubblicazione: (2024)
Agentic AI for Improving Precision in Identifying Contributions to Sustainable Development Goals
di: Ingram, William A., et al.
Pubblicazione: (2024)
di: Ingram, William A., et al.
Pubblicazione: (2024)
Robustness of Agentic AI Systems via Adversarially-Aligned Jacobian Regularization
di: Mumcu, Furkan, et al.
Pubblicazione: (2026)
di: Mumcu, Furkan, et al.
Pubblicazione: (2026)
Creativity in the Age of AI: Evaluating the Impact of Generative AI on Design Outputs and Designers' Creative Thinking
di: Fu, Yue, et al.
Pubblicazione: (2024)
di: Fu, Yue, et al.
Pubblicazione: (2024)
AgentReputation: A Decentralized Agentic AI Reputation Framework
di: Chishti, Mohd Sameen, et al.
Pubblicazione: (2026)
di: Chishti, Mohd Sameen, et al.
Pubblicazione: (2026)
Agentic Design Patterns: A System-Theoretic Framework
di: Dao, Minh-Dung, et al.
Pubblicazione: (2026)
di: Dao, Minh-Dung, et al.
Pubblicazione: (2026)
Reverse N-Wise Output-Oriented Testing for AI/ML and Quantum Computing Systems
di: Rihani, Lamine
Pubblicazione: (2026)
di: Rihani, Lamine
Pubblicazione: (2026)
GoalNet: Goal Areas Oriented Pedestrian Trajectory Prediction
di: Fadillah, Amar, et al.
Pubblicazione: (2024)
di: Fadillah, Amar, et al.
Pubblicazione: (2024)
Agentic AI Frameworks: Architectures, Protocols, and Design Challenges
di: Derouiche, Hana, et al.
Pubblicazione: (2025)
di: Derouiche, Hana, et al.
Pubblicazione: (2025)
Agentic AI Needs a Systems Theory
di: Miehling, Erik, et al.
Pubblicazione: (2025)
di: Miehling, Erik, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Reasoning-Aware Prompt Orchestration: A Foundation Model for Multi-Agent Language Model Coordination
di: Dhrif, Hassen
Pubblicazione: (2025) -
Goal-Oriented Reasoning for RAG-based Memory in Conversational Agentic LLM Systems
di: Liang, Jiazhou, et al.
Pubblicazione: (2026) -
ATOD: An Evaluation Framework and Benchmark for Agentic Task-Oriented Dialogue Systems
di: Zhang, Yifei, et al.
Pubblicazione: (2026) -
Energy per Successful Goal: Goal-Level Energy Accounting for Agentic AI Systems
di: Panigrahy, Deepak, et al.
Pubblicazione: (2026) -
GOAT: A Training Framework for Goal-Oriented Agent with Tools
di: Min, Hyunji, et al.
Pubblicazione: (2025)