MedSkillAudit: A Domain-Specific Audit Framework for Medical Research Agent Skills
Fuente:
arXiv
Salvato in:
| Autori principali: | Hou, Yingyong, Lao, Xinyuan, Wang, Huimei, Yao, Qianyu, Chen, Wei, Huang, Bocheng, Sun, Fei, Lv, Yuxian, Lei, Weiqi, Wen, Xueqian, Xia, Pengfei, Tan, Zhujun, Xie, Shengyang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Structured Security Auditing and Robustness Enhancement for Untrusted Agent Skills
di: Lv, Lijia, et al.
Pubblicazione: (2026)
di: Lv, Lijia, et al.
Pubblicazione: (2026)
Counterfactual Trace Auditing of LLM Agent Skills
di: Zhou, Xiaolin, et al.
Pubblicazione: (2026)
di: Zhou, Xiaolin, et al.
Pubblicazione: (2026)
SkillProbe: Security Auditing for Emerging Agent Skill Marketplaces via Multi-Agent Collaboration
di: Guo, Zihan, et al.
Pubblicazione: (2026)
di: Guo, Zihan, et al.
Pubblicazione: (2026)
Graduate Information Literacy Skills: The 2003 ANU Skills Audit
di: Perrett, Valerie
Pubblicazione: (2004)
di: Perrett, Valerie
Pubblicazione: (2004)
MedOpenClaw and MedFlowBench: Auditing Medical Agents in Full-Study Workflows
di: Shen, Weixiang, et al.
Pubblicazione: (2026)
di: Shen, Weixiang, et al.
Pubblicazione: (2026)
Semia: Auditing Agent Skills via Constraint-Guided Representation Synthesis
di: Wen, Hongbo, et al.
Pubblicazione: (2026)
di: Wen, Hongbo, et al.
Pubblicazione: (2026)
Sealing the Audit-Runtime Gap for LLM Skills
di: Shen, Tingda, et al.
Pubblicazione: (2026)
di: Shen, Tingda, et al.
Pubblicazione: (2026)
Agent Skills Should Go Beyond Text: The Case for Visual Skills
di: Xu, Binxiao, et al.
Pubblicazione: (2026)
di: Xu, Binxiao, et al.
Pubblicazione: (2026)
STARS: Skill-Triggered Audit for Request-Conditioned Invocation Safety in Agent Systems
di: Zhang, Guijia, et al.
Pubblicazione: (2026)
di: Zhang, Guijia, et al.
Pubblicazione: (2026)
Novice Auditors and Audits of Fair Values: Knowledge and Skill Requirements*
di: J. Efrim Boritz, et al.
Pubblicazione: (2024)
di: J. Efrim Boritz, et al.
Pubblicazione: (2024)
SkillForge: Forging Domain-Specific, Self-Evolving Agent Skills in Cloud Technical Support
di: Liu, Xingyan, et al.
Pubblicazione: (2026)
di: Liu, Xingyan, et al.
Pubblicazione: (2026)
SkillOps: Managing LLM Agent Skill Libraries as Self-Maintaining Software Ecosystems
di: Pu, Hongji, et al.
Pubblicazione: (2026)
di: Pu, Hongji, et al.
Pubblicazione: (2026)
An Audit of Skills and Qualifications in Preservation and Conservation Techniques: The Case of the University of Zambia Libraries
di: Shameenda, Kimbo Lemmy, et al.
Pubblicazione: (2012)
di: Shameenda, Kimbo Lemmy, et al.
Pubblicazione: (2012)
Auditable Agents
di: Nian, Yi, et al.
Pubblicazione: (2026)
di: Nian, Yi, et al.
Pubblicazione: (2026)
TAPE: Tailored Posterior Difference for Auditing of Machine Unlearning
di: Wang, Weiqi, et al.
Pubblicazione: (2025)
di: Wang, Weiqi, et al.
Pubblicazione: (2025)
AUDITA: A New Dataset to Audit Humans vs. AI Skill at Audio QA
di: Kabir, Tasnim, et al.
Pubblicazione: (2026)
di: Kabir, Tasnim, et al.
Pubblicazione: (2026)
Distribution-Specific Auditing For Subgroup Fairness
di: Hsu, Daniel, et al.
Pubblicazione: (2024)
di: Hsu, Daniel, et al.
Pubblicazione: (2024)
SkillGenBench: Benchmarking Skill Generation Pipelines for LLM Agents
di: Zhou, Yifan, et al.
Pubblicazione: (2026)
di: Zhou, Yifan, et al.
Pubblicazione: (2026)
AuditGPT: Auditing Smart Contracts with ChatGPT
di: Xia, Shihao, et al.
Pubblicazione: (2024)
di: Xia, Shihao, et al.
Pubblicazione: (2024)
RepoAudit: An Autonomous LLM-Agent for Repository-Level Code Auditing
di: Guo, Jinyao, et al.
Pubblicazione: (2025)
di: Guo, Jinyao, et al.
Pubblicazione: (2025)
Optimally Auditing Adversarial Agents
di: Das, Sanmay, et al.
Pubblicazione: (2026)
di: Das, Sanmay, et al.
Pubblicazione: (2026)
Auditing Agent Harness Safety
di: Liu, Chengzhi, et al.
Pubblicazione: (2026)
di: Liu, Chengzhi, et al.
Pubblicazione: (2026)
Explainable Information Retrieval in the Audit Domain
di: Frummet, Alexander, et al.
Pubblicazione: (2025)
di: Frummet, Alexander, et al.
Pubblicazione: (2025)
SkillMaster: Toward Autonomous Skill Mastery in LLM Agents
di: Yang, Min, et al.
Pubblicazione: (2026)
di: Yang, Min, et al.
Pubblicazione: (2026)
MemAudit: Post-hoc Auditing of Poisoned Agent Memory via Causal Attribution and Structural Anomaly Detection
di: Tan, Zhewen, et al.
Pubblicazione: (2026)
di: Tan, Zhewen, et al.
Pubblicazione: (2026)
SnapAudit: Active Auditing of Differentially Private In-Context Learning via Snapshot-Based Simulation
di: Xia, Yuyang, et al.
Pubblicazione: (2025)
di: Xia, Yuyang, et al.
Pubblicazione: (2025)
Audited Skill-Graph Self-Improvement for Agentic LLMs via Verifiable Rewards, Experience Synthesis, and Continual Memory
di: Huang, Ken, et al.
Pubblicazione: (2025)
di: Huang, Ken, et al.
Pubblicazione: (2025)
SkillSieve: A Hierarchical Triage Framework for Detecting Malicious AI Agent Skills
di: Hou, Yinghan, et al.
Pubblicazione: (2026)
di: Hou, Yinghan, et al.
Pubblicazione: (2026)
SkillTrojan: Backdoor Attacks on Skill-Based Agent Systems
di: Feng, Yunhao, et al.
Pubblicazione: (2026)
di: Feng, Yunhao, et al.
Pubblicazione: (2026)
Fairness Auditing with Multi-Agent Collaboration
di: de Vos, Martijn, et al.
Pubblicazione: (2024)
di: de Vos, Martijn, et al.
Pubblicazione: (2024)
CSR‐Linked Compensation Contract and Audit Pricing
di: Yiqing Tan
Pubblicazione: (2025)
di: Yiqing Tan
Pubblicazione: (2025)
Does Audit Partner Workload Affect the Disclosure of Critical Audit Matters? Evidence From China
di: Bingxin Yi, et al.
Pubblicazione: (2026)
di: Bingxin Yi, et al.
Pubblicazione: (2026)
From History to State: Constant-Context Skill Learning for LLM Agents
di: Xie, Haoyang, et al.
Pubblicazione: (2026)
di: Xie, Haoyang, et al.
Pubblicazione: (2026)
Formal Skill: Programmable Runtime Skills for Efficient and Accurate LLM Agents
di: Zhang, Xi, et al.
Pubblicazione: (2026)
di: Zhang, Xi, et al.
Pubblicazione: (2026)
Geometric Auditing of AI - Geometric Auditing of AI
di: Wyneken, B.
Pubblicazione: (2025)
di: Wyneken, B.
Pubblicazione: (2025)
Reporting Connectivity, Audit Quality, and Audit Fees
di: Meiting Lu, et al.
Pubblicazione: (2025)
di: Meiting Lu, et al.
Pubblicazione: (2025)
Skill over Scale: The Case for Medium, Domain-Specific Models for SE
di: Mukherjee, Manisha, et al.
Pubblicazione: (2023)
di: Mukherjee, Manisha, et al.
Pubblicazione: (2023)
Toward User Comprehension Supports for LLM Agent Skill Specifications
di: Wen, Zikai Alex
Pubblicazione: (2026)
di: Wen, Zikai Alex
Pubblicazione: (2026)
No Attack Required: Semantic Fuzzing for Specification Violations in Agent Skills
di: Li, Ying, et al.
Pubblicazione: (2026)
di: Li, Ying, et al.
Pubblicazione: (2026)
SkillMOO: Multi-Objective Optimization of Agent Skills for Software Engineering
di: Gong, Jingzhi, et al.
Pubblicazione: (2026)
di: Gong, Jingzhi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Structured Security Auditing and Robustness Enhancement for Untrusted Agent Skills
di: Lv, Lijia, et al.
Pubblicazione: (2026) -
Counterfactual Trace Auditing of LLM Agent Skills
di: Zhou, Xiaolin, et al.
Pubblicazione: (2026) -
SkillProbe: Security Auditing for Emerging Agent Skill Marketplaces via Multi-Agent Collaboration
di: Guo, Zihan, et al.
Pubblicazione: (2026) -
Graduate Information Literacy Skills: The 2003 ANU Skills Audit
di: Perrett, Valerie
Pubblicazione: (2004) -
MedOpenClaw and MedFlowBench: Auditing Medical Agents in Full-Study Workflows
di: Shen, Weixiang, et al.
Pubblicazione: (2026)