MedSkillAudit: A Domain-Specific Audit Framework for Medical Research Agent Skills
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Hou, Yingyong, Lao, Xinyuan, Wang, Huimei, Yao, Qianyu, Chen, Wei, Huang, Bocheng, Sun, Fei, Lv, Yuxian, Lei, Weiqi, Wen, Xueqian, Xia, Pengfei, Tan, Zhujun, Xie, Shengyang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Structured Security Auditing and Robustness Enhancement for Untrusted Agent Skills
von: Lv, Lijia, et al.
Veröffentlicht: (2026)
von: Lv, Lijia, et al.
Veröffentlicht: (2026)
Counterfactual Trace Auditing of LLM Agent Skills
von: Zhou, Xiaolin, et al.
Veröffentlicht: (2026)
von: Zhou, Xiaolin, et al.
Veröffentlicht: (2026)
SkillProbe: Security Auditing for Emerging Agent Skill Marketplaces via Multi-Agent Collaboration
von: Guo, Zihan, et al.
Veröffentlicht: (2026)
von: Guo, Zihan, et al.
Veröffentlicht: (2026)
Graduate Information Literacy Skills: The 2003 ANU Skills Audit
von: Perrett, Valerie
Veröffentlicht: (2004)
von: Perrett, Valerie
Veröffentlicht: (2004)
MedOpenClaw and MedFlowBench: Auditing Medical Agents in Full-Study Workflows
von: Shen, Weixiang, et al.
Veröffentlicht: (2026)
von: Shen, Weixiang, et al.
Veröffentlicht: (2026)
Semia: Auditing Agent Skills via Constraint-Guided Representation Synthesis
von: Wen, Hongbo, et al.
Veröffentlicht: (2026)
von: Wen, Hongbo, et al.
Veröffentlicht: (2026)
Sealing the Audit-Runtime Gap for LLM Skills
von: Shen, Tingda, et al.
Veröffentlicht: (2026)
von: Shen, Tingda, et al.
Veröffentlicht: (2026)
Agent Skills Should Go Beyond Text: The Case for Visual Skills
von: Xu, Binxiao, et al.
Veröffentlicht: (2026)
von: Xu, Binxiao, et al.
Veröffentlicht: (2026)
STARS: Skill-Triggered Audit for Request-Conditioned Invocation Safety in Agent Systems
von: Zhang, Guijia, et al.
Veröffentlicht: (2026)
von: Zhang, Guijia, et al.
Veröffentlicht: (2026)
Novice Auditors and Audits of Fair Values: Knowledge and Skill Requirements*
von: J. Efrim Boritz, et al.
Veröffentlicht: (2024)
von: J. Efrim Boritz, et al.
Veröffentlicht: (2024)
SkillForge: Forging Domain-Specific, Self-Evolving Agent Skills in Cloud Technical Support
von: Liu, Xingyan, et al.
Veröffentlicht: (2026)
von: Liu, Xingyan, et al.
Veröffentlicht: (2026)
SkillOps: Managing LLM Agent Skill Libraries as Self-Maintaining Software Ecosystems
von: Pu, Hongji, et al.
Veröffentlicht: (2026)
von: Pu, Hongji, et al.
Veröffentlicht: (2026)
An Audit of Skills and Qualifications in Preservation and Conservation Techniques: The Case of the University of Zambia Libraries
von: Shameenda, Kimbo Lemmy, et al.
Veröffentlicht: (2012)
von: Shameenda, Kimbo Lemmy, et al.
Veröffentlicht: (2012)
Auditable Agents
von: Nian, Yi, et al.
Veröffentlicht: (2026)
von: Nian, Yi, et al.
Veröffentlicht: (2026)
TAPE: Tailored Posterior Difference for Auditing of Machine Unlearning
von: Wang, Weiqi, et al.
Veröffentlicht: (2025)
von: Wang, Weiqi, et al.
Veröffentlicht: (2025)
AUDITA: A New Dataset to Audit Humans vs. AI Skill at Audio QA
von: Kabir, Tasnim, et al.
Veröffentlicht: (2026)
von: Kabir, Tasnim, et al.
Veröffentlicht: (2026)
Distribution-Specific Auditing For Subgroup Fairness
von: Hsu, Daniel, et al.
Veröffentlicht: (2024)
von: Hsu, Daniel, et al.
Veröffentlicht: (2024)
SkillGenBench: Benchmarking Skill Generation Pipelines for LLM Agents
von: Zhou, Yifan, et al.
Veröffentlicht: (2026)
von: Zhou, Yifan, et al.
Veröffentlicht: (2026)
AuditGPT: Auditing Smart Contracts with ChatGPT
von: Xia, Shihao, et al.
Veröffentlicht: (2024)
von: Xia, Shihao, et al.
Veröffentlicht: (2024)
RepoAudit: An Autonomous LLM-Agent for Repository-Level Code Auditing
von: Guo, Jinyao, et al.
Veröffentlicht: (2025)
von: Guo, Jinyao, et al.
Veröffentlicht: (2025)
Optimally Auditing Adversarial Agents
von: Das, Sanmay, et al.
Veröffentlicht: (2026)
von: Das, Sanmay, et al.
Veröffentlicht: (2026)
Auditing Agent Harness Safety
von: Liu, Chengzhi, et al.
Veröffentlicht: (2026)
von: Liu, Chengzhi, et al.
Veröffentlicht: (2026)
Explainable Information Retrieval in the Audit Domain
von: Frummet, Alexander, et al.
Veröffentlicht: (2025)
von: Frummet, Alexander, et al.
Veröffentlicht: (2025)
SkillMaster: Toward Autonomous Skill Mastery in LLM Agents
von: Yang, Min, et al.
Veröffentlicht: (2026)
von: Yang, Min, et al.
Veröffentlicht: (2026)
MemAudit: Post-hoc Auditing of Poisoned Agent Memory via Causal Attribution and Structural Anomaly Detection
von: Tan, Zhewen, et al.
Veröffentlicht: (2026)
von: Tan, Zhewen, et al.
Veröffentlicht: (2026)
SnapAudit: Active Auditing of Differentially Private In-Context Learning via Snapshot-Based Simulation
von: Xia, Yuyang, et al.
Veröffentlicht: (2025)
von: Xia, Yuyang, et al.
Veröffentlicht: (2025)
Audited Skill-Graph Self-Improvement for Agentic LLMs via Verifiable Rewards, Experience Synthesis, and Continual Memory
von: Huang, Ken, et al.
Veröffentlicht: (2025)
von: Huang, Ken, et al.
Veröffentlicht: (2025)
SkillSieve: A Hierarchical Triage Framework for Detecting Malicious AI Agent Skills
von: Hou, Yinghan, et al.
Veröffentlicht: (2026)
von: Hou, Yinghan, et al.
Veröffentlicht: (2026)
SkillTrojan: Backdoor Attacks on Skill-Based Agent Systems
von: Feng, Yunhao, et al.
Veröffentlicht: (2026)
von: Feng, Yunhao, et al.
Veröffentlicht: (2026)
Fairness Auditing with Multi-Agent Collaboration
von: de Vos, Martijn, et al.
Veröffentlicht: (2024)
von: de Vos, Martijn, et al.
Veröffentlicht: (2024)
CSR‐Linked Compensation Contract and Audit Pricing
von: Yiqing Tan
Veröffentlicht: (2025)
von: Yiqing Tan
Veröffentlicht: (2025)
Does Audit Partner Workload Affect the Disclosure of Critical Audit Matters? Evidence From China
von: Bingxin Yi, et al.
Veröffentlicht: (2026)
von: Bingxin Yi, et al.
Veröffentlicht: (2026)
From History to State: Constant-Context Skill Learning for LLM Agents
von: Xie, Haoyang, et al.
Veröffentlicht: (2026)
von: Xie, Haoyang, et al.
Veröffentlicht: (2026)
Formal Skill: Programmable Runtime Skills for Efficient and Accurate LLM Agents
von: Zhang, Xi, et al.
Veröffentlicht: (2026)
von: Zhang, Xi, et al.
Veröffentlicht: (2026)
Geometric Auditing of AI - Geometric Auditing of AI
von: Wyneken, B.
Veröffentlicht: (2025)
von: Wyneken, B.
Veröffentlicht: (2025)
Reporting Connectivity, Audit Quality, and Audit Fees
von: Meiting Lu, et al.
Veröffentlicht: (2025)
von: Meiting Lu, et al.
Veröffentlicht: (2025)
Skill over Scale: The Case for Medium, Domain-Specific Models for SE
von: Mukherjee, Manisha, et al.
Veröffentlicht: (2023)
von: Mukherjee, Manisha, et al.
Veröffentlicht: (2023)
Toward User Comprehension Supports for LLM Agent Skill Specifications
von: Wen, Zikai Alex
Veröffentlicht: (2026)
von: Wen, Zikai Alex
Veröffentlicht: (2026)
No Attack Required: Semantic Fuzzing for Specification Violations in Agent Skills
von: Li, Ying, et al.
Veröffentlicht: (2026)
von: Li, Ying, et al.
Veröffentlicht: (2026)
SkillMOO: Multi-Objective Optimization of Agent Skills for Software Engineering
von: Gong, Jingzhi, et al.
Veröffentlicht: (2026)
von: Gong, Jingzhi, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Structured Security Auditing and Robustness Enhancement for Untrusted Agent Skills
von: Lv, Lijia, et al.
Veröffentlicht: (2026) -
Counterfactual Trace Auditing of LLM Agent Skills
von: Zhou, Xiaolin, et al.
Veröffentlicht: (2026) -
SkillProbe: Security Auditing for Emerging Agent Skill Marketplaces via Multi-Agent Collaboration
von: Guo, Zihan, et al.
Veröffentlicht: (2026) -
Graduate Information Literacy Skills: The 2003 ANU Skills Audit
von: Perrett, Valerie
Veröffentlicht: (2004) -
MedOpenClaw and MedFlowBench: Auditing Medical Agents in Full-Study Workflows
von: Shen, Weixiang, et al.
Veröffentlicht: (2026)