agent-evaluation
Pass
Audited by Gen Agent Trust Hub on Sep 15, 2026
Risk Level: SAFE
Full Analysis
- [SAFE]: No security issues detected. The skill consists entirely of instructional content, prompt templates, and implementation patterns for AI evaluation. It does not implement dangerous tool calls, network operations, file system access, or privilege escalation. The documentation focuses on improving agent quality through metrics and systematic testing workflows.
Audit Metadata