openai-evals-and-observability
Installation
SKILL.md
OpenAI Evals And Observability
When to use
Invoke when an OpenAI-backed capability needs measurable quality gates, production telemetry, prompt/model versioning, or operational monitoring.
Do not use to define the model contract from scratch. The quality target should
come from ai-architecture.md or a quality-engineering handoff.
Inputs
Required:
- Approved
ai-architecture.mdor existing OpenAI capability implementation. - Capability name and success criteria.
- Evaluation examples or source for creating them.
- Target application language, framework, and telemetry stack.