openai-evals-and-observability

Installation
SKILL.md

OpenAI Evals And Observability

When to use

Invoke when an OpenAI-backed capability needs measurable quality gates, production telemetry, prompt/model versioning, or operational monitoring.

Do not use to define the model contract from scratch. The quality target should come from ai-architecture.md or a quality-engineering handoff.

Inputs

Required:

  • Approved ai-architecture.md or existing OpenAI capability implementation.
  • Capability name and success criteria.
  • Evaluation examples or source for creating them.
  • Target application language, framework, and telemetry stack.
Installs
3
GitHub Stars
12
First Seen
Jun 10, 2026
openai-evals-and-observability — amritmalla/claude-full-stack-2.0