agent-evals-and-observability

SKILLFlujo de trabajocomunidad
v0.0.0magnus919MITActualizado hace 6 dFuente →

Design, run, review, or release framework- and vendor-neutral evaluations and observability for AI agents. Use when defining agent evals, datasets, graders, trajectory review, regression analysis, release gates, production traces, or privacy-aware telemetry. Covers task and trajectory contracts, sta

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
44Estrellas del repo
1Clientes
1Formatos
hace 6 dÚltima actualización
Skill
Autormagnus919
Versión0.0.0
LicenciaMIT
CategoríaFlujo de trabajo
Formatosskill.md
PromptNo publicado
Compatibilidad
Claude✓ Compatible
Cursor
Copilot
ChatGPT
Gemini
Acerca de

Design, run, review, or release framework- and vendor-neutral evaluations and observability for AI agents. Use when defining agent evals, datasets, graders, trajectory review, regression analysis, release gates, production traces, or privacy-aware telemetry. Covers task and trajectory contracts, statistical comparisons, and incident-to-case learning; route framework implementation to pydanticai or

Palabras clave
skillclaude