agent-evals

SKILLFlujo de trabajocomunidad
v0.0.0BagelHoleMITActualizado hace 3 mFuente →

Build automated evaluation suites for AI agents using golden datasets, rubrics, and regression gates. Use when shipping agent features, validating prompt changes, or gating deployments on quality.

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
47Estrellas del repo
1Clientes
1Formatos
hace 3 mÚltima actualización
Skill
AutorBagelHole
Versión0.0.0
LicenciaMIT
CategoríaFlujo de trabajo
Formatosskill.md
PromptNo publicado
Compatibilidad
Claude✓ Compatible
Cursor
Copilot
ChatGPT
Gemini
Acerca de

Build automated evaluation suites for AI agents using golden datasets, rubrics, and regression gates. Use when shipping agent features, validating prompt changes, or gating deployments on quality.

Palabras clave
skillclaude