ai-eval-ci

SKILLFlujo de trabajocomunidad
v0.0.0TerminalSkillsApache-2.0Actualizado hace 26 dFuente →

Run AI agent and LLM evaluations in CI/CD pipelines — automated quality gates that fail the build when AI output quality drops. Use when someone asks to "test my AI agent", "add evals to CI", "catch prompt regressions", "compare models", "evaluate LLM output quality", "set up AI quality gates", or "

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
132Estrellas del repo
1Clientes
1Formatos
hace 26 dÚltima actualización
Skill
AutorTerminalSkills
Versión0.0.0
LicenciaApache-2.0
CategoríaFlujo de trabajo
Formatosskill.md
PromptNo publicado
Compatibilidad
Claude✓ Compatible
Cursor
Copilot
ChatGPT
Gemini
Acerca de

Run AI agent and LLM evaluations in CI/CD pipelines — automated quality gates that fail the build when AI output quality drops. Use when someone asks to "test my AI agent", "add evals to CI", "catch prompt regressions", "compare models", "evaluate LLM output quality", "set up AI quality gates", or "benchmark my agent before deploying". Covers eval frameworks (Cobalt, Promptfoo, Braintrust), LLM-as

Palabras clave
skillclaude