eval-designer

SKILLFlujo de trabajocomunidad
v0.0.0NickCrewMITActualizado hace 1 mFuente →

Use this skill when building evaluation frameworks to measure LLM quality, safety, accuracy, or alignment including test suites, human eval rubrics, automated evals, and metrics design. Not for training or fine-tuning models. Not for dataset curation or benchmark comparison across publicly available

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
32Estrellas del repo
1Clientes
1Formatos
hace 1 mÚltima actualización
Skill
AutorNickCrew
Versión0.0.0
LicenciaMIT
CategoríaFlujo de trabajo
Formatosskill.md
PromptNo publicado
Compatibilidad
Claude✓ Compatible
Cursor
Copilot
ChatGPT
Gemini
Acerca de

Use this skill when building evaluation frameworks to measure LLM quality, safety, accuracy, or alignment including test suites, human eval rubrics, automated evals, and metrics design. Not for training or fine-tuning models. Not for dataset curation or benchmark comparison across publicly available models.

Palabras clave
skillclaude