agent-benchmark

SKILLFlujo de trabajocomunidad
v0.0.0greglas75MITActualizado hace 7 dFuente →

Self-benchmark: YOU write the code, adversarial reviews it (multi-provider), you fix, you write tests, adversarial reviews tests, you fix. Measures YOUR quality as an agent. Run in different models (Opus, Sonnet, Haiku) and compare results.

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
6Estrellas del repo
1Clientes
1Formatos
hace 7 dÚltima actualización
Skill
Autorgreglas75
Versión0.0.0
LicenciaMIT
CategoríaFlujo de trabajo
Formatosskill.md
PromptNo publicado
Compatibilidad
Claude✓ Compatible
Cursor
Copilot
ChatGPT
Gemini
Acerca de

Self-benchmark: YOU write the code, adversarial reviews it (multi-provider), you fix, you write tests, adversarial reviews tests, you fix. Measures YOUR quality as an agent. Run in different models (Opus, Sonnet, Haiku) and compare results.

Palabras clave
skillclaude