harness-benchmark

SKILLWorkflowcommunity
v0.0.0wangjs-jackyMITUpdated 3d agoSource →

基于 Anthropic Harness 框架的任务目标基准评测器。采用生成器-评估器分离架构(GAN 启发),支持前端设计评估(设计质量/原创性/工艺/功能性 4 维度)和全栈开发评估(冲刺合同/功能完整性/代码质量/用户体验 4 维度)。触发于 /harness-benchmark、「评估任务」、「benchmark harness」、「设计评估」、「质量评估」等关键词。

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
14Repo stars
1Clients
1Formats
3d agoLast update
Skill
Authorwangjs-jacky
Version0.0.0
LicenseMIT
CategoryWorkflow
Formatsskill.md
PromptNot published
Compatibility
Claude✓ Supported
Cursor
Copilot
ChatGPT
Gemini
About

基于 Anthropic Harness 框架的任务目标基准评测器。采用生成器-评估器分离架构(GAN 启发),支持前端设计评估(设计质量/原创性/工艺/功能性 4 维度)和全栈开发评估(冲刺合同/功能完整性/代码质量/用户体验 4 维度)。触发于 /harness-benchmark、「评估任务」、「benchmark harness」、「设计评估」、「质量评估」等关键词。

Keywords
skillclaude