sickn33-advanced-evaluation

SKILLFlusso di lavorocommunity
v0.0.0sickn33MITAggiornato 8 g faFonte →

This skill should be used when the user asks to "implement LLM-as-judge", "compare model outputs", "create evaluation rubrics", "mitigate evaluation bias", or mentions direct scoring, pairwise comparison, position bias, evaluation pipelines, or automated quality assessment.

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
45kStelle del repo
1Client
1Formati
8 g faUltimo aggiornamento
Skill
Autoresickn33
Versione0.0.0
LicenzaMIT
CategoriaFlusso di lavoro
Formatiskill.md
PromptApri (vedi la scheda Prompt)
Compatibilità
Claude✓ Supportato
Cursor
Copilot
ChatGPT
Gemini
Descrizione

This skill should be used when the user asks to "implement LLM-as-judge", "compare model outputs", "create evaluation rubrics", "mitigate evaluation bias", or mentions direct scoring, pairwise comparison, position bias, evaluation pipelines, or automated quality assessment.

Parole chiave
skillclaude