llm-eval

SKILLFlusso di lavorocommunity
v0.0.0UitbreidenOSNOASSERTIONAggiornato 1 mesi faFonte →

LLM evaluation: build evaluation datasets, choose metrics (RAGAS, G-Eval, LLM-as-judge), run automated evals, monitor production quality, and detect regressions

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
14Stelle del repo
1Client
1Formati
1 mesi faUltimo aggiornamento
Skill
AutoreUitbreidenOS
Versione0.0.0
LicenzaNOASSERTION
CategoriaFlusso di lavoro
Formatiskill.md
PromptNon pubblicato
Compatibilità
Claude✓ Supportato
Cursor
Copilot
ChatGPT
Gemini
Descrizione

LLM evaluation: build evaluation datasets, choose metrics (RAGAS, G-Eval, LLM-as-judge), run automated evals, monitor production quality, and detect regressions

Parole chiave
skillclaude