llm-eval

SKILLWorkflowcommunauté
v0.0.0UitbreidenOSNOASSERTIONMis à jour il y a 1 moisSource →

LLM evaluation: build evaluation datasets, choose metrics (RAGAS, G-Eval, LLM-as-judge), run automated evals, monitor production quality, and detect regressions

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
14Étoiles du dépôt
1Clients
1Formats
il y a 1 moisDernière mise à jour
Skill
AuteurUitbreidenOS
Version0.0.0
LicenceNOASSERTION
CatégorieWorkflow
Formatsskill.md
PromptNon publié
Compatibilité
Claude✓ Pris en charge
Cursor
Copilot
ChatGPT
Gemini
À propos

LLM evaluation: build evaluation datasets, choose metrics (RAGAS, G-Eval, LLM-as-judge), run automated evals, monitor production quality, and detect regressions

Mots-clés
skillclaude