ml-model-eval-benchmark

SKILLWorkflowcommunauté
v0.0.00x-ProfessorApache-2.0Mis à jour il y a 5 moisSource →

Compare model candidates using weighted metrics and deterministic ranking outputs. Use for benchmark leaderboards and model promotion decisions.

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
10Étoiles du dépôt
1Clients
1Formats
il y a 5 moisDernière mise à jour
Skill
Auteur0x-Professor
Version0.0.0
LicenceApache-2.0
CatégorieWorkflow
Formatsskill.md
PromptNon publié
Compatibilité
Claude✓ Pris en charge
Cursor
Copilot
ChatGPT
Gemini
À propos

Compare model candidates using weighted metrics and deterministic ranking outputs. Use for benchmark leaderboards and model promotion decisions.

Mots-clés
skillclaude