pytorch-preference-optimization

SKILLWorkflowcommunauté
v0.0.0cxcscmuMITMis à jour il y a 1 moisSource →

PyTorch patterns for implementing preference optimization losses (DPO, SimPO, etc.) for LLM training.

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
77Étoiles du dépôt
1Clients
1Formats
il y a 1 moisDernière mise à jour
Skill
Auteurcxcscmu
Version0.0.0
LicenceMIT
CatégorieWorkflow
Formatsskill.md
PromptNon publié
Compatibilité
Claude✓ Pris en charge
Cursor
Copilot
ChatGPT
Gemini
À propos

PyTorch patterns for implementing preference optimization losses (DPO, SimPO, etc.) for LLM training.

Mots-clés
skillclaude