model-trainer

SKILLFlujo de trabajocomunidad
v0.0.0aisa-groupMITActualizado hace 17 dFuente →

This skill should be used when users want to train or fine-tune language models using TRL (Transformer Reinforcement Learning) on Hugging Face Jobs infrastructure. Covers SFT, DPO, GRPO and reward modeling training methods, plus GGUF conversion for local deployment. Includes guidance on the TRL Jobs

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
91Estrellas del repo
1Clientes
1Formatos
hace 17 dÚltima actualización
Skill
Autoraisa-group
Versión0.0.0
LicenciaMIT
CategoríaFlujo de trabajo
Formatosskill.md
PromptNo publicado
Compatibilidad
Claude✓ Compatible
Cursor
Copilot
ChatGPT
Gemini
Acerca de

This skill should be used when users want to train or fine-tune language models using TRL (Transformer Reinforcement Learning) on Hugging Face Jobs infrastructure. Covers SFT, DPO, GRPO and reward modeling training methods, plus GGUF conversion for local deployment. Includes guidance on the TRL Jobs package, UV scripts with PEP 723 format, dataset preparation and validation, hardware selection, co

Palabras clave
skillclaude