trl-training

SKILLWorkflowCommunity
v0.0.0waybarriosMITAktualisiert vor 7 TQuelle →

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
470Repo-Sterne
1Clients
1Formate
vor 7 TLetzte Aktualisierung
Skill
Autorwaybarrios
Version0.0.0
LizenzMIT
KategorieWorkflow
Formateskill.md
PromptNicht veröffentlicht
Kompatibilität
Claude✓ Unterstützt
Cursor
Copilot
ChatGPT
Gemini
Über

Train and fine-tune transformer language models using TRL (Transformers Reinforcement Learning). Supports SFT, DPO, GRPO, KTO, RLOO and Reward Model training via CLI commands.

Schlagwörter
skillclaude