Skill

pytorch-preference-optimization

PyTorch patterns for implementing preference optimization losses (DPO, SimPO, etc.) for LLM training.

Claim this listing

Connect your GitHub to prove you own or maintain this listing. We verify repo access automatically — most publishers are confirmed in seconds.

1Connect GitHub
2Submit your claim
3Auto-verified, or reviewed within 48h