Hugging Face Model Trainer
par huggingface
Entraînez ou affinez des modèles de langage en utilisant TRL (Transformer Reinforcement Learning) sur l'infrastructure Hugging Face Jobs. Couvre les méthodes d'entraînement SFT, DPO, GRPO et le reward modeling, ainsi que la conversion en GGUF pour
npx skills add https://github.com/huggingface/skills --skill hugging-face-model-trainer