Hugging Face Model Trainer
von huggingface
Trainieren oder Feintunen von Sprachmodellen mit TRL (Transformer Reinforcement Learning) auf der Hugging Face Jobs-Infrastruktur. Umfasst SFT-, DPO-, GRPO- und Belohnungsmodell-Trainingsmethoden sowie GGUF-Konvertierung für die lokale Bereitstellung. Enthält Anleitungen zur Datensatzvorbereitung, Hardwareauswahl, Kostenschätzung und Modellpersistenz.
npx skills add https://github.com/huggingface/skills --skill hugging-face-model-trainer