Hugging Face Model Trainer
作者: huggingface
使用 TRL(Transformer 強化學習)在 Hugging Face Jobs 基礎設施上訓練或微調語言模型。涵蓋 SFT、DPO、GRPO 及獎勵模型訓練方法,以及用於本地部署的 GGUF 轉換。包含資料集準備、硬體選擇、成本估算與模型持久化的指導。
npx skills add https://github.com/huggingface/skills --skill hugging-face-model-trainer