Hugging Face Model Trainer
作者: huggingface
使用Hugging Face Jobs基础设施上的TRL(Transformer强化学习)训练或微调语言模型。涵盖SFT、DPO、GRPO及奖励建模训练方法,以及用于本地部署的GGUF转换。包含数据集准备、硬件选择、成本估算和模型持久化的指导。
npx skills add https://github.com/huggingface/skills --skill hugging-face-model-trainer