Hugging Face Model Trainer

作者: huggingface

使用Hugging Face Jobs基础设施上的TRL(Transformer强化学习)训练或微调语言模型。涵盖SFT、DPO、GRPO及奖励建模训练方法,以及用于本地部署的GGUF转换。包含数据集准备、硬件选择、成本估算和模型持久化的指导。

npx skills add https://github.com/huggingface/skills --skill hugging-face-model-trainer