Hugging Face Model Trainer
от huggingface
Обучайте или донастраивайте языковые модели с помощью TRL (Transformer Reinforcement Learning) на инфраструктуре Hugging Face Jobs. Охватывает методы обучения SFT, DPO, GRPO и модели вознаграждения, а также конвертацию в GGUF для локального развертывания. Включает рекомендации по подготовке наборов данных, выбору оборудования, оценке затрат и сохранению модели.
npx skills add https://github.com/huggingface/skills --skill hugging-face-model-trainer