Hugging Face Model Trainer
por huggingface
Treine ou ajuste modelos de linguagem usando TRL (Transformer Reinforcement Learning) na infraestrutura de Jobs do Hugging Face. Abrange os métodos de treinamento SFT, DPO, GRPO e modelagem de recompensa, além da conversão para GGUF para implantação local. Inclui orientações sobre preparação de conjuntos de dados, seleção de hardware, estimativa de custos e persistência de modelos.
npx skills add https://github.com/huggingface/skills --skill hugging-face-model-trainer