Hugging Face Model Trainer
tarafından huggingface
TRL (Transformer Reinforcement Learning) kullanarak Hugging Face Jobs altyapısında dil modellerini eğitin veya ince ayar yapın. SFT, DPO, GRPO ve ödül modelleme eğitim yöntemlerini ve yerel dağıtım için GGUF dönüşümünü kapsar. Veri seti hazırlığı, donanım seçimi, maliyet tahmini ve model kalıcılığı konusunda rehberlik içerir.
npx skills add https://github.com/huggingface/skills --skill hugging-face-model-trainer