Hugging Face Model Trainer

Latih atau sesuaikan model bahasa menggunakan TRL (Transformer Reinforcement Learning) pada infrastruktur Hugging Face Jobs. Mencakup metode pelatihan SFT, DPO, GRPO, dan pemodelan reward, serta konversi GGUF untuk penerapan lokal. Termasuk panduan persiapan dataset, pemilihan perangkat keras, estimasi biaya, dan persistensi model.

npx skills add https://github.com/huggingface/skills --skill hugging-face-model-trainer

Lebih banyak skill dari huggingface