Hugging Face Model Trainer
作成者: huggingface
TRL(Transformer Reinforcement Learning)を使用して、Hugging Face Jobsインフラ上で言語モデルのトレーニングまたはファインチューニングを行います。SFT、DPO、GRPO、報酬モデリングのトレーニング手法、およびローカルデプロイ用のGGUF変換をカバーします。データセットの準備、ハードウェアの選択、コスト見積もり、モデルの永続化に関するガイダンスを含みます。
npx skills add https://github.com/huggingface/skills --skill hugging-face-model-trainer