Hugging Face Model Trainer
작성자: huggingface
TRL(Transformer Reinforcement Learning)을 사용하여 Hugging Face Jobs 인프라에서 언어 모델을 훈련하거나 미세 조정합니다. SFT, DPO, GRPO 및 보상 모델링 훈련 방법과 로컬 배포를 위한 GGUF 변환을 다룹니다. 데이터셋 준비, 하드웨어 선택, 비용 추정 및 모델 지속성에 대한 지침을 포함합니다.
npx skills add https://github.com/huggingface/skills --skill hugging-face-model-trainer