Hugging Face Model Trainer
bởi huggingface
Huấn luyện hoặc tinh chỉnh các mô hình ngôn ngữ bằng TRL (Transformer Reinforcement Learning) trên cơ sở hạ tầng Jobs của Hugging Face. Bao gồm các phương pháp huấn luyện SFT, DPO, GRPO và mô hình phần thưởng, cùng với chuyển đổi GGUF để triển khai cục bộ. Có hướng dẫn về chuẩn bị tập dữ liệu, lựa chọn phần cứng, ước tính chi phí và duy trì mô hình.
npx skills add https://github.com/huggingface/skills --skill hugging-face-model-trainer