提供使用slime(Megatron+SGLang框架)进行RL驱动的LLM后训练指导。适用于训练GLM模型、实现自定义数据生成等场景。
npx skills add https://github.com/firecrawl/ai-research-skills --skill slime-rl-training