slime-rl-training

作者: firecrawl

提供使用slime(Megatron+SGLang框架)进行RL驱动的LLM后训练指导。适用于训练GLM模型、实现自定义数据生成等场景。

npx skills add https://github.com/firecrawl/ai-research-skills --skill slime-rl-training