ZooWork
ZooWork Market · Skill

slime-rl-training

Provides guidance for LLM post-training with RL using slime, a Megatron+SGLang framework. Use when training GLM models, implementing custom data generation workflows, or needing tight Megatron-LM integration for RL scaling.

◇
Orchestra-Research
orchestra-research-ai-research-skills-slime · v1.0.0
分类ai-llms
安装次数10
更新时间2026-09-13T07:33:00.698Z
校验状态待验证
Reinforcement LearningMegatron-LMSGLangGRPOPost-TrainingGLM