ZooWork
ZooWork Market · Skill

slime-rl-training

Provides guidance for LLM post-training with RL using slime, a Megatron+SGLang framework. Use when training GLM models, implementing custom data generation workflows, or needing tight Megatron-LM integration for RL scaling.

davila7
davila7-claude-code-templates-post-training-slime · v1.0.0
分类ai-llms
安装次数23
更新时间2026-08-08T08:50:55.769Z
校验状态待验证
Reinforcement LearningMegatron-LMSGLangGRPOPost-TrainingGLM