Koala OSS Club


Modal Training Gym | 开箱即用的 RL 训练场


Modal 推出的开源 Python SDK,专门做大模型的强化学习后训练。它把集群拓扑、Ray 和 NCCL 启动、卷挂载、断点续训、评测和模型服务这些基础设施全部包办,开发者只管写训练逻辑。内置十三个以上模型的训练配方,覆盖 Qwen 和 Gemma 系列,支持 slime 和 miles 两套训练框架,还带观测面板,文档里有十四个可直接跑的教程。 点评:RL 后训练现在是模型能力提升的主战场,Modal 在平台上将这部分能力做到开箱即用,且有可参考的示例,在产品设计上的巧思非常值得学习。
URL
https://gym.modal.dev/
标签
AI,云计算
视频
科技周报视频合集