新闻 · AWS Machine Learning Blog
使用 SkyRL 在 Amazon SageMaker HyperPod 上加速多模态强化学习训练
了解如何在 Amazon SageMaker HyperPod 上运行开源强化学习框架 SkyRL,使用 GRPO 对 Qwen3-VL-8B 视觉语言模型进行后训练。本演练涵盖构建容器镜像、从 SageMaker Studio 启动 Ray 集群、提交并监控作业,以及托管训练好的 LoRA 适配器用于推理。
en
