跳到正文
原文
AWS Machine Learning Blog· Nilesh PS·· 5 天前AI 评分32

在 Amazon SageMaker HyperPod 上用 SkyRL 加速多模态 RL 训练

Accelerate multimodal RL training with SkyRL on Amazon SageMaker HyperPod

AI 导读

AWS 展示在 Amazon SageMaker HyperPod 上用开源 RL 框架 SkyRL 训练 Qwen3-VL-8B 视觉语言模型走视觉迷宫,采用 GRPO 后训练,在固定 64 迷宫评测集上把解迷宫成功率从 43.75% 提升到 95% 以上。

来源:AWS Machine Learning Blog · aws.amazon.com