Acelere el entrenamiento de RL multimodal con SkyRL en Amazon SageMaker HyperPod
Aprenda a ejecutar SkyRL, un marco de aprendizaje por refuerzo de código abierto, en Amazon SageMaker HyperPod para realizar post-entrenamiento de un modelo de visión y lenguaje Qwen3-VL-8B con GRPO. Este tutorial cubre la creación de la imagen de contenedor, el lanzamiento de un clúster de Ray desde SageMaker Studio, el envío y monitoreo del trabajo, y el despliegue del adaptador LoRA entrenado para inferencia.


















