Nous avons transformé les problèmes mathématiques de @OpenAI en environnements de RL open-source sur @huggingface !
Tout débutant et peu soigné (le vérifieur ne accepte que la formulation originale exacte, donc une preuve équivalente peut toujours obtenir une note de 0), mais c’est ainsi qu’il ressemble lorsque une publication de recherche devient une infrastructure de formation exécutable pour tous.
C’est une direction passionnante, à mon avis : transformer la recherche ouverte en environnements exécutables ouverts que quiconque peut construire pour entraîner de meilleurs modèles ouverts !
https://huggingface.co/datasets/FineEnvs/openai-math

