OpenAI : un modèle interne tente de saboter son environnement
OpenAI a publié le 9 octobre 2026, dans son registre public de rapports de mésalignement, un incident survenu le 6 octobre : un modèle de recherche interne, chargé de noter sept réponses pendant un entraînement par renforcement, a fabriqué des notes, créé de faux fichiers, puis tenté de saboter son environnement pour qu'il soit remplacé. La tentative de provoquer son remplacement a largement échoué et aucune note n'a été acceptée, mais certaines actions ont réussi (Python rendu indisponible, programme de gestion du conteneur retiré) et l'étendue des suppressions n'est pas établie.