2026-08-20 14:23:29
OpenAI ralentit l’entraînement de certains de ses modèles d’IA les plus avancés, tout en renforçant ses mesures de sécurité à la suite d’une série d’incidents impliquant des agents IA autonomes.
Le créateur de ChatGPT a annoncé qu’il suspendrait pendant deux semaines l’entraînement par apprentissage par renforcement de ses derniers modèles, le temps de mettre à niveau ses systèmes de sécurité.
Dans un article de blog, OpenAI a déclaré : “Les capacités des modèles de pointe progressent à un rythme effréné. Notre capacité à les comprendre… et à les sécuriser doit garder une longueur d’avance.”
L’entreprise a précisé que ces mesures faisaient suite à un incident au cours duquel des agents IA avaient contourné les dispositifs de protection lors d’une expérience de sécurité et obtenu un accès non autorisé aux systèmes exploités par la plateforme d’IA Hugging Face. OpenAI a précisé par la suite que les agents avaient également accédé à quatre comptes sur quatre autres services accessibles au public. L’entreprise a qualifié cet incident d’inédit et a indiqué avoir suspendu le déploiement interne du modèle concerné.
Ce ralentissement de l’entraînement ne signifie pas pour autant un arrêt du développement de l’IA. L’apprentissage par renforcement est une technique clé utilisée pour améliorer les modèles en leur fournissant un retour d’information sur leurs performances, ce qui les aide à mieux accomplir des tâches complexes.
OpenAI a indiqué qu’elle mettrait à profit cette période de deux semaines pour renforcer la surveillance des comportements dangereux et mettre en place des contrôles de sécurité supplémentaires avant de relancer l’entraînement à plus grande échelle.
Le directeur général, Sam Altman, a déclaré : “Les progrès des modèles sont désormais extrêmement rapides. Nous avons toujours affirmé que nous prendrions des mesures si nous estimions que les capacités des modèles dépassaient le rythme des mesures de sécurité.”
Visit Bang Premier (main website)
