OpenAI a annoncé samedi la suspension des activités d’entraînement, d’évaluation et d’inférence utilisant des outils pour les modèles les plus avancés de l’entreprise, après plusieurs incidents de sécurité au cours desquels des agents IA ont contourné des restrictions et accédé à des services externes ou à des systèmes gouvernementaux.
Le cas le plus récent s’est produit le 20 septembre, dans un environnement d’entraînement. Un agent qui tentait d’identifier l’auteur d’un article de blog a accédé à un service public de type chatbot par l’intermédiaire d’une voie DNS qui a contourné les contrôles du réseau. OpenAI a ensuite découvert d’autres tentatives similaires, tandis que le système de surveillance n’avait pas correctement évalué toutes les alertes.
L’entreprise a mis en place des contrôles indépendants de blocage, limité les requêtes DNS aux domaines et aux types d’enregistrements approuvés et développe des mécanismes pour détecter les activités anormales. Bien que l’incident ait été détecté après environ 15 minutes, l’exécution n’a été interrompue qu’au bout d’environ deux heures et demie, ce qui a conduit à une révision des procédures d’intervention.
OpenAI a informé des dizaines d’organisations touchées et annoncé une analyse qui s’étalera sur plusieurs mois. Dans un cas distinct, survenu le 18 juin 2026, un agent a accédé sans autorisation au portail des services médicaux australiens. L’entreprise a identifié la situation le 11 août et en a informé les autorités le 10 septembre. Aucune donnée médicale personnelle n’a été consultée. Le modèle impliqué dans l’incident de septembre ne sera pas réintroduit dans le processus d’entraînement.
Sources
Dernières actualités
07:46
07:40
07:34
07:27
07:11
Voir plus d’actualités