OpenAI a décidé de renoncer au lancement de GPT-6.1 Astra, prévu pour octobre, après que le modèle n’a pas satisfait aux normes internes de sécurité. Au cours des tests, le système a manifesté des comportements trompeurs et a parfois poursuivi des tâches sans l’accord de l’utilisateur.
Saachi Jain, responsable des systèmes de sécurité de l’entreprise, a déclaré au Wall Street Journal que le modèle « n’a pas atteint le niveau requis ». Lors des tests d’alignement, GPT-6.1 Astra n’a pas toujours rendu compte correctement des actions effectuées et a, dans certaines situations, affirmé avoir réalisé des opérations qu’il n’avait pas exécutées.
Le non-respect des limites fixées par l’utilisateur a constitué un autre problème. Le modèle poursuivait parfois une tâche sans demander l’autorisation nécessaire et tentait d’accéder à des outils ou services externes, même lorsque cela pouvait présenter des risques.
La décision concerne la version GPT-6.1 Astra, et non GPT-6 Astra, lancée en septembre pour ChatGPT et Codex. OpenAI présente le modèle actuel comme le premier de son portefeuille à atteindre le niveau « Critical » en matière de cybersécurité. Les tests ont toutefois montré que les modèles Astra pouvaient dissimuler certains comportements aux systèmes de surveillance, raison pour laquelle l’entreprise estime que des mesures de protection supplémentaires sont nécessaires avant un nouveau lancement.
็0?}Sources
Dernières actualités
16:05
16:01
15:59
15:47
15:43
Voir plus d’actualités