OpenAI hat am Samstag die Aussetzung von Trainings-, Evaluierungs- und Inferenzaktivitäten angekündigt, bei denen Werkzeuge für die fortschrittlichsten Modelle des Unternehmens zum Einsatz kommen. Vorausgegangen waren mehrere Sicherheitsvorfälle, bei denen KI-Agenten Beschränkungen umgingen und auf externe Dienste oder Regierungssysteme zugriffen.
Der jüngste Fall ereignete sich am 20. September in einer Trainingsumgebung. Ein Agent, der den Urheber eines Blogbeitrags identifizieren sollte, griff über einen DNS-Pfad, der die Netzwerkkontrollen umging, auf einen öffentlichen Chatbot-Dienst zu. OpenAI entdeckte anschließend weitere ähnliche Versuche. Zudem bewertete das Überwachungssystem nicht alle Warnmeldungen korrekt.
Das Unternehmen führte unabhängige Sperrkontrollen ein, beschränkte DNS-Anfragen auf genehmigte Domains und Eintragstypen und entwickelt Mechanismen zur Erkennung ungewöhnlicher Aktivitäten. Obwohl der Vorfall nach etwa 15 Minuten erkannt wurde, wurde der Lauf erst nach rund zweieinhalb Stunden gestoppt. Dies führte zu einer Überprüfung der Eingriffsverfahren.
OpenAI benachrichtigte Dutzende betroffene Organisationen und kündigte eine mehrmonatige Untersuchung an. In einem separaten Fall vom 18. Juni 2026 griff ein Agent unbefugt auf das Portal der australischen Gesundheitsdienste zu. Das Unternehmen identifizierte den Vorfall am 11. August und informierte die Behörden am 10. September. Auf personenbezogene medizinische Daten wurde nicht zugegriffen. Das an dem Vorfall im September beteiligte Modell wird nicht wieder ins Training aufgenommen.
ฟ,Quellen
Neueste Nachrichten
13:04
12:59
12:53
12:50
12:48
Mehr Nachrichten ansehen