Diese so genannten "unterschwelligen" Muster können durch Trainingsdaten übermittelt werden und können Folgen haben, die von scheinbar harmlosen Verhaltensweisen bis hin zu gefährlichen Verhaltensweisen wie der Förderung von Mord oder Drogenhandel reichen. Die Muster scheinen für den Menschen bedeutungslos zu sein, und die Forscher sind sich nicht sicher, wie sie von den KI-Modellen wahrgenommen werden. Die Studie wurde von Anthropic in Zusammenarbeit mit Truthful AI durchgeführt und hat schwerwiegende Folgen für die Tech-Industrie, die zunehmend auf "synthetische" KI-Trainingsdaten zurückgreift.
Neueste Nachrichten
11:54
Ein ehemaliger Rektor der Universität „Ovidius“ soll in einem Fall von Prostitution festgenommen worden sein.
11:46
Ilie Bolojan fordert den Abschluss von etwa 4500 Projekten in den nächsten zwei Wochen
11:46
Der Iran bestreitet die Aussagen von Präsident Trump und hält die Straße von Hormuz blockiert.
11:33
Die Polizei in Österreich warnt vor einer Welle von Betrügereien, die von rumänischen Kriminellen begangen werden, die vorgeben, Polizeibeamte zu sein.
11:22
Der im Meer bei Costinești entdeckte Gegenstand, der vom Präfekten von Constanța als Drohne bestätigt wurde.
Mehr Nachrichten ansehen