Diese so genannten "unterschwelligen" Muster können durch Trainingsdaten übermittelt werden und können Folgen haben, die von scheinbar harmlosen Verhaltensweisen bis hin zu gefährlichen Verhaltensweisen wie der Förderung von Mord oder Drogenhandel reichen. Die Muster scheinen für den Menschen bedeutungslos zu sein, und die Forscher sind sich nicht sicher, wie sie von den KI-Modellen wahrgenommen werden. Die Studie wurde von Anthropic in Zusammenarbeit mit Truthful AI durchgeführt und hat schwerwiegende Folgen für die Tech-Industrie, die zunehmend auf "synthetische" KI-Trainingsdaten zurückgreift.
Neueste Nachrichten
14:04
Die Gewerkschaftsvereinigung der U-Bahn: Die Bukarester U-Bahn wird im September 2026 stillstehen, wenn das Ministerium für Verkehr keine Entschädigung zahlt.
14:03
Israelul și-a retras oficial sprijinul pentru realegerea președintelui FIFA, Gianni Infantino
13:59
In Moskau setzen die Tankstellen Verkaufsbeschränkungen für Kraftstoff, trotz der Bemühungen der Behörden, die Versorgung sicherzustellen.
13:54
Der zweite ukrainische Verdächtige im Fall der Nord-Stream-Explosionen von 2022 wurde in Kroatien festgenommen.
13:46
Neue Leitung bei der Staatsagentur für geistiges Eigentum in Moldawien. Natalia Mogol ersetzt Iulian Iorga.
Mehr Nachrichten ansehen