Diese so genannten "unterschwelligen" Muster können durch Trainingsdaten übermittelt werden und können Folgen haben, die von scheinbar harmlosen Verhaltensweisen bis hin zu gefährlichen Verhaltensweisen wie der Förderung von Mord oder Drogenhandel reichen. Die Muster scheinen für den Menschen bedeutungslos zu sein, und die Forscher sind sich nicht sicher, wie sie von den KI-Modellen wahrgenommen werden. Die Studie wurde von Anthropic in Zusammenarbeit mit Truthful AI durchgeführt und hat schwerwiegende Folgen für die Tech-Industrie, die zunehmend auf "synthetische" KI-Trainingsdaten zurückgreift.
Neueste Nachrichten
13:19
Der iranische Außenminister warnt, dass Teheran im Falle einer neuen militärischen Konfrontation härter reagieren wird
12:59
Copernicus warnt: Hitzewellen und Waldbrände haben die Belastung durch Ozonverschmutzung erhöht
12:32
Die Ukraine bittet die EU um finanzielle Mittel und logistische Unterstützung für Agrarexporte. Rumänien und Polen warnen jedoch, dass die Infrastruktur an ihre Grenzen stößt.
12:01
Ehemaliger OpenAI-Forscher warnt, dass das Tempo der KI-Entwicklung die Fähigkeit übersteigt, ihre Risiken zu kontrollieren
11:42
Vier USR-Abgeordnete schlagen einen klaren Mechanismus zur Untersuchung der von Bürgern gemeldeten Gerüche und zur Bewertung der Auswirkungen auf die Gesundheit vor
Mehr Nachrichten ansehen