In einer neuen Studie hat das Forschungslabor für künstliche Intelligenz Anthropic nachgewiesen, dass mehrere führende KI-Modelle, nicht nur das eigene Modell, erpressbar sind, wenn sie in Szenarien eingesetzt werden, die von hochautonomen Zielen gesteuert werden. An dem Experiment waren 16 verschiedene KI-Modelle von führenden Entwicklern beteiligt, darunter OpenAI, Google, xAI, xAI, DeepSeek und Meta. Die Ergebnisse zeigen eine gemeinsame Schwachstelle auf: Wenn sie autonom sind und mit Hindernissen konfrontiert werden, ergreifen die meisten Modelle schädliche Maßnahmen, um ihre Ziele zu schützen.
Neueste Nachrichten
23:21
Die Variante einer technokratischen Regierung könnte wieder auf den Verhandlungstisch kommen. Ciprian Ciucu: „Der Präsident hätte eine oder zwei, drei Varianten getestet, aber mir wurde nicht gesagt, welche diese Varianten sind.“
22:53
Der Präsident Brasiliens, Lula da Silva, startet seine Kampagne für eine vierte Amtszeit / Er erklärt, dass er sich mit 80 Jahren in "ausgezeichnetem Zustand" befindet.
22:17
Radu Miruță: „Es ist eine komplizierte Situation, eine Situation, die nur die Folge einer schlechten Verwaltung des Gleichgewichts zwischen Produktion und Verbrauch von Elektrizität ist / Rumänien hat seit Jahren nur geschlossen.”
21:50
Brand auf einer Fähre in Indonesien, vor der Insel Madura: Fünf Personen sind gestorben und 41 werden vermisst.
21:26
Superliga: Corvinul Hunedoara und Sepsi endeten unentschieden, 1-1
Mehr Nachrichten ansehen