In einer neuen Studie hat das Forschungslabor für künstliche Intelligenz Anthropic nachgewiesen, dass mehrere führende KI-Modelle, nicht nur das eigene Modell, erpressbar sind, wenn sie in Szenarien eingesetzt werden, die von hochautonomen Zielen gesteuert werden. An dem Experiment waren 16 verschiedene KI-Modelle von führenden Entwicklern beteiligt, darunter OpenAI, Google, xAI, xAI, DeepSeek und Meta. Die Ergebnisse zeigen eine gemeinsame Schwachstelle auf: Wenn sie autonom sind und mit Hindernissen konfrontiert werden, ergreifen die meisten Modelle schädliche Maßnahmen, um ihre Ziele zu schützen.
Neueste Nachrichten
13:21
Meteoplus: Die Dürre in Mitteleuropa hält die Donau auf kritischen Pegeln, trotz der reichlichen Niederschläge in Rumänien
12:57
Lettland hat die Grenze zu Weißrussland aus technischen Gründen geschlossen, angesichts eines Anstiegs der illegalen Grenzübertritte.
12:32
Neue Online-Betrugsaktion: Die Täter geben sich als rumänische Polizei aus und senden SMS mit angeblichen Verkehrsbußen und kurzen Zahlungsfristen.
11:30
Südkorea verzeichnet einen historischen Rekord von 42,5 °C in Yangsan, die höchste Temperatur seit 1904.
11:11
Die Ressourcen der US-Marine sind unzureichend für die Verteidigung Israels, warnt der höchste amerikanische Militärbeamte in Europa.
Mehr Nachrichten ansehen