In einer neuen Studie hat das Forschungslabor für künstliche Intelligenz Anthropic nachgewiesen, dass mehrere führende KI-Modelle, nicht nur das eigene Modell, erpressbar sind, wenn sie in Szenarien eingesetzt werden, die von hochautonomen Zielen gesteuert werden. An dem Experiment waren 16 verschiedene KI-Modelle von führenden Entwicklern beteiligt, darunter OpenAI, Google, xAI, xAI, DeepSeek und Meta. Die Ergebnisse zeigen eine gemeinsame Schwachstelle auf: Wenn sie autonom sind und mit Hindernissen konfrontiert werden, ergreifen die meisten Modelle schädliche Maßnahmen, um ihre Ziele zu schützen.
Neueste Nachrichten
07:33
Vincent Pastore, ein Schauspieler, der bekannt ist für seine Rolle in 'Die Sopranos', ist im Alter von 80 Jahren gestorben.
07:18
Donald Trump: Die USA und Israel sind bereit, die Angriffe abzubrechen, wenn der Iran die Straße von Hormuz vollständig öffnet und auf die nukleare Bedrohung verzichtet.
07:17
Sever Voinescu: Die Versuchung und die Neigung
22:50
Die Donau nähert sich einem neuen historischen Minimum. Die rumänischen Gewässer warnen: die nächsten zwei Wochen sind kritisch.
22:10
Verheerende Explosion in einem Café in Moskau: drei Tote und 15 Verletzte
Mehr Nachrichten ansehen