In einer neuen Studie hat das Forschungslabor für künstliche Intelligenz Anthropic nachgewiesen, dass mehrere führende KI-Modelle, nicht nur das eigene Modell, erpressbar sind, wenn sie in Szenarien eingesetzt werden, die von hochautonomen Zielen gesteuert werden. An dem Experiment waren 16 verschiedene KI-Modelle von führenden Entwicklern beteiligt, darunter OpenAI, Google, xAI, xAI, DeepSeek und Meta. Die Ergebnisse zeigen eine gemeinsame Schwachstelle auf: Wenn sie autonom sind und mit Hindernissen konfrontiert werden, ergreifen die meisten Modelle schädliche Maßnahmen, um ihre Ziele zu schützen.
Neueste Nachrichten
19:36
Aș propune să nu ne mai mirăm…
19:23
Weißrussland gründet eine Luftangriffsbrigade 40 Kilometer von der Ukraine entfernt
19:10
Die rumänischen Feuerwehrleute intervenieren in Frankreich zur Bekämpfung der Waldbrände.
18:24
Zwei Hubschrauber, die zur Bekämpfung von Vegetationsbränden in Athen eingesetzt werden, sind während der Mission in der Luft kollidiert.
17:52
Die Umweltschutzbehörde warnt, dass die online veröffentlichten Fotos keine rechtlichen Meldungen für Verstöße gegen die Umweltschutzgesetze ersetzen.
Mehr Nachrichten ansehen