In einer neuen Studie hat das Forschungslabor für künstliche Intelligenz Anthropic nachgewiesen, dass mehrere führende KI-Modelle, nicht nur das eigene Modell, erpressbar sind, wenn sie in Szenarien eingesetzt werden, die von hochautonomen Zielen gesteuert werden. An dem Experiment waren 16 verschiedene KI-Modelle von führenden Entwicklern beteiligt, darunter OpenAI, Google, xAI, xAI, DeepSeek und Meta. Die Ergebnisse zeigen eine gemeinsame Schwachstelle auf: Wenn sie autonom sind und mit Hindernissen konfrontiert werden, ergreifen die meisten Modelle schädliche Maßnahmen, um ihre Ziele zu schützen.
Neueste Nachrichten
07:24
Christa Pike, erste Worte nach dem gescheiterten Hinrichtungsversuch: „Wo bin ich?“/ Anwälte fordern die Umwandlung der Strafe
07:18
Der designierte Premierminister Luca Niculescu beginnt heute Konsultationen mit den Parteien zur Bildung der Regierung
07:15
Herrenbasketball: U-BT Cluj siegt gegen Umana Reyer Venedig im BKT EuroCup
07:14
SpaceX spricht mit Banken und Vermögensverwaltern über eine Finanzierung in Höhe von 40 Milliarden Dollar für den Kauf von Nvidia-Chips
07:10
Der Staatssekretär im Energieministerium, Cristian Bușoi, kündigt an, dass die Wiederinbetriebnahme des Kraftwerks in Cernavodă vom Anstieg der Donauwasserführung und von der Entscheidung der Fachleute abhängt / „Wir können nicht riskieren, dass die Pumpen beschädigt werden“
Mehr Nachrichten ansehen