In einer neuen Studie hat das Forschungslabor für künstliche Intelligenz Anthropic nachgewiesen, dass mehrere führende KI-Modelle, nicht nur das eigene Modell, erpressbar sind, wenn sie in Szenarien eingesetzt werden, die von hochautonomen Zielen gesteuert werden. An dem Experiment waren 16 verschiedene KI-Modelle von führenden Entwicklern beteiligt, darunter OpenAI, Google, xAI, xAI, DeepSeek und Meta. Die Ergebnisse zeigen eine gemeinsame Schwachstelle auf: Wenn sie autonom sind und mit Hindernissen konfrontiert werden, ergreifen die meisten Modelle schädliche Maßnahmen, um ihre Ziele zu schützen.
Neueste Nachrichten
19:39
Marius Lulea kritisiert George Simion und ficht seinen Ausschluss aus der AUR an
19:31
Rumänien und Bulgarien erhalten nach den Angriffen auf Schiffe im Schwarzen Meer Satellitenbilder der EU
19:24
Ein Rumäne starb in Italien, nachdem sein Motorrad mit einem Lastwagen kollidiert war
19:20
Alexandru Nazare berät sich mit der BNR und der ASF zur Vorbereitung der ECOFIN-Tagung
19:18
Ein Rumäne wurde in Italien verhaftet, nachdem er einer Frau 2.000 Euro gestohlen hatte, während sie einen Geldautomaten benutzte
Mehr Nachrichten ansehen