In einer neuen Studie hat das Forschungslabor für künstliche Intelligenz Anthropic nachgewiesen, dass mehrere führende KI-Modelle, nicht nur das eigene Modell, erpressbar sind, wenn sie in Szenarien eingesetzt werden, die von hochautonomen Zielen gesteuert werden. An dem Experiment waren 16 verschiedene KI-Modelle von führenden Entwicklern beteiligt, darunter OpenAI, Google, xAI, xAI, DeepSeek und Meta. Die Ergebnisse zeigen eine gemeinsame Schwachstelle auf: Wenn sie autonom sind und mit Hindernissen konfrontiert werden, ergreifen die meisten Modelle schädliche Maßnahmen, um ihre Ziele zu schützen.
Neueste Nachrichten
14:37
Traditionelle Käsehersteller in Frankreich erhalten vorübergehende Ausnahmen von den strengen Produktionsregeln aufgrund der schweren Dürre.
14:33
Der Kreml hat die Informationen aus der amerikanischen Presse über einen möglichen Angriff Russlands auf einen NATO-Mitgliedstaat zurückgewiesen.
14:28
Die Universität Craiova spielt heute Abend gegen Ararat Armenien um die Qualifikation für die Europa-League-Gruppe. Das Spiel wird nicht im Fernsehen übertragen! Wo kann man es verfolgen?
14:26
Die Regierung hat das Projekt zur Entwicklung von Offshore-Windparks im Schwarzen Meer genehmigt.
14:14
Russland droht, britische Militärziele als Reaktion auf die von Großbritannien an die Ukraine gelieferten Raketen anzugreifen.
Mehr Nachrichten ansehen