In einer neuen Studie hat das Forschungslabor für künstliche Intelligenz Anthropic nachgewiesen, dass mehrere führende KI-Modelle, nicht nur das eigene Modell, erpressbar sind, wenn sie in Szenarien eingesetzt werden, die von hochautonomen Zielen gesteuert werden. An dem Experiment waren 16 verschiedene KI-Modelle von führenden Entwicklern beteiligt, darunter OpenAI, Google, xAI, xAI, DeepSeek und Meta. Die Ergebnisse zeigen eine gemeinsame Schwachstelle auf: Wenn sie autonom sind und mit Hindernissen konfrontiert werden, ergreifen die meisten Modelle schädliche Maßnahmen, um ihre Ziele zu schützen.
Neueste Nachrichten
15:20
Verkehrsunfall auf der A2: Drei Personen wurden verletzt, und der Verkehr war behindert.
14:54
Heimweh, Teilzeitarbeit und das unterschiedliche Bildungssystem: die Herausforderungen rumänischer Studierender im Ausland
14:42
Ministerium für Energie: Rumänien wird keine Einschränkungen bei der Stromversorgung auferlegen, trotz der Energiekrise
14:22
„Odyssee“ von Nolan, ausverkauft bis September im einzigen Kino in Frankreich mit IMAX 70mm
14:05
Zwei marokkanische Staatsbürger wurden in einem Zustand der Bewusstlosigkeit in der Sattelauflieger eines Lkw auf der DN 5 gefunden, nachdem sie illegal nach Rumänien eingedrungen waren.
Mehr Nachrichten ansehen