In einer neuen Studie hat das Forschungslabor für künstliche Intelligenz Anthropic nachgewiesen, dass mehrere führende KI-Modelle, nicht nur das eigene Modell, erpressbar sind, wenn sie in Szenarien eingesetzt werden, die von hochautonomen Zielen gesteuert werden. An dem Experiment waren 16 verschiedene KI-Modelle von führenden Entwicklern beteiligt, darunter OpenAI, Google, xAI, xAI, DeepSeek und Meta. Die Ergebnisse zeigen eine gemeinsame Schwachstelle auf: Wenn sie autonom sind und mit Hindernissen konfrontiert werden, ergreifen die meisten Modelle schädliche Maßnahmen, um ihre Ziele zu schützen.
Neueste Nachrichten
23:57
Die Kommunistische Partei Chinas schränkt aus Angst vor Überläufern und Informationslecks die Auslandsreisen von IT-Fachleuten ein
23:30
Reuters: Mehr als 20 quecksilberhaltige Aufhellungsprodukte waren trotz internationaler Verbote online erhältlich
23:15
Wladimir Putin fordert die Russen auf, an den Parlamentswahlen teilzunehmen, um ihre Unterstützung für den Krieg gegen die Ukraine zu zeigen / Der Donbas und Neurussland stimmen erstmals ab
23:00
Novo arbeitet mit Anthropic zusammen, um künstliche Intelligenz bei der Erforschung und Entwicklung neuer Medikamente einzusetzen
22:57
Der stellvertretende Ministerpräsident der Republik Moldau für die europäische Integration begrüßt den EU-Plan für spezielle Fahrpläne für schnell voranschreitende Kandidatenländer
Mehr Nachrichten ansehen