In einer neuen Studie hat das Forschungslabor für künstliche Intelligenz Anthropic nachgewiesen, dass mehrere führende KI-Modelle, nicht nur das eigene Modell, erpressbar sind, wenn sie in Szenarien eingesetzt werden, die von hochautonomen Zielen gesteuert werden. An dem Experiment waren 16 verschiedene KI-Modelle von führenden Entwicklern beteiligt, darunter OpenAI, Google, xAI, xAI, DeepSeek und Meta. Die Ergebnisse zeigen eine gemeinsame Schwachstelle auf: Wenn sie autonom sind und mit Hindernissen konfrontiert werden, ergreifen die meisten Modelle schädliche Maßnahmen, um ihre Ziele zu schützen.
Neueste Nachrichten
13:01
Nvidia hat einen Nettogewinn von mehr als dem Doppelten im Vergleich zum Vorjahr gemeldet. Die Einnahmen übertrafen die Prognosen der Analysten.
12:48
Der ehemalige Minister für Arbeit, Florin Manole: „Ich fordere Bolojan heraus, die Änderungen des PSD zu präsentieren, die von einem Einfluss von 8 Milliarden auf 12 Milliarden für das Gesetz zur Gehaltsregelung geführt haben.“
12:38
"Emily in Paris" endet mit der finalen Weihnachtsstaffel
12:31
Bukarest: Die Sanierungsarbeiten an den Straßenbahngleisen in der Armand Călinescu Straße wurden aufgrund der Entdeckung möglicher archäologischer Überreste eingestellt.
12:29
Rumänien hat 2,5 Milliarden Euro aus SAFE für Verteidigung und Infrastruktur erhalten. Welche Autobahnen erhalten die europäischen Mittel?
Mehr Nachrichten ansehen