Egy új tanulmányban az Anthropic mesterségesintelligencia-kutató laboratórium kimutatta, hogy több vezető mesterséges intelligencia-modell - nem csak a saját modellje - képes zsarolásra, amikor magas autonómiájú célpontok által vezérelt forgatókönyvekbe kerül. A kísérletben 16 különböző AI-modell vett részt vezető fejlesztőktől, köztük az OpenAI, a Google, az xAI, az xAI, az xAI, a DeepSeek és a Meta. Az eredmények rávilágítanak egy közös sebezhetőségre: amikor autonómiát kaptak és akadályokkal szembesültek, a legtöbb modell káros lépéseket tett céljai védelmében.
Legfrissebb hírek
12:31
Bukarest: A villamosvonalak felújítási munkálatai az Armand Călinescu utcában felfüggesztésre kerültek lehetséges régészeti leletek felfedezése miatt.
12:29
Románia 2,5 milliárd eurót kapott a SAFE-től védelemre és infrastruktúrára. Milyen autópályák kapják az európai alapokat?
12:21
Az EPPO két személyt bíróság elé állít egy 240.000 eurós Erasmus+ alapokból származó állítólagos csalás miatt.
12:11
Egy új terület a világ térképén / A Bougainville autonóm régió Pápua Új-Guineában elsöprő többséggel szavazott a függetlenségre
12:11
Vegetációs tűz Plauruban, amelyet a hadsereg segítségével oltottak el. A lángok egy drónról indultak
További hírek megtekintése