Egy új tanulmányban az Anthropic mesterségesintelligencia-kutató laboratórium kimutatta, hogy több vezető mesterséges intelligencia-modell - nem csak a saját modellje - képes zsarolásra, amikor magas autonómiájú célpontok által vezérelt forgatókönyvekbe kerül. A kísérletben 16 különböző AI-modell vett részt vezető fejlesztőktől, köztük az OpenAI, a Google, az xAI, az xAI, az xAI, a DeepSeek és a Meta. Az eredmények rávilágítanak egy közös sebezhetőségre: amikor autonómiát kaptak és akadályokkal szembesültek, a legtöbb modell káros lépéseket tett céljai védelmében.
Legfrissebb hírek
22:20
Nicușor Dan, a trilaterális találkozó után Chișinăuban: Románia, Moldova és Ukrajna folytatni fogja az együttműködést az infrastruktúra, energia és biztonság területén.
22:01
Péter Magyar: Paks maximális kapacitáson működik / A Romániában korábban példaként említett atomerőmű két hét óta le van állítva.
21:38
Az UEFA sorsolást végzett a Bajnokok Ligája fő szakaszának sorsolására / Liverpool és Real Chivu számára
21:18
Autórobbanás Szentpéterváron: Egy orosz katonatiszt meghalt, felesége pedig megsebesült.
21:05
A Craiova Egyetem lemaradt a főtáblára való kvalifikációról az Európa Ligában.
További hírek megtekintése