Egy új tanulmányban az Anthropic mesterségesintelligencia-kutató laboratórium kimutatta, hogy több vezető mesterséges intelligencia-modell - nem csak a saját modellje - képes zsarolásra, amikor magas autonómiájú célpontok által vezérelt forgatókönyvekbe kerül. A kísérletben 16 különböző AI-modell vett részt vezető fejlesztőktől, köztük az OpenAI, a Google, az xAI, az xAI, az xAI, a DeepSeek és a Meta. Az eredmények rávilágítanak egy közös sebezhetőségre: amikor autonómiát kaptak és akadályokkal szembesültek, a legtöbb modell káros lépéseket tett céljai védelmében.
Legfrissebb hírek
12:11
Egy új terület a világ térképén / A Bougainville autonóm régió Pápua Új-Guineában elsöprő többséggel szavazott a függetlenségre
12:11
Vegetációs tűz Plauruban, amelyet a hadsereg segítségével oltottak el. A lángok egy drónról indultak
12:01
Az Egyesült Államok Élelmiszer- és Gyógyszerügyi Hivatala jóváhagyott egy gyógyszert, amely megduplázza a fejlett hasnyálmirigyrákos betegek túlélési arányát.
11:31
Special Informat.ro / Iskolakezdés: a valós számla az iskolai év kezdetén
11:25
Oroszország nemkívánatos személlyé nyilvánította a romániai nagykövetség egyik alkalmazottját Moszkvában.
További hírek megtekintése