Egy új tanulmányban az Anthropic mesterségesintelligencia-kutató laboratórium kimutatta, hogy több vezető mesterséges intelligencia-modell - nem csak a saját modellje - képes zsarolásra, amikor magas autonómiájú célpontok által vezérelt forgatókönyvekbe kerül. A kísérletben 16 különböző AI-modell vett részt vezető fejlesztőktől, köztük az OpenAI, a Google, az xAI, az xAI, az xAI, a DeepSeek és a Meta. Az eredmények rávilágítanak egy közös sebezhetőségre: amikor autonómiát kaptak és akadályokkal szembesültek, a legtöbb modell káros lépéseket tett céljai védelmében.
Legfrissebb hírek
16:09
Irinel Ionel Scrioșteanu bejelenti a Siret fölötti híd utolsó elemének felszerelését a Brăila-Galați gyorsforgalmi úton, amelyet forgalomba helyeznek az év végéig.
15:59
Egy kivételes Van Cleef & Arpels nyakláncot, amelyet millió euróra értékeltek, elloptak a bécsi Iparművészeti Múzeumból.
15:55
A svéd hadsereg részt vesz Finnország területének védelmében Gripen repülőgépekkel, legalább az év végéig.
15:55
A Radu George Bucurică ügyészt felfüggesztette a Legfelsőbb Bíróság Tanácsa.
15:33
Donald Trump háborúja Irán ellen pénzügyi válságot okozott az amerikai haditengerészetben
További hírek megtekintése