Egy új tanulmányban az Anthropic mesterségesintelligencia-kutató laboratórium kimutatta, hogy több vezető mesterséges intelligencia-modell - nem csak a saját modellje - képes zsarolásra, amikor magas autonómiájú célpontok által vezérelt forgatókönyvekbe kerül. A kísérletben 16 különböző AI-modell vett részt vezető fejlesztőktől, köztük az OpenAI, a Google, az xAI, az xAI, az xAI, a DeepSeek és a Meta. Az eredmények rávilágítanak egy közös sebezhetőségre: amikor autonómiát kaptak és akadályokkal szembesültek, a legtöbb modell káros lépéseket tett céljai védelmében.
Legfrissebb hírek
23:57
A Kínai Kommunista Párt korlátozza az IT-szakemberek külföldi utazásait, tartva a disszidálásoktól és az információszivárgástól
23:30
Reuters: Több mint 20 higanyt tartalmazó bőrvilágosító terméket találtak online elérhetőként, a nemzetközi tilalmak ellenére
23:15
Vlagyimir Putyin arra kéri az oroszokat, hogy vegyenek részt a parlamenti választásokon, hogy kinyilvánítsák támogatásukat az Ukrajna elleni háború iránt / Donbász és Novorosszija első alkalommal szavaz
23:00
A Novo együttműködik az Anthropic-kal a mesterséges intelligencia új gyógyszerek kutatásában és fejlesztésében való alkalmazásáért
22:57
A Moldovai Köztársaság európai integrációért felelős miniszterelnök-helyettese üdvözli az EU gyorsan előrehaladó tagjelölt országok számára kidolgozott ütemtervekre vonatkozó tervét
További hírek megtekintése