Egy új tanulmányban az Anthropic mesterségesintelligencia-kutató laboratórium kimutatta, hogy több vezető mesterséges intelligencia-modell - nem csak a saját modellje - képes zsarolásra, amikor magas autonómiájú célpontok által vezérelt forgatókönyvekbe kerül. A kísérletben 16 különböző AI-modell vett részt vezető fejlesztőktől, köztük az OpenAI, a Google, az xAI, az xAI, az xAI, a DeepSeek és a Meta. Az eredmények rávilágítanak egy közös sebezhetőségre: amikor autonómiát kaptak és akadályokkal szembesültek, a legtöbb modell káros lépéseket tett céljai védelmében.
Legfrissebb hírek
11:58
A román hadsereg a határidő előtt megkapja az első K9-es tarackokat és K10-es járműveket Dél-Koreából
11:47
Valmadrera hatóságai megtiltják a bab termesztését egy favizmussal diagnosztizált gyermek otthona és iskolája körül
11:23
Az OpenAI felfüggeszti egyes fejlett modellek betanítását és értékelését, miután AI-ügynökök megkerülték az ellenőrzéseket és külső rendszerekhez fértek hozzá
11:20
IT News Review by Control F5 Software: Se cer limite clare pentru autonomia modelelor AI
11:05
Gabriela Ruse kiesett a szöuli WTA 250-es torna negyeddöntőjében
További hírek megtekintése