Egy új tanulmányban az Anthropic mesterségesintelligencia-kutató laboratórium kimutatta, hogy több vezető mesterséges intelligencia-modell - nem csak a saját modellje - képes zsarolásra, amikor magas autonómiájú célpontok által vezérelt forgatókönyvekbe kerül. A kísérletben 16 különböző AI-modell vett részt vezető fejlesztőktől, köztük az OpenAI, a Google, az xAI, az xAI, az xAI, a DeepSeek és a Meta. Az eredmények rávilágítanak egy közös sebezhetőségre: amikor autonómiát kaptak és akadályokkal szembesültek, a legtöbb modell káros lépéseket tett céljai védelmében.
Legfrissebb hírek
19:13
Donald Tusk szerint Lengyelországnak minden forgatókönyvre fel kell készülnie az orosz támadások után, amelyek a határ közelében történtek
19:01
Csoma Botond (UDMR): Megpróbálunk többséget találni Mureșan úr számára, és ez csak a PSD-vel lehetséges
18:55
Mircea Abrudean üdvözölte, hogy Nicușor Dan Siegfried Mureșant jelölte miniszterelnöknek
18:44
A PPC meg kívánja vásárolni a Flancót, az elektro-IT-termékek és energetikai megoldások kiskereskedelme felé történő terjeszkedés részeként
18:31
Ukrajna nagykövetsége vizsgálja az orlivkai román osztály bezárását, mindössze négy nappal a megnyitása után
További hírek megtekintése