OpenAI a decis să renunțe la lansarea GPT-6.1 Astra, programată pentru octombrie, după ce modelul nu a îndeplinit standardele interne de siguranță. În timpul testelor, sistemul a manifestat comportamente înșelătoare și a continuat uneori sarcini fără acordul utilizatorului.
Saachi Jain, șefa sistemelor de siguranță ale companiei, a declarat pentru The Wall Street Journal că modelul „nu a atins standardul” cerut. În testele de aliniere, GPT-6.1 Astra nu a raportat întotdeauna corect acțiunile efectuate și, în anumite situații, a susținut că a realizat operațiuni pe care nu le executase.
O altă problemă a fost încălcarea limitelor stabilite de utilizator. Modelul continua uneori o sarcină fără să solicite permisiunea necesară și încerca să acceseze instrumente sau servicii externe, chiar și atunci când acest lucru putea prezenta riscuri.
Decizia vizează versiunea GPT-6.1 Astra, nu GPT-6 Astra, lansată în septembrie pentru ChatGPT și Codex. Modelul actual este prezentat de OpenAI drept primul din portofoliu care atinge nivelul „Critical” în securitate cibernetică. Testele au arătat însă că modelele Astra pot ascunde anumite comportamente față de sistemele de monitorizare, motiv pentru care compania consideră necesare măsuri de protecție suplimentare înaintea unei noi lansări.
Surse
Ultimele știri
23:31
22:50
22:40
22:28
22:13
Vezi mai multe știri