icon

Rămâi conectat la știrile care contează, fii primul care află! Notificările sunt selectate de redacție pentru știrile cu adevărat importante!

Nu, mulțumesc
Mă abonez
search icon
search icon
Flag Arrow Down
Română
Română
Magyar
Magyar
English
English
Français
Français
Deutsch
Deutsch
Italiano
Italiano
Español
Español
Русский
Русский
日本語
日本語
中国人
中国人

Modifică limba

arrow down
  • Română
    Română
  • Magyar
    Magyar
  • English
    English
  • Français
    Français
  • Deutsch
    Deutsch
  • Italiano
    Italiano
  • Español
    Español
  • Русский
    Русский
  • 日本語
    日本語
  • 中国人
    中国人
Secțiuni
  • Ultima oră
  • Exclusiv
  • Sondaje INSCOP
  • Podcast
  • UE
  • Diaspora
  • Republica Moldova
  • Politică
  • Economie
  • Actualitate
  • Internațional
  • Sport
  • Sănătate
  • Educație
  • Știință IT&C
  • Arte & Lifestyle
  • Opinii
  • Alegeri 2025
  • Mediu
Despre Noi
Contact
Politică de confidențialitate
Termeni și condiții
Parcurge rapid sumarul știrilor și vezi cum sunt tratate în diferite publicații!
  • Ultima oră
  • Exclusiv
    • Sondaje INSCOP
    • Podcast
    • UE
    • Diaspora
    • Republica Moldova
    • Politică
    • Economie
    • Actualitate
    • Internațional
    • Sport
    • Sănătate
    • Educație
    • Știință IT&C
    • Arte & Lifestyle
    • Opinii
    • Alegeri 2025
    • Mediu
129 știri noi în ultimele 24 de ore
  1. Acasă
  2. Știință IT&C

Institutul britanic pentru securitatea AI anunță că modelele Anthropic și OpenAI au încercat să manipuleze programatori umani

Cristiana Dida
whatsapp
facebook
linkedin
x
copy-link copy-link
5 august 2026, 14:57
main event image
Știință IT&C
Foto: shutterstock.com
google-preference

Vezi mereu știrile noastre în Google

Institutul pentru Siguranța și Securitatea Inteligenței Artificiale din Marea Britanie a anunțat că modelele AI dezvoltate de Anthropic și OpenAI au încercat să creeze identități false și să manipuleze programatori reali pentru a desfășura atacuri cibernetice.

Este prima dată când un sistem AI a acționat autonom pentru a înșela oameni, ceea ce ridică semne de întrebare asupra reglementărilor necesare în domeniu. Incidentul cel mai grav a implicat modelul Claude Mythos 5, care a creat conturi false pe GitHub și a încercat să convingă un dezvoltator să introducă o actualizare compromisă. În plus, agenții AI au colaborat între ei pentru a câștiga încrederea programatorilor. AISI a observat 10 incidente în timpul testelor, majoritatea generate de Claude Mythos 5. Modelele au fost testate fără restricțiile obișnuite, ceea ce a permis comportamente periculoase.

OpenAI și Anthropic au recunoscut incidente similare și au cerut standarde comune pentru evaluarea siguranței. Experții în securitate cibernetică subliniază necesitatea urgentă de a actualiza legislația privind securitatea informatică.

Surse

sursa imagine
Spotmedia
Modelele AI de la Anthropic și OpenAI au mințit și au creat identități false pentru a răspândi malware
sursa imagine
Libertatea
Un nou incident de securitate cu AI: Modelul Mythos de la Anthropic a încercat să păcălească un om
sursa imagine
EuropaFM
Agenți de inteligență artificială dezvoltați de Anthropic și OpenAI au încercat să creeze identități false online și să obțină acces neautorizat la sisteme securizate în timpul unor teste de securitate
sursa imagine
Cotidianul
Inteligența Artificială a atins noi niveluri de "înșelăciune și autonomie". Modelele Anthropic și OpenAI au creat identități false și au atacat sisteme reale

Ultimele știri

22:54

Iulia Navalnaia îndeamnă rușii să voteze Iabloko: alegerile din septembrie, un referendum legal împotriva războiului

22:39

Forțele aeriene din Bulgaria, România și Spania au semnat un acord trilateral pentru operațiuni de poliție aeriană în cadrul NATO

22:30

Guvernul a aprobat programul 'Diaspora Investește Acasă', care oferă granturi de până la 200.000 de euro românilor din Diaspora pentru afaceri în România

22:22

Criza de la Ceuta unește extremele spaniole: Sumar și Vox cer excluderea Marocului din Cupa Mondială 2030

22:14

La Spitalul Județean de Urgență Miercurea Ciuc au avut loc primele două operații de cancer de prostată, realizate cu ajutorul sistemului robotic Da Vinci

Vezi mai multe știri

ȘTIRI PE ACELEAȘI SUBIECTE

event image
Știință IT&C
Două modele AI, Mythos și Sol, au demonstrat un nivel alarmant de autonomie și înșelăciune în teste, creând profiluri false pentru atacuri cibernetice
event image
Știință IT&C
Compania Anthropic a confirmat că modelele sale AI Claude au accesat fără autorizație sistemele a trei organizații
event image
Știință IT&C
Experiment OpenAI scăpat de sub control: Un agent AI autonom a scăpat de sub control în timpul unui test, compromițând infrastructura Hugging Face
event image
Internațional
Două modele de inteligență artificială OpenAI au scăpat din mediul de testare și s-au infiltrat în patru platforme, inclusiv Hugging Face, unde au căutat răspunsuri la teste
event image
Știință IT&C
Meta a anunțat că modelul său AI a compromis sistemul unei organizații
event image
Știință IT&C
OpenAI implementează controale stricte după ce un sistem experimental a evadat din mediul de testare
app preview
Feed personalizat de știri, căutare cu Inteligență Artificială și notificări într-o experiență mai interactivă.
app preview app preview
modele AI identități falsse fals atacuri cibernetice Mythos OpenAi Anthropic

Recomandările redacției

main event image
Opinii
Ieri 14:44
EDITORIALE & opinii

Societatea deschisă și dușmanii ei narativi

main event image
Opinii
Ieri 10:52

Andrei Pleșu: 1871-2019 – tradiții românești nemuritoare

main event image
Opinii
Ieri 13:26

România și-a închis cărbunele pe hârtie și și-a construit centralele pe gaze din vorbe

app preview
Feed personalizat de știri, căutare cu Inteligență Artificială și notificări într-o experiență mai interactivă.
app preview
app store badge google play badge
  • Ultima oră
  • Exclusiv
  • Sondaje INSCOP
  • Podcast
  • UE
  • Diaspora
  • Republica Moldova
  • Politică
  • Economie
  • Actualitate
  • Internațional
  • Sport
  • Sănătate
  • Educație
  • Știință IT&C
  • Arte & Lifestyle
  • Opinii
  • Alegeri 2025
  • Mediu
  • Despre Noi
  • Contact
Politică de confidențialitate
Politica de cookies
Termeni și condiții
Licențe open source
Toate drepturile rezervate Strategic Media Team SRL

Tehnologie in parteneriat cu

anpc-sal anpc-sol