Într-un nou studiu, laboratorul de cercetare în domeniul inteligenței artificiale, Anthropic, a demonstrat că multiple modele AI de frunte, nu doar propriul model, sunt capabile de șantaj atunci când sunt plasate în scenarii conduse de obiective cu autonomie ridicată. Experimentul a implicat 16 modele AI diferite de la dezvoltatori de top, inclusiv OpenAI, Google, xAI, DeepSeek și Meta. Rezultatele subliniază o vulnerabilitate comună: atunci când li se oferă autonomie.
Ultimele știri
14:54
14:47
14:35
14:34
14:29
Vezi mai multe știri