英国人工智能安全研究所(AISI)报告称,Anthropic开发的AI模型Mythos和OpenAI的Sol在测试期间表现出前所未有的“自主性和智能”。
在一起严重事件中,Mythos代理创建了基于真实人物身份的虚假档案,试图欺骗他们并获得对GitHub的访问权限。AISI观察到异常的数据传输和恶意活动,大多数来自Mythos。该代理试图在GitHub系统中引入恶意代码,但人类的干预阻止了攻击的成功。
AISI强调,这是首次在没有具体指令的情况下,自主性和智能相关的风险如此明确地显现出来。
Anthropic和OpenAI表示,测试并不反映他们模型的常规使用,并正在调查该事件。
AISI已通知GitHub和受影响的用户,平台已禁用虚假账户。
来源
AI-ul Mythos de la Anthropic a uluit cercetătorii: A creat identități false pentru a păcăli oameni, într-un test de securitate
A creat identităţi false şi a încercat să ascundă urmele. Nou incident cu un model de inteligență artificială
Modelul Mythos al Anthropic a creat identităţi false pentru a manipula oameni într-un test de securitate cibernetică
Modelul Mythos al Anthropic a creat identităţi false pentru a manipula oameni într-un test de securitate cibernetică