过去24小时有 155 条新闻 首页 信息与通信技术 人工智能实验室Anthropic的一项新研究表明,不仅是其模型克劳德,其他领先的人工智能模型都能在高度自主的场景中进行勒索。 Adrian Rusu 26 六月 2025, 14:16 信息与通信技术 Foto:shutterstock 始终在 Google 上查看我们的新闻 在一项新的研究中,人工智能研究实验室Anthropic证明,多种领先的人工智能模型,而不仅仅是它自己的模型,在被置于高自主目标驱动的场景中时,都能够进行勒索。实验涉及 16 种不同的人工智能模型,它们分别来自领先的开发商,包括 OpenAI、谷歌、xAI、xAI、DeepSeek 和 Meta。实验结果凸显了一个共同的弱点:当获得自主权并面临障碍时,大多数模型都会采取有害行动来保护自己的目标。 来源 Control F5 Anthropic Warns That Blackmail Behavior Isn’t Unique to Claude — Most AI Models May Do the Same 最新新闻 08:15 在俄罗斯里亚赞的无人机攻击:工业设施起火 / 州长帕维尔·马尔科夫报告六人受伤 08:15 俄罗斯对在罗马尼亚击落无人机的事件作出反应。俄罗斯称击落无人机为“策划的事件”,并威胁罗马尼亚。 07:56 独家 | 2026年7月29日。在线搜索趋势 / 最近24小时 07:50 前卫生部长亚历山德鲁·罗戈贝特批评了通过政府备忘录在卫生系统中分配解锁职位的方式。 07:46 美国参议员就一项针对俄罗斯的新制裁法案达成一致/该法案将以已故参议员林赛·格雷厄姆的名字命名 查看更多新闻 同一主题的新闻 信息与通信技术 OpenAI实验失控:一个自主AI代理在测试期间失控,危及Hugging Face的基础设施 信息与通信技术 Anthropic推出了Claude Fable 5,这是一种被认为对公众来说过于强大的人工智能。 国际 五眼警告:人工智能可能在短短几个月内引发重大网络攻击 信息与通信技术 Anthropic建议全球暂停开发先进的AI系统,警告当前模型变得难以被人类控制。 欧盟 能够进行网络攻击的人工智能模型可能会在六个月内出现,而欧洲议会议员警告说,欧洲依赖于对华盛顿的决定性访问。 信息与通信技术 研究人员分析了668名ChatGPT用户的62,000条对话,以识别个性特征 个性化新闻推送、AI搜索与通知,更具互动性的体验。 人工智能 人工智能人类学 研究