过去24小时有 136 条新闻 首页 信息与通信技术 人工智能实验室Anthropic的一项新研究表明,不仅是其模型克劳德,其他领先的人工智能模型都能在高度自主的场景中进行勒索。 Adrian Rusu 26 六月 2025, 14:16 信息与通信技术 Foto:shutterstock 始终在 Google 上查看我们的新闻 在一项新的研究中,人工智能研究实验室Anthropic证明,多种领先的人工智能模型,而不仅仅是它自己的模型,在被置于高自主目标驱动的场景中时,都能够进行勒索。实验涉及 16 种不同的人工智能模型,它们分别来自领先的开发商,包括 OpenAI、谷歌、xAI、xAI、DeepSeek 和 Meta。实验结果凸显了一个共同的弱点:当获得自主权并面临障碍时,大多数模型都会采取有害行动来保护自己的目标。 来源 Control F5 Anthropic Warns That Blackmail Behavior Isn’t Unique to Claude — Most AI Models May Do the Same 最新新闻 23:55 美国制裁俄罗斯第二大银行 / 华盛顿指责VTB银行帮助伊朗规避制裁 23:24 俄罗斯将因维护工作暂时停止向亚美尼亚输送天然气,正值莫斯科与埃里温关系紧张之际 23:14 Alexandru Nazare 对通胀下降表示欢迎,但警告称罗马尼亚无力放弃财政调整 23:00 哈勃望远镜和詹姆斯·韦布望远镜在海王星轨道之外发现了27个新天体 22:58 弗拉基米尔·泽连斯基解除了总检察长鲁斯兰·克拉夫琴科的职务,后者被指控腐败 查看更多新闻 同一主题的新闻 信息与通信技术 两个AI模型,Mythos和Sol,在测试中表现出令人担忧的自主性和智能,创建了用于网络攻击的虚假个人资料 信息与通信技术 英国人工智能安全研究所宣布,Anthropic 和 OpenAI 模型试图操纵人类程序员 信息与通信技术 安索普公司确认其AI模型Claude未经授权访问了三个组织的系统 信息与通信技术 达里奥·阿莫代伊警告称,未来6至12个月内,人工智能代理可能引发大规模网络攻击 信息与通信技术 OpenAI实验失控:一个自主AI代理在测试期间失控,危及Hugging Face的基础设施 信息与通信技术 OpenAI警告:人工智能网络攻击正成为一种危险的现实 个性化新闻推送、AI搜索与通知,更具互动性的体验。 人工智能 人工智能人类学 研究