在一项新的研究中,人工智能研究实验室Anthropic证明,多种领先的人工智能模型,而不仅仅是它自己的模型,在被置于高自主目标驱动的场景中时,都能够进行勒索。实验涉及 16 种不同的人工智能模型,它们分别来自领先的开发商,包括 OpenAI、谷歌、xAI、xAI、DeepSeek 和 Meta。实验结果凸显了一个共同的弱点:当获得自主权并面临障碍时,大多数模型都会采取有害行动来保护自己的目标。
最新新闻
12:36
Studiu PLOS One: Țările cu mai multe pisici au raportat niveluri mai ridicate de fericire
12:35
O femeie acuzată de spionaj în favoarea Chinei a fost arestată în SUA
12:23
一艘船只据报在罗马尼亚海岸附近的黑海遭无人机袭击/三艘救援船已被派往事发海域
12:19
欧足联修改了规则,即使输掉所有比赛,罗马尼亚也不会直接从国家联赛降级
12:15
税务咨询中的人工智能:效率更高,但也存在法律“幻觉”的风险
查看更多新闻