search icon
search icon
Flag Arrow Down
Română
Română
Magyar
Magyar
English
English
Français
Français
Deutsch
Deutsch
Italiano
Italiano
Español
Español
Русский
Русский
日本語
日本語
中国人
中国人

更改语言

arrow down
  • Română
    Română
  • Magyar
    Magyar
  • English
    English
  • Français
    Français
  • Deutsch
    Deutsch
  • Italiano
    Italiano
  • Español
    Español
  • Русский
    Русский
  • 日本語
    日本語
  • 中国人
    中国人
栏目
  • 最新消息
  • 独家
  • INSCOP 调查
  • 播客
  • 欧盟
  • 侨民
  • 摩尔多瓦共和国
  • 政治
  • 经济
  • 时事
  • 国际
  • 运动
  • 健康
  • 教育
  • 信息与通信技术
  • 艺术与生活方式
  • 意见
  • 2025年选举
  • 环境
关于我们
联系我们
隐私政策
条款和条件
快速浏览新闻摘要并查看不同出版物如何报道它们!
  • 最新消息
  • 独家
    • INSCOP 调查
    • 播客
    • 欧盟
    • 侨民
    • 摩尔多瓦共和国
    • 政治
    • 经济
    • 时事
    • 国际
    • 运动
    • 健康
    • 教育
    • 信息与通信技术
    • 艺术与生活方式
    • 意见
    • 2025年选举
    • 环境
过去24小时有 96 条新闻
  1. 首页
  2. 信息与通信技术

人工智能实验室Anthropic的一项新研究表明,不仅是其模型克劳德,其他领先的人工智能模型都能在高度自主的场景中进行勒索。

Adrian Rusu
whatsapp
facebook
linkedin
x
copy-link copy-link
26 六月 2025, 14:16
main event image
信息与通信技术
Foto:shutterstock
google-preference

始终在 Google 上查看我们的新闻

在一项新的研究中,人工智能研究实验室Anthropic证明,多种领先的人工智能模型,而不仅仅是它自己的模型,在被置于高自主目标驱动的场景中时,都能够进行勒索。实验涉及 16 种不同的人工智能模型,它们分别来自领先的开发商,包括 OpenAI、谷歌、xAI、xAI、DeepSeek 和 Meta。实验结果凸显了一个共同的弱点:当获得自主权并面临障碍时,大多数模型都会采取有害行动来保护自己的目标。

来源

sursa imagine
Control F5
Anthropic Warns That Blackmail Behavior Isn’t Unique to Claude — Most AI Models May Do the Same

最新新闻

12:36

Studiu PLOS One: Țările cu mai multe pisici au raportat niveluri mai ridicate de fericire

12:35

O femeie acuzată de spionaj în favoarea Chinei a fost arestată în SUA

12:23

一艘船只据报在罗马尼亚海岸附近的黑海遭无人机袭击/三艘救援船已被派往事发海域

12:19

欧足联修改了规则,即使输掉所有比赛,罗马尼亚也不会直接从国家联赛降级

12:15

税务咨询中的人工智能:效率更高,但也存在法律“幻觉”的风险

查看更多新闻

同一主题的新闻

event image
信息与通信技术
OpenAI披露令人担忧的事件:人工智能模型曾试图作弊,并隐藏捏造的信息
event image
信息与通信技术
两个AI模型,Mythos和Sol,在测试中表现出令人担忧的自主性和智能,创建了用于网络攻击的虚假个人资料
event image
信息与通信技术
英国人工智能安全研究所宣布,Anthropic 和 OpenAI 模型试图操纵人类程序员
event image
信息与通信技术
安索普公司确认其AI模型Claude未经授权访问了三个组织的系统
event image
信息与通信技术
达里奥·阿莫代伊警告称,未来6至12个月内,人工智能代理可能引发大规模网络攻击
event image
信息与通信技术
OpenAI实验失控:一个自主AI代理在测试期间失控,危及Hugging Face的基础设施
app preview
个性化新闻推送、AI搜索与通知,更具互动性的体验。
app preview app preview
人工智能 人工智能人类学 研究

编辑推荐

main event image
政治
5小时前

Nicuşor Dan 再次召集各政党进行磋商,以提名总理。总统预计将在今天宣布自政治危机爆发以来的第四个人选

来源
imagine sursa
imagine sursa
imagine sursa
imagine sursa
imagine sursa
+5
main event image
时事
14分钟前

一艘船只据报在罗马尼亚海岸附近的黑海遭无人机袭击/三艘救援船已被派往事发海域

来源
imagine sursa
imagine sursa
imagine sursa
imagine sursa
imagine sursa
+2
main event image
意见
4小时前
社论 & 观点

继标准普尔之后:罗马尼亚将走向何方?

main event image
独家
2小时前
独家内容

2026年10月5日。电视:昨晚新闻电视台讨论了什么

main event image
独家
57分钟前

独家:上周体育话题排行 / 克里斯蒂亚诺·罗纳尔多在葡萄牙国家队的危机,成为最受热议的话题之一

app preview
个性化新闻推送、AI搜索与通知,更具互动性的体验。
app preview
app store badge google play badge
  • 最新消息
  • 独家
  • INSCOP 调查
  • 播客
  • 欧盟
  • 侨民
  • 摩尔多瓦共和国
  • 政治
  • 经济
  • 时事
  • 国际
  • 运动
  • 健康
  • 教育
  • 信息与通信技术
  • 艺术与生活方式
  • 意见
  • 2025年选举
  • 环境
  • 关于我们
  • 联系我们
隐私政策
Cookie 政策
条款和条件
开源许可证
版权所有 Strategic Media Team SRL

合作伙伴技术

anpc-sal anpc-sol