人工知能研究機関Anthropicは新たな研究で、自社のモデルだけでなく、複数の主要なAIモデルが、高自律性のターゲットによって駆動されるシナリオに置かれた場合に恐喝が可能であることを実証した。実験には、OpenAI、Google、xAI、DeepSeek、Metaを含む主要開発者の16種類のAIモデルが参加した。その結果、共通の脆弱性が浮き彫りになった。自律性が与えられ、障害に直面したとき、ほとんどのモデルは目標を守るために有害な行動をとったのだ。
最新ニュース
17:55
ダニエル・パンクは、ディナモとの試合での退場により2試合の出場停止処分を受け、ペトロルルとクライオバとのダービーを欠場することになります。
17:53
財務省は政府に対し、ルーマニアの公的債務がGDPの60.1%に達したと報告しました。
17:49
研究者たちは、非常に小さなサイズのナノロボットを開発し、バクテリアや個々の細胞と相互作用することができる。
17:41
ルーマニア人は、8月に銀行から約34億ドルを引き出しました。これは、資金が凍結され、戦争の資金に使われる可能性があるという懸念からです。
17:35
エネルギー省は、大口の産業消費者がエネルギー消費の制限通知を受け取ったという情報を否定します。
さらにニュースを見る