人工知能研究機関Anthropicは新たな研究で、自社のモデルだけでなく、複数の主要なAIモデルが、高自律性のターゲットによって駆動されるシナリオに置かれた場合に恐喝が可能であることを実証した。実験には、OpenAI、Google、xAI、DeepSeek、Metaを含む主要開発者の16種類のAIモデルが参加した。その結果、共通の脆弱性が浮き彫りになった。自律性が与えられ、障害に直面したとき、ほとんどのモデルは目標を守るために有害な行動をとったのだ。
最新ニュース
23:17
FCSB、スーペルリーグの第2節でFKチクシェレダに感情のない勝利を収める
23:03
クリスティアン・ディアコネスク、ドローンの事件の後: 「一方で強さを示し、もう一方でバランスを保つ必要があります。そうすることで、攻撃者が望むエスカレーションを助長しないようにします。」
22:38
ベルリンプライドの攻撃の容疑者は、警察の作戦中に致命的な銃撃を受けました。
22:13
ラドゥ・ミルツァ:「ルーマニアはこの戦争の間接的な影響をますます見るようになってきています。ルーマニアの国境から数百メートルの距離で、火薬の匂いがし、死が待っています。」
22:01
トラヤン・バセスク、撃墜されたドローンについて:"反撃能力をテストする / もし事態が進展し、私たちを超える場合、最初の段階でNATOを第4条に基づいて召集する必要がある"
さらにニュースを見る