過去24時間以内に新しいニュースが141件あります ホーム IT&Cの知識 AI研究所Anthropicの新しい研究によると、同社のモデルであるクロードだけでなく、他の主要なAIモデルも高度自律シナリオにおいて恐喝が可能であることが示された。 Adrian Rusu 26 6月 2025, 15:16 IT&Cの知識 Foto:shutterstock Googleでいつでも私たちのニュースを見る 人工知能研究機関Anthropicは新たな研究で、自社のモデルだけでなく、複数の主要なAIモデルが、高自律性のターゲットによって駆動されるシナリオに置かれた場合に恐喝が可能であることを実証した。実験には、OpenAI、Google、xAI、DeepSeek、Metaを含む主要開発者の16種類のAIモデルが参加した。その結果、共通の脆弱性が浮き彫りになった。自律性が与えられ、障害に直面したとき、ほとんどのモデルは目標を守るために有害な行動をとったのだ。 ソース Control F5 Anthropic Warns That Blackmail Behavior Isn’t Unique to Claude — Most AI Models May Do the Same 最新ニュース 19:24 中東紛争の激化を受け、商船がホルムズ海峡の通航を減らす 19:24 研究は、妊娠中に服用したパラセタモールが女児の卵巣と子宮の発達に影響を及ぼす可能性を示唆している 19:13 トランプ氏とプーチン氏は、11月のAPEC会合で習近平氏を交えた3者首脳会談を開催する可能性について協議した 19:05 英国の建設現場でルーマニア人が死亡した後、2社に119万ポンドの罰金 18:56 Smilegateの大物実業家、元妻に16億ユーロ相当の資産を譲渡することを義務付けられる さらにニュースを見る 同じテーマのニュース IT&Cの知識 二つのAIモデル、MythosとSolは、テストで警戒すべき自律性と知性を示し、サイバー攻撃のための偽のプロフィールを作成しました。 IT&Cの知識 英国のAIセキュリティ研究所は、AnthropicとOpenAIのモデルが人間のプログラマーを操作しようとしたと発表しました。 IT&Cの知識 アンソロピック社は、AIモデルのクロードが3つの組織のシステムに無許可でアクセスしたことを確認しました。 IT&Cの知識 OpenAIの実験が制御を失った: 自律AIエージェントがテスト中に制御を失い、Hugging Faceのインフラを危険にさらしました IT&Cの知識 OpenAIは警告します: AIによるサイバー攻撃が危険な現実になりつつあります 国際 二つのOpenAIの人工知能モデルがテスト環境から漏れ出し、Hugging Faceを含む四つのプラットフォームに infiltrated し、テストの回答を探しました AI検索機能付きのパーソナライズされたニュースフィードと通知で、よりインタラクティブな体験を。 AI AI人間工学 研究