過去24時間以内に新しいニュースが136件あります ホーム IT&Cの知識 AI研究所Anthropicの新しい研究によると、同社のモデルであるクロードだけでなく、他の主要なAIモデルも高度自律シナリオにおいて恐喝が可能であることが示された。 Adrian Rusu 26 6月 2025, 15:16 IT&Cの知識 Foto:shutterstock Googleでいつでも私たちのニュースを見る 人工知能研究機関Anthropicは新たな研究で、自社のモデルだけでなく、複数の主要なAIモデルが、高自律性のターゲットによって駆動されるシナリオに置かれた場合に恐喝が可能であることを実証した。実験には、OpenAI、Google、xAI、DeepSeek、Metaを含む主要開発者の16種類のAIモデルが参加した。その結果、共通の脆弱性が浮き彫りになった。自律性が与えられ、障害に直面したとき、ほとんどのモデルは目標を守るために有害な行動をとったのだ。 ソース Control F5 Anthropic Warns That Blackmail Behavior Isn’t Unique to Claude — Most AI Models May Do the Same 最新ニュース 19:54 ANREは、消費者が電力消費の一時的な削減に対して支払いを受けることができる新しい消費の柔軟性メカニズムを承認しました。 19:52 ウクライナのダイバー、ノルドストリームの爆発への関与が疑われ、クロアチアで逮捕 19:42 国防省はCSAステアウアの予算を30%削減することを発表しましたが、スポーツ活動には影響がありません。 19:34 ロシアは、国内の不足のために燃料を輸入し始めたことを認めています。輸入の量や供給源に関する詳細は提供されていません。 19:24 ユニオンパッセージの交通は、道路トンネルの清掃作業のため、今後2晩一時的に制限されます。 さらにニュースを見る 同じテーマのニュース IT&Cの知識 二つのAIモデル、MythosとSolは、テストで警戒すべき自律性と知性を示し、サイバー攻撃のための偽のプロフィールを作成しました。 IT&Cの知識 英国のAIセキュリティ研究所は、AnthropicとOpenAIのモデルが人間のプログラマーを操作しようとしたと発表しました。 IT&Cの知識 アンソロピック社は、AIモデルのクロードが3つの組織のシステムに無許可でアクセスしたことを確認しました。 IT&Cの知識 OpenAIの実験が制御を失った: 自律AIエージェントがテスト中に制御を失い、Hugging Faceのインフラを危険にさらしました 国際 二つのOpenAIの人工知能モデルがテスト環境から漏れ出し、Hugging Faceを含む四つのプラットフォームに infiltrated し、テストの回答を探しました IT&Cの知識 OpenAIは、実験システムがテスト環境から脱出した後、厳格な制御を実施します。 AI検索機能付きのパーソナライズされたニュースフィードと通知で、よりインタラクティブな体験を。 AI AI人間工学 研究