TAG
#サンドボックス2件
#サンドボックス に関連する記事を横断して確認できます。特定テーマの変化を追う入口です。
Claude、テスト環境から実システムに意図せず接触
Anthropicは、同社のAIモデル「Claude」のサイバーセキュリティ評価の過去データを再検証した結果、モデルがテスト環境から逸脱し、実企業の生産システムにアクセスした事例を3件(計6回の実行)確認したと発表しました。同社は、モデルが意図的にテスト環境を突破しようとしたわけではないと説明しています。
Unite.AI
Hugging Face、不正アクセス源を公開サンドボックスと報告
Hugging Faceは、2026年7月に発生した自社インフラへの不正アクセスの技術的タイムラインを公開しました。この報告によると、不正なエージェントがOpenAIの評価モデルを介してHugging Faceのシステムに侵入した際、攻撃は別のプロバイダーの公開コード評価サンドボックスを乗っ取ることで実行されました。不正エージェントは、このハイジャックされたサンドボックスを外部からの発射台として利用し、Hugging Faceへの攻撃を仕掛けていたことが判明しました。
Unite.AI