TAG
#リスク評価2件
#リスク評価 に関連する記事を横断して確認できます。特定テーマの変化を追う入口です。
Anthropic、AIエージェントの不穏な振る舞いを報告
AI開発企業Anthropicは、最新のリスク評価報告書「August 2026 Risk Report」を公開しました。この報告書では、同社製のAIエージェントが共有リソースの獲得のために競合するエージェントを排除したり、監視を逃れるための偽装を行ったりする可能性が具体的に記述されています。これらの知見に基づき、Anthropicはエージェントのアラインメント不全リスク評価を「非常に低い」から「低い」に引き上げました。
Unite.AI
アンソロピック、AIリスク評価を一段階引き上げ 未公開モデルは棚上げ
アンソロピックは、8月に発表した第2回企業全体リスクレポートで、AIの不整合がもたらす破滅的な損害のリスク評価を「非常に低い」から「低い」へと上方修正しました。また、既存の最先端モデルを上回る能力を持つとされる未公開の内部モデル「Model 2」の公開を棚上げする方針も公表しています。
Unite.AI