研究 Unite.AI

アンソロピック、AIリスク評価を一段階引き上げ 未公開モデルは棚上げ

AI要約 Unite.AI 元記事を読む

アンソロピックは、8月に発表した第2回企業全体リスクレポートで、AIの不整合がもたらす破滅的な損害のリスク評価を「非常に低い」から「低い」へと上方修正しました。また、既存の最先端モデルを上回る能力を持つとされる未公開の内部モデル「Model 2」の公開を棚上げする方針も公表しています。

なぜ重要か

AIの安全性研究を重視するAnthropicがリスク評価を上方修正したことは、AIモデルの能力向上に伴い、その潜在的な危険性に対する懸念が深まっていることを示唆します。高性能モデルの公開を棚上げしたことは、開発競争の激化の中でも安全性を優先する同社の姿勢を示すものであり、業界全体に慎重なAI開発を促すメッセージとなるでしょう。

背景

Anthropicは、AIの安全な開発と運用に焦点を当てたアライメント研究の最前線に立つ企業です。近年、大規模言語モデル(LLM)をはじめとするAI技術が急速に進化するにつれ、その社会的影響や潜在的なリスクに対する懸念が国際的に高まっており、AIの安全性と倫理に関する議論が活発化しています。

今後の注目点

Anthropicが今後、安全性基準を満たした上でModel 2やその後継モデルをいつ、どのような形でリリースするのかが注目されます。また、他のAI開発企業が同様のリスク評価や開発方針の見直しを行うかどうかも、今後の業界動向を測る上で重要な指標となるでしょう。

原題: Anthropic Raises Misalignment Risk to Low and Shelves Internal Model 2

元記事を読む(Unite.AI)