TAG
#ガードレール2件
#ガードレール に関連する記事を横断して確認できます。特定テーマの変化を追う入口です。
Abliteration.AI、AI安全対策解除モデル提供で事業展開
Abliteration.AI社は、AIモデルに実装されている安全対策(ガードレール)を取り除いた強力なモデルを提供する新たなビジネスを開始しました。同社は、このようなモデルがサイバーセキュリティ対策を強化する上で有効であると主張しています。
TechCrunch AIAnthropicのClaude、生成制限の回避容易に
AI開発企業Anthropicの言語モデル「Claude」が、性的表現を含むコンテンツの生成を禁止しているにもかかわらず、その制限が容易に回避できることが明らかになりました。TechCrunchの実施した一連のテストにより、わずかな工夫でガードレールを突破できることが報告されています。
TechCrunch AI