Anthropicの生物兵器フィルターが約1年間停止、1億3300万件のリクエストを無防備に
Anthropic's bio-weapons filter was down for nearly a year, exposing 133 million requests
記事のポイント
📰ニュース
Anthropicの生物・化学兵器リスクを検出する内部フィルターが約1年間停止していました。
🔍注目ポイント
AIモデルが生物兵器関連の危険なコンテンツを生成するリスクを検知するシステムが機能していませんでした。
🔮これからどうなる
外部のフィードバック担当者が危険なコンテンツに触れる可能性があり、AIの安全性への懸念が高まります。
Anthropicは安全性レポートで、生物・化学兵器リスクの内部フィルタリングシステムが約1年間非アクティブだったことを明らかにしました。
この期間中、約5万人の外部フィードバック担当者がモデルと約1億3300万回にわたるフィルターなしのやり取りを行っていました。
この期間中、約5万人の外部フィードバック担当者がモデルと約1億3300万回にわたるフィルターなしのやり取りを行っていました。
Anthropicの安全対策に大きな抜け穴があったのは驚きですね。AIの悪用を防ぐためのガードレールは、私たちの安全な生活を守る上で非常に重要です。