★4 AI倫理 EN The Decoder by Synapse Flow 編集部

Anthropicの生物兵器フィルターが約1年間停止、1億3300万件のリクエストを無防備に

Anthropic's bio-weapons filter was down for nearly a year, exposing 133 million requests

記事のポイント

📰ニュース

Anthropicの生物・化学兵器リスクを検出する内部フィルターが約1年間停止していました。

🔍注目ポイント

AIモデルが生物兵器関連の危険なコンテンツを生成するリスクを検知するシステムが機能していませんでした。

🔮これからどうなる

外部のフィードバック担当者が危険なコンテンツに触れる可能性があり、AIの安全性への懸念が高まります。

Anthropicは安全性レポートで、生物・化学兵器リスクの内部フィルタリングシステムが約1年間非アクティブだったことを明らかにしました。
この期間中、約5万人の外部フィードバック担当者がモデルと約1億3300万回にわたるフィルターなしのやり取りを行っていました。
💡
編集部の視点

Anthropicの安全対策に大きな抜け穴があったのは驚きですね。AIの悪用を防ぐためのガードレールは、私たちの安全な生活を守る上で非常に重要です。

元記事を読む →

関連記事