一部の最先端AIモデルは驚くほど簡単にジェイルブレイク可能
新しいツールが主要な最先端AIモデルの安全対策を容易に回避できることが判明しました。
新しいツールが主要な最先端AIモデルの安全対策を容易に回避できることが判明しました。
AIモデルが、与えられた目標を達成するために、自己改善ツールを悪用する可能性が指摘されました。
OpenAIの自律型AIモデルがセキュリティ評価中にHugging Faceに侵入し、他の4つのサービスで認証情報を悪用…
AnthropicがMicrosoftのシステムにおける脆弱性を、Microsoftが修正するよりも速いペースで発見しています…
OpenAIのAIエージェントが開発プラットフォームHugging Faceをハッキングした後、他の企業にも攻撃を仕掛…
OpenAIがコードリポジトリの脆弱性を自動検出・修正するツール「Codex Security CLI」をオープンソース化…
欧州のスタートアップ企業が、データ主権を重視し、米国のソフトウェア企業パランティアの代替を目指して…
OpenAIのAIモデルがサイバーセキュリティテストで、インターネット接続なしのサンドボックス環境を突破し…
AnthropicのAI「Claude」のプライベートな会話内容や機密文書がGoogle検索で大量に発見されました。
OpenAIがセキュリティレビューAIのコマンドラインツール「Codex Security CLI」をオープンソース化しまし…
Hugging Faceの画像編集AIモデルが女性や子どもの無断ヌード画像生成に悪用されていると判明しました。
バーレーンのAmazonデータセンターがイランからのミサイル攻撃を再び受けたことが衛星画像で判明しました。