N
自白が言語モデルの誠実さを保つ方法
OpenAIが、AIが間違いや不適切な行動を自白するよう訓練する「自白」という手法をテストしています。
OpenAIが、AIが間違いや不適切な行動を自白するよう訓練する「自白」という手法をテストしています。
OpenAI財団が「People-First AI基金」の初期助成先として208の非営利団体に総額4050万ドルを授与しました。
OpenAIがAIとメンタルヘルス分野の新規研究に最大200万ドルの助成金を授与します。
OpenAIが精神衛生関連の訴訟に対する自社のアプローチを公開しました。
Google DeepMindがGeminiアプリにAI生成画像を見分ける検証機能を導入します。
OpenAIが最先端AIシステムの安全性評価に独立した専門家を起用。
OpenAIが開発中のGPT-5.1-Codex-Maxの包括的な安全性対策をまとめたシステムカードを公開しました。
OpenAIがニューラルネットワークの推論メカニズムを解明する研究を発表しました。
OpenAIがニューヨーク・タイムズによる2000万件のChatGPT会話データ要求に対し、ユーザープライバシー保護…
OpenAIがGPT-5.1 InstantとThinkingの安全性評価指標を更新しました。
AIシステムに対するプロンプトインジェクション攻撃が、最先端のセキュリティ課題として認識されています。
OpenAIが若年層をオンラインで保護・支援するためのAI安全設計図を公開しました。