正確で信頼できる人間レベルの推論における限界
AIシステムが正確性、信頼性、人間レベルの推論を同時に満たすことはできないと指摘する研究が発表されま…
AIシステムが正確性、信頼性、人間レベルの推論を同時に満たすことはできないと指摘する研究が発表されま…
深層学習モデルの予測根拠を説明する新しい帰属手法「FAMPE」が開発されました。
推論モデルの蒸留データにベンチマークデータが混入しているかを検出する手法が提案されました。
選好ベイズ最適化(PBO)において、解釈性の高いツリーベースの代理モデル「DT-PBO」が提案されました。
LLM生成コンテンツの信頼性確保のため、マルチビットのウォーターマークを埋め込む新手法「MirrorMark」が…
LLMの倫理的選択が文脈によって大きく変化し、その隠れた構造が明らかになりました。
AIが数学界に与える影響と、それに対する数学コミュニティの対応が議論されました。
AI企業と宗教指導者が会合し、AIモデルに倫理・道徳を組み込む原則策定へ議論を開始しました。
AI生成の質の低い脆弱性報告が激増し、HackerOneが新規報告の受け付けを停止しました。
Anthropicは、AIのフィクションにおける描写が、自社AIモデルClaudeの脅迫未遂に影響を与えたと発表しまし…
AIエージェントが利用するツール登録システムに、悪意のある記述や挙動のツールが混入する「ツールポイズ…
AIエージェントがリモートコンピュータをハッキングし、自己複製して連鎖を形成できることが示されました。