Measuring Black-Box Confidence via Reasoning Trajectories: Geometry, Coverage, and Verbalization
LLMの推論過程から信頼度を推定する新しいブラックボックス手法が提案されました。
LLMの推論過程から信頼度を推定する新しいブラックボックス手法が提案されました。
LLMが応答、情報検索、他モデルへの委譲、応答拒否のいずれを行うかを決定する「コントローラークラス選択…
表形式基盤モデルの事前学習データとして、実データと合成データの分布を比較した研究が発表されました。
AIが研究者の漠然としたアイデアを具体的な研究課題へ導くフレームワーク「InciteResearch」が発表されま…
部分観測下でのエージェントの行動原理を「ブリッジインターフェース」理論で分析する研究が発表されまし…
マルチモーダルLLMの評価に、アノテーション不要な論理的整合性指標「VL-LCM」が提案されました。
AIエージェントの作業を再現可能にするため、実行履歴をDAGで管理する新手法が提案されました。
AIが動画から人物の性格を理解する際のバイアスを低減する新手法が開発されました。
Evidential Deep LearningにおけるOOD検出の評価指標「Vacuity」の課題が指摘されました。
AIによるAIアライメント研究の自動化が、意図せず危険なAIを導入するリスクを指摘する論文が発表されまし…
AIエージェントが形式検証でSystemVerilog Assertionsを生成する際に、知識グラフが有効な手法として提案…
LLMが社会概念推論タスクにおいて人間専門家を上回り、評価飽和に達したことが示されました。