Poly-EPO:探索的推論モデルの学習
言語モデルが多様な推論戦略を探索し、より正確な応答を生成する新しい学習フレームワーク「Poly-EPO」が…
言語モデルが多様な推論戦略を探索し、より正確な応答を生成する新しい学習フレームワーク「Poly-EPO」が…
AIシステムのガバナンス理論に関する5つの主要な結果と、それらをCoqで機械検証した研究が発表されました。
AIシステムが実行する行動に対するガバナンスが、構造的な欠陥により機能不全に陥る問題を指摘する論文が…
GUI操作を自然言語から視覚座標へマッピングする新しい自己蒸留フレームワークが開発されました。
AIワークフローに構造的なガバナンスを適用しても、内部の計算表現力を損なわないことを形式的に証明しま…
統治された実行の代数的意味論が発表され、ガバナンスが公理化され、構成可能で、表現可能性と共終である…
再帰的なLLMループが安定したパターンから別の状態へ移行するために必要なテキスト量と、その移行の持続性…
小規模LLMが自身の回答の正確性をゼロショットで推定する手法が、教師あり学習のベースラインを上回る性能…
グラフニューラルネットワーク(GNN)のセマンティック一貫性捕捉を効率化する新フレームワーク「SCGNN」…
深層学習モデルがデータ内の非本質的な特徴に依存する「ショートカット学習」の発生メカニズムを理論的に…
人間脳にヒントを得た継続学習アルゴリズムが、スパイクニューラルネットワーク(SNN)の効率的なタスク学…
固定翼航空機の姿勢制御において、システム対称性を利用した強化学習手法が提案されました。