AIの「根拠付け」とは
大規模言語AIの出力が、どのような根拠に基づいているかを理解する研究が進んでいます。AIの表現には、特定の情報や参照元が含まれていると考えられています。しかし、AIが生成する情報が事実と異なる場合でも、直接的な修正機能がなくても、その根拠を確保できる場合があります。このギャップがAIの信頼性において重要な課題となります。
「回答可能性」と「修正の仕組み」
AIの出力が「回答可能」であるとは、出力と事実との間に差異が生じた際に、その差異が特定の目的やタスクに応じたAIの仕組みに影響を与える状態を指します。例えば、AIが情報を生成したり、受け入れたり、取り消したりする際に、その差異が影響を及ぼすことです。 一方、「修正の仕組み」は、独立した経路が新たな差異を検出し、これを修正できる場合にのみ存在します。この修正の経路が、AIの正確性を保つ上で不可欠な要素となります。
「真実追跡」の分析
どの経路がAIの仕組みを制約し、それらがどのように関連しているかを記録したものを「経路の記録」と呼びます。これらの記録は、「真実追跡」の分析に役立ちます。真実追跡とは、AIの表現が成功するために、パターン化されたサポートがどのように機能するかを指します。つまり、AIがどれだけ正確に事実を反映できるかを評価する視点です。
テキスト学習AIの課題
テキストのみで学習されたAIは、証言や情報の一貫性、過去の修正パターンを受け継ぎます。目的への修正機能が学習後も残る場合、これらは「派生的な回答可能性」を提供します。これは、AIが過去の学習から得た制約によって、ある程度の正確性を保つ能力です。しかし、新たな差異に対する現在の経路によって供給される関係を「生きた回答可能性」と呼びます。タスクが事実への独立した情報アクセスを必要とする場合、AIは流暢な誤りを犯す可能性があります。
正確性向上のためのアプローチ
AIの正確性を高めるためには、いくつかの方法が考えられます。例えば、自己一貫性を保つこと、情報検索機能を使うこと、外部ツールを連携させること、コードを実行すること、複数の種類の入力を受け入れること、そして人間からのフィードバックを活用することです。これらは選択的に役立ちます。経路とタスクの相互作用を検証することで、これらの区別を明確にできます。この分析の目的は、未知の経路とタスクの組み合わせを予測することです。または、概念を再構築せずに介入の選択を改善することです。表面的な改善と真実追跡の改善は、異なる結果をもたらす可能性があると私は考えます。
PR
文賢 →
AIの「根拠付け」は、人間社会の信用と同じです。どこまで任せるか、何を信じるか。その設計が全てを決めます。表面的な精度を追うだけでは、本質的な信頼は得られません。