0 / 4 節読了

何が起きたか

TOPPAN、NTTデータ、FPSCの3社が、デジタル庁の行政AI「源内」向けに約1,800万ページもの行政文書をAI-Ready化する事業を発表しました。このプロジェクトは、AIが行政文書を正確に理解し、活用できるようにするための基盤を構築するものです。単にデータを取り込むだけでなく、AIが効率的に学習・参照できる形に加工する作業が含まれます。これは、行政サービスのデジタル化を加速させる上で不可欠なステップだと私は見ています。

なぜ法令専門家が重要なのか

このプロジェクトで特筆すべきは、参加企業の一社であるFPSCが、エンジニアリングやデータ分析の専門ではなく、法令実務の専門家である点です。行政文書は、法律、規則、ガイドラインなど、専門的な知識と文脈理解が不可欠な情報で構成されています。AIがこれらの文書を正しく解釈し、適切な回答を生成するためには、単なるテキストデータとしてではなく、その法的意味合いや関連性を理解した上での構造化が求められます。FPSCの参画は、この複雑な法的文脈をAIに「教え込む」ための重要な役割を担っていると私は考えます。

行政AIの真の課題

私の経験上、AIの性能はモデルの賢さだけで決まるわけではありません。特に行政分野のような専門性が高く、情報量が膨大な領域では、AIに与えるデータの質と構造が決定的な要素となります。約1,800万ページという途方もない量の文書をAI-Ready化する作業は、単なるOCRやデータ変換ではありません。どの情報を抽出し、どのように関連付け、どのような形式でAIに提示するか。この「データ設計」こそが、行政AIの成否を分ける真の勝負どころです。モデルがどれだけ高性能でも、入力データが不適切であれば、期待する結果は得られません。

私の見方

この発表は、行政AIの導入において、技術的な側面だけでなく、ドメイン知識の重要性を再認識させるものです。私はこれまでも、AIプロジェクトの成功は「何をAIに学習させるか」「どのようにデータを準備するか」にかかると断言してきました。今回の事例は、まさにその私の見方を裏付けるものです。行政AIが市民サービス向上に貢献するためには、まず人間が高度な専門知識をもってデータを整理し、AIがそれを活用できる形にすることが不可欠です。この地道な作業こそが、AI活用の最速ルートだと私は考えます。

学習コースAI活用アカデミー

コース一覧を見る →
柴亮太
柴亮太の視点

約1,800万ページのAI-Ready化は、モデルの賢さより「何を食わせるか」が重要だと改めて示しています。行政AIの勝負は、データ設計と専門知識の融合です。私はこの泥臭い作業こそが、AI活用の最速ルートだと断言します。