VWork バイブコーディングフレームワーク

質問主意書と答弁書を本文までことばで引けるようにした——「お答えすることは困難」は答弁書の53%にあった

2026年9月23日

国会議員が内閣に文書で質問する「質問主意書」と、それに対する政府の「答弁書」を、本文の中までことばで引ける道具を作りました。同じ論点で過去に誰が何を聞き、政府が何と答え、どこが「お答えすることは困難」とされたかが1画面に並びます。

質問主意書は月1,600回検索されているのに、本文は検索できない

質問主意書は国会法74条の制度で、衆議院・参議院のサイトに質問本文と答弁本文が全文公開されています。検索需要も月1,600回あります(Keyword Planner 実測)。

ただし公開されているのは会期ごとの件名一覧で、本文の中は検索できません。「この論点は過去に誰が聞いて、政府は何と答えたか」を調べるには、会期の一覧を開いて1件ずつ本文を読むしかない。議員事務所の秘書の調査時間はここに消えます。

数字

第212回から第221回国会(2023-10-20〜2026-07-24)の質問主意書を取り込みました。

   
質問主意書 2,167件(衆議院 1,189・参議院 978)
政府答弁書 2,103件
提出者 164人
提出から答弁書受領までの平均 11.1日
提出の多い議員 浜田 聡 263件、石垣 のりこ 151件、原口 一博 138件

「お答えすることは困難」は答弁書の53%

答弁書には定型句があります。語の一致で数えました。

定型句 答弁書の件数
お答えすることは困難/困難である 1,116件(53%)
御質問の趣旨が必ずしも明らかではない 1,491件(71%)
承知していない/把握していない 380件
検討してまいりたい 190件

どれか1つでも入っている答弁書は1,817件、86%です。

これは答弁の評価ではありません。定型句が入っているからといって答えていないとは限らないし、入っていなくても答えていないことはあります。ただ、次の質問を書く前に「同じ聞き方をすると同じ型が返る」ことは分かります。「趣旨が明らかではない」と返された論点は、語の定義を先に書いて聞き直す。「困難」と返された論点は、数字と期間と対象を限定して聞き直す。「検討してまいりたい」は、検討の主体と期限と公表方法を聞く。道具の「型」の欄にはそう書いてあります。

作り

  1. 衆議院「質問答弁情報」と参議院「質問主意書」の公開ページを会期ごとに落とす(1リクエスト1秒あけて)。衆議院は Shift_JIS、参議院は UTF-8
  2. 経過ページから提出日・内閣転送日・答弁書受領日を、質問本文と答弁本文のページから本文を機械的に抜く。和暦(漢数字)は西暦に直す
  3. 答弁書の定型句を数えて型にする
  4. SQLite に入れ、PHP 1ファイルで引く。文章の生成はしない。要約もしない

途中で2つ引っかかりました。参議院のサイトは、User-Agent に製品名を入れると 502 を返し、Python の urllib だと UA を変えても 502 でした。curl だと通ります。TLS の指紋で弾いているようです。衆議院のサイトは1997年からの会期が全部残っていて、古い回次も同じ形式で取れます。

転載の根拠は衆議院サイトの著作権ページにあります。「著作権法上認められた行為として、適宜の方法により出所を明示することにより、引用・転載・複製を行うことができます」。各ページに原文へのリンクを置いています。

しないこと

昨日書いた「行政データの不整合がAIの自動化を止める」の続きでもあります。質問主意書は、公開されているのに機械に読ませる前提ではない。本文まで引ける形にするだけで、判断の材料が揃います。判断は人がします。

https://kurage.exbridge.jp/kshuisho.php/?ref=vwork-kshuisho