「間違えない政府」という幻想──学習を万能解にしない制度設計論

シリーズ: 行雲流水
新しい技術に対して、政府はどれくらい速くルールを作るべきなのか。AI、暗号資産、自動運転、バイオテクノロジーのような領域では、この問いが繰り返し立ち上がる。対応が遅ければ、技術と市場が先に動き、法制度は後から実態を追認するだけになる。逆に、十分な情報が揃わないうちに急いでルールを固めれば、実態に合わない規制を作り、予期しない被害を生む可能性がある。
この問題は、しばしば「イノベーションを阻害しない迅速な規制」と「安全性や権利を重視する慎重な規制」の二者択一として語られる。シンガポールは速い、ヨーロッパは慎重だ、という国別の比較も繰り返し持ち出される。
しかし、この対立の立て方自体を疑うところから始めた方がよい。速さと慎重さのどちらを選ぶかという問いは、実のところもっと古く、もっと深い緊張の上に、技術変化という新しい制約が重なって生じたものにすぎない。本稿では、政治学者ジェームズ・フィシュキンが示した民主主義の構造的な緊張から出発し、規制のサンドボックス、熟議型のミニ・パブリック、そして「学習する政府」という像まで、順を追って考えていく。
速さでも慎重さでもなく
「速い規制」対「慎重な規制」という図式が測ろうとしている「速さ」には、複数の異なる能力が混在している。新しい問題を認識する速さ、暫定的な対応を取る速さ、実証実験を始める速さ、正式な立法に至る速さ、問題が判明してから修正する速さ、そして必要なら制度を撤回する速さである。ある国がこの一つに秀でていても、別の一つでは著しく劣ることがある。国別のランキングは、こうした複数の速さのどれか一つを切り取って、全体の評価であるかのように提示している場合が少なくない。
さらに、速ければ良い、遅ければ慎重だ、という単純な価値づけも成り立たない。急いで決めて後から大きな被害を生んだ事例もあれば、ただ止まっているだけの遅さもある。したがって評価の単位を「決定までの時間」から、変化を検知し、判断し、実行し、結果から学び、再び判断するという循環そのものの性能へ移す必要がある。これは言葉の言い換えではなく、測る対象そのものを変える作業である。
問題は、この循環の性能を測る基準がまだ明確でないことだ。速さだけを追いかければ危うい。誰の声が考慮されたか、どのような情報に基づいて判断したか、影響を受ける人々が意思決定に関与できたか、といった観点も欠かせない。この基準を探るために、まず技術変化とは無関係に存在してきた、もっと古い緊張へさかのぼる必要がある。
フィシュキンのトリレンマ──技術以前からあった緊張
フィシュキンが指摘したのは、民主主義が追求する三つの価値、政治的平等、大衆参加、熟議のあいだにある構造的な緊張である。政治的平等は、特定の階層や集団の声だけが重く扱われるのではなく、市民の意見が原則として等しく扱われることを指す。大衆参加は、少数の政治家や専門家だけでなく、できるだけ多くの市民が政治的意思形成に加わることである。熟議は、十分な情報に接し、異なる立場や理由を検討したうえで判断することを意味する。
この三つを同時に高い水準で実現するのは難しい。一人一票の選挙や住民投票は政治的平等と大衆参加を強く満たすが、そこで全員が十分な情報を得て熟議しているとは限らない。専門家による審議は熟議の質を高めるが、参加できる人数は限られ、政治的平等を損ないやすい。無作為抽出した市民による討議は、政治的平等と熟議を近似させる有効な方法だが、意図的に参加の規模を絞っている。どの制度形態を選んでも、何かを手放さざるを得ない。
この緊張は、新しい技術が登場するよりずっと前から民主主義に内在していた。したがって、冒頭で示した「速さか慎重さか」という対立は、実のところこの古い緊張の上に、技術変化という新しい制約が重なって生じたものにすぎない。次に検討すべきは、その新しい制約の正体である。
「第四の価値」ではなく、時間という外部制約
技術変化への応答性を、フィシュキンの三価値に加わる第四の価値として位置づける整理は、直感的ではあるが理論的な精度を欠く。政治的平等、参加、熟議は、いずれも民主的意思形成そのものの内側にある価値である。これに対して応答性は、外部環境がどれだけの速度で変化しており、それに制度がどれだけの時間で反応できるかという、性質の異なる概念である。
より正確に言えば、技術変化という外部制約が、もともと緊張関係にあった三価値の実現を、従来より短い時間の中で行うことを要求するようになった、と理解すべきだろう。この整理は些末な言い換えではない。応答性を独立した価値として扱うと「速ければ速いほど良い」という単純な最大化目標に転化しやすいが、時間制約として位置づけ直せば、問いは「限られた時間の中で、政治的平等・参加・熟議をどう配分するか」という、より具体的な設計問題になる。
この時間制約が軽視できない理由は、政治的決定の遅延そのものが中立ではないからだ。政府が議論を続けている間にも、技術やサービスは市場で展開され続ける。利用者が増え、企業が投資を行い、標準規格が固まっていく。ネットワーク効果や巨額投資、消費者行動の固定化によって、後の政策選択肢は狭まっていく。特に、新技術が現行法の下で事実上市場展開可能であり、政府が暫定的な境界設定すら行わない場合には、政治的決定の遅延そのものが、企業や市場による事実上のルール形成を許すことになる。
ただし、遅延が必ず企業支配に帰結するわけではない。暫定規制、既存法の適用、一時的なモラトリアムなど、政府には他の選択肢も残されている。応答性が民主的自己決定の条件になるのは、遅延に加えて、政府が最低限の境界すら示さずに放置したときである。
パレートフロンティアという評価軸
政治的平等、参加、熟議、そして応答性という時間制約のあいだに本当のトレードオフがあるなら、あらゆる価値を同時に最大化することはできない。しかし、ある制度がある価値の組み合わせを実現していること自体は、直ちに失敗を意味しない。重要なのは、その制度がパレートフロンティア (Pareto frontier)、すなわち「他の価値を犠牲にしなければ、どの価値も改善できない」境界線の上に位置しているかどうかである。
例えば、ある制度が応答性は高いが熟議が弱く、別の制度は熟議が厚いが応答性に乏しいとする。それぞれ異なる価値を選んでいるだけなら、比較にあまり意味はない。しかし、別の制度設計へ移ることで、応答性を落とさずに熟議を改善でき、しかも政治的平等も悪化しないのであれば、元の制度は単なる価値選択をしているのではなく、設計として非効率な位置に留まっていることになる。
この視点に立つと、政策論の焦点は「どこで妥協するか」から、「制度設計によってフロンティア自体をどこまで外側へ押し広げられるか」へ移る。「シンガポールは速さを重視する」「ヨーロッパは慎重さを重視する」という比較だけでは、それぞれ異なる価値を選んでいるとしか言えない。しかし制度の工夫によって複数の価値を同時に改善できる余地があるなら、問題は価値選択ではなく、設計の巧拙になる。
ここで注意すべき点が一つある。パレートフロンティアという概念は、価値判断そのものを不要にするものではない。フロンティア上に複数の制度が存在すれば、そのどこを選ぶかは依然として政治的な価値判断の対象である。ただし、フロンティアの内側に留まっている制度を、単に「我々は慎重さを選んでいるだけだ」と正当化することはできなくなる。次に見るのは、実際にこのフロンティアを外側へ押し出そうとしている、具体的な制度技術である。
サンドボックスとミニ・パブリック──二つの縮約装置
規制のサンドボックス (regulatory sandbox) は、対象者、地域、期間、取引額などを限定した管理環境のもとで、新しい製品やサービスを実際の利用者に試してもらう仕組みである。全面的に新技術を解禁すれば応答性は高いが被害が広がる可能性があり、安全性が完全に証明されるまで禁止すれば失敗は防げるが実環境でしか得られない情報を失う。サンドボックスは、行動の開始時点を早めながら、失敗した場合の被害範囲を限定することで、応答性と慎重さを同時に引き上げようとする。その本質は規制緩和そのものではなく、探索を可逆的にすることにある。
サンドボックスが主に生成するのは、「実際にこれを行うと何が起きるか」という経験的な知識である。ここには限界もある。参加企業は無作為抽出されたサンプルではなく、多くの場合は自発的に応募した企業であり、利用者も限定的である。規模を本番環境まで拡大したときに現れる競争行動やネットワーク効果、悪用のパターンは、限定環境では観察しにくい。サンドボックスでの成功は、全面展開の証明ではなく、経験的不確実性を減らす一段階に過ぎない。
これとは別の縮約装置が、討論型世論調査 (Deliberative Polling) に代表される熟議型のミニ・パブリック (mini-public) である。社会全体が同じだけ議論することは現実的に不可能なため、無作為抽出によって社会の縮図を作り、十分な情報と討議の場を与える。目指すのは、政治的平等を近似しながら熟議の質を高めることである。
サンドボックスとミニ・パブリックには、興味深い共通点がある。どちらも社会全体をいきなり対象にせず、限定された環境へ縮約することで、高密度な情報を生成してから全体の意思決定へ戻すという原理を持つ。ただし両者が生成する情報の性質は異なる。サンドボックスが答えるのは「実際に何が起きるか」という経験的な問いであるのに対し、ミニ・パブリックが答えようとするのは「十分な情報を得て異なる立場を検討した市民は、これをどう評価するか」という、熟慮された規範的判断である。前者は経験的知識、後者は熟慮された社会的選好であり、同一視してはならない。
ミニ・パブリックにも固有の限界がある。熟議に参加した数百人の判断を、参加していない数千万人の意思としてそのまま正当化する根拠は自動的には成立しない。議題設定、提示される資料、招かれる専門家の選定によって結論が誘導される余地も残る。こうした限界があるからこそ、多くの実践では熟議の結果を拘束力のある決定そのものではなく、提言や議題設定の材料として位置づけ、最終決定は代表制の政治過程に委ねている。
政治は学習だけでは処理できない
ここまでの議論は、サンドボックスで経験を集め、ミニ・パブリックで価値判断を照らせば、多くの問題が片づくかのような印象を与えるかもしれない。しかし、この印象そのものが見直しを要する。
政策上の対立には、少なくとも三つの異なる種類がある。第一は経験的不確実性であり、自動運転の事故率や新しい金融サービスの詐欺発生率のように、実験やデータ収集、専門的分析によって解消に近づけられる。第二は価値的不一致であり、事故率が一定水準なら自動運転を認めるべきか、利便性とプライバシーのどちらをどれだけ重視するかのように、データだけでは決められない。ここには熟議が必要になる。
第三は分配的対立である。配車サービスと既存のタクシー事業者、生成AI企業と著作権者、プラットフォーム企業と労働者のように、ある制度変更によって誰が利益を得て誰が負担を負うかという対立は、十分な経験的知識と十分な熟慮された選好があっても消えない。実証データが揃い、市民が十分に議論して納得したとしても、既存の事業者にとって自分の仕事や収入が奪われるという事実自体は変わらないからだ。
この三分類は、それまでの整理に対する重要な自己修正になる。サンドボックスとミニ・パブリックという二つの装置は、それぞれ経験的不確実性と価値的不一致には有効だが、分配的対立には原理的に対応できない。分配的対立が必要とするのは、さらなる学習ではなく、代表制の政治過程を通じた交渉、補償、移行措置といった別種の処理機構である。
「制度が学習できれば対立は解消する」という発想は、政策上の対立の多くを情報不足あるいは熟議不足として扱おうとする、過度に調和的な政治観に陥りやすい。実際には、十分な情報と十分な熟議を経てもなお、立場の違いそのものによって残り続ける対立がある。制度的学習を万能の処方箋として扱わないことは、本稿全体の中核をなす留保である。
誰が「何を学ぶべきか」を決めるのか
サンドボックスとミニ・パブリックは、一見すると価値中立な技術的装置に見える。しかし、誰を実験に参加させるか、何を成功の指標とするか、どの損害を許容範囲とみなすか、熟議の場にどの資料を渡し誰を専門家として招くかといった一連の設計判断には、常に誰かの意思決定が介在している。
したがって「制度が学習できるかどうか」という問いだけでは不十分であり、「誰が学習の対象と方法、すなわち何を学ぶべきかを決めるのか」という、より上位の問いを立てる必要がある。制度的な学習能力がどれほど高くても、その学習過程の設計が一部の行政官や業界関係者だけに握られているなら、それは十分に民主的なガバナンスとは言いがたい。
この論点は、実験を通じた漸進的な制度改善を重視する統治のあり方一般に向けられてきた批判とも重なる。手続き上の問題解決を重視するあまり、その背後にある権力の非対称性や利害対立の構図が見えにくくなるという懸念である。制度的学習を語るときには、学習の速度や精度だけでなく、学習の議題を誰が設定しているのかという政治的平等の問題を、繰り返し問い直す必要がある。ここで、フィシュキンのトリレンマの一角であった政治的平等が、実験や熟議の「入り口」の設計という新しい場面で、もう一度効いてくる。
可逆性の多層性と、変えやすさの限界
可逆性は、速い意思決定を正当化する重要な条件である。決定を後から低コストで修正できるなら、最初の段階で完全な情報や合意を確保する必要性は下がる。逆に、不可逆的な帰結を伴う決定では、事前の慎重さの比重を高めなければならない。
ただし可逆性を、法律や行政決定の撤回可能性だけで捉えることはできない。少なくとも技術的可逆性、経済的可逆性、社会的可逆性、権利侵害に関する可逆性を、別々の軸として区別する必要がある。あるAIサービスを一年間認めた後に禁止できたとしても、その一年間に個人情報がすでに流出していれば被害は戻らない。市場が寡占化していれば競争状態の復元は難しく、企業が巨額投資を行い、人々が職業や生活習慣を変えていれば、その社会的・経済的コストも不可逆的になりうる。問うべきは「法律を撤回できるか」ではなく、「失敗した場合、誰にとって、何が、どこまで回復可能なのか」である。可逆性が高く影響範囲が狭い領域では小さく早く試せるが、不可逆性が高く影響範囲が広い領域では、実験に先立つ証拠と権利保障を厚くする必要がある。
同時に、柔軟性を無条件に高めることにも代償がある。ルールが頻繁かつ恣意的に変わる制度は、投資、人材育成、長期契約といった、一定の予見可能性を前提とする活動を困難にする。ルールが来月にも変わりうるという状態が常態化すれば、政府自身が不確実性の発生源になってしまう。柔軟性と法的安定性のあいだにも、また別のトレードオフが存在する。
したがって目指すべきは、無制限の柔軟性ではなく、予見可能な変更可能性である。どのような事象が起きれば再検討を始めるのか、誰が再検討を開始できるのか、どの証拠を用いるのか、既存の投資や権利にどのような経過措置を置くのかを、あらかじめ制度化しておく。これによって、柔軟性と法的安定性というトレードオフについても、パレートフロンティアを外側へ押し出すことができる。
正統性の二つの顔と、学習の外にある下限
制度的学習が社会に受け入れられるかどうかは、正統性の問題でもある。ここでも二種類を区別しておく必要がある。一つは、手続きが公平だったと市民が感じ、自分の希望と異なる結論であっても受け入れられると思える、体感された正統性である。もう一つは、多数がどれほど納得していても揺るがない、規範的・制度的な正統性である。基本的人権、法の支配、適正手続、司法審査といった外側の枠組みがこれにあたる。
九十九パーセントの市民が賛成したとしても、それだけで基本的人権を侵害する政策が正当化されるわけではない。したがって、本稿が提示してきた適応的なガバナンスの設計は、常に憲法的・法的な制約の内側で行われるべきものである。「社会が学び続ければよい」という発想だけでは、この下限を説明できない。実験も熟議も交渉も、この下限の内側で行われる技術であって、下限そのものを動かす技術ではない。
動的な意思決定モデルへ
ここまでの議論を統合すると、意思決定を一回きりの出来事として設計するのではなく、循環として設計するという発想にたどり着く。暫定的に境界を定める、必要ならサンドボックスで限定的に試す、専門家がリスクと便益、代替案を評価する、価値判断が分かれる論点は熟議にかける、利害が対立する論点は政治的に交渉する、正式な決定を下す、実施結果を追跡する、前提が崩れれば再検討する。こうした一連の循環である。
重要なのは、あらゆる案件にこの全工程を一律に適用することではない。経験的不確実性が中心の問題では実験を厚くし、価値的不一致が中心の問題では熟議を厚くし、分配的対立が中心の問題では交渉と補償の設計を厚くする。不可逆性が高く影響範囲の広い領域では、実験に先立つ証拠固めと権利保障を厚くする。政治的平等、熟議、参加、応答性を、同じ瞬間にすべて最大化しようとするのではなく、時間軸上の異なる局面に配置し直すのである。
この循環を具体的な制度として機能させるには、いくつかの技術的な工夫が考えられる。再検討の開始条件、いわゆるエスカレーション・トリガーをあらかじめ明示すること。正式な法改正を待たずに動ける暫定的な決定手段を用意しておくこと。サンドボックスでの実証が終わった時点で、制度変更、変更不要、追加実験、禁止のいずれかを理由とともに一定期間内に回答する「閉じ方」を設計しておくこと。意見公募の結果を単なる件数としてではなく、採用、部分採用、不採用、対象外に分類し、採否の理由を公開すること。こうした工夫はいずれも、学習を美しい理念として語るだけでなく、学習の結果が実際の制度変更へ変換される経路を、具体的に設計しようとする試みである。
日本という一つの試験例
この一般理論を、日本の行政に当てはめて考えてみる。政策評価の仕組み、審議会、意見公募、規制のサンドボックス制度など、日本の行政にはすでに一定の制度部品が存在している。したがって「日本には学習する仕組みがない」という単純な診断は、あまり説得力を持たない。
むしろ検討に値するのは、現場で得られた情報が正式な制度変更へと変換される経路の性能である。担当者が問題を認識してから、課内で共有され、局へ上がり、他省庁との調整が必要になり、既存業界との調整が始まり、審議会にかけられ、法改正が必要になるという経路のどこかで、変換は滞留しているかもしれない。情報が足りないのか、権限が足りないのか、省庁間調整で止まるのか、既存の利害調整で止まるのか、政治判断待ちになるのか。これらを見分けなければ、「日本の意思決定は遅い」という診断そのものが意味を持たない。
ただし、本稿がここで示せるのは、制度部品の不足ではなく接続の性能に問題があるかもしれない、という仮説にとどまる。どの経路のどの段階で滞留が起きているかを具体的な事例に基づいて特定するには、複数の政策変更の過程を時系列で追う実証的な作業が別途必要になる。ここで断定に踏み込むことは、本稿がここまで積み上げてきた議論の質を損なう。日本は、この一般理論を検証するための一つの試験例として開かれた位置に留めておくのが誠実な扱いだろう。
「間違えない政府」ではなく
不確実性の高い問題に対して、政府に「最初から正しい決定」を求めることは、しばしば非現実的である。実際に動かしてみなければ分からないことがある。十分な情報があっても価値判断が分かれることがある。情報と価値観を共有していても、利害そのものが衝突していることがある。
だとすれば、良いガバナンスの基準もまた変える必要がある。重要なのは、最初から間違えない政府ではない。何が分からないのかを見極め、小さく試せる範囲を判断し、価値観が分かれている論点を可視化して熟議にかけ、利害が衝突している論点は政治的に交渉し、必要なら補償し、権利を侵害しうる領域には学習や多数意見とは別の下限を置き、新しい情報によって前提が崩れたなら決定を修正できる政府である。
ただし、この「学習する政府」という像は、それ自体を万能の処方箋にしてはならない。学習の対象と方法を誰が決めているのか、分配の対立は交渉と補償によって処理されているのか、権利の下限は保たれているのか。この三つの問いを繰り返し立て続けることによってのみ、制度的学習は単なる技術官僚的な改善にとどまらず、民主的なガバナンスであり続けることができる。
問題は、速さと慎重さのあいだのどこで妥協するかではない。政治的平等、熟議、参加、法的安定性という制約を守りながら、制度設計によってそのパレートフロンティアをどこまで外側へ動かせるか、である。
ポイント整理
「速い/慎重」という国別比較は評価の単位として粗い
速さには問題認識、暫定対応、実証実験、正式立法、修正、撤回という複数の異なる能力が含まれ、単一の指標で測れない。
評価すべきは決定までの時間ではなく、検知・判断・実行・学習・再判断という循環の性能である。
フィシュキンのトリレンマは技術以前から存在する
政治的平等・大衆参加・熟議は、同時に高水準で満たすことが構造的に難しい三つの価値である。
技術変化への応答性は、この三価値に加わる第四の価値ではなく、三価値の実現に課される時間的な外部制約として位置づけるべきである。
パレートフロンティアという評価軸への転換
複数の価値のトレードオフは所与としつつも、制度設計によってフロンティア自体を外側へ押し広げられるかを問う。
サンドボックスとミニ・パブリックは、いずれもこのフロンティアを押し出そうとする具体的な制度技術である。
政治は学習だけでは処理できない
政策上の対立は経験的不確実性、価値的不一致、分配的対立の三種類に分けられ、それぞれ実験、熟議、交渉という異なる処理手段を必要とする。
「学習すれば解決する」という発想は、分配的対立を情報不足や熟議不足に矮小化する危険を持つ。
可逆性と正統性は多層的である
可逆性は法的・技術的・経済的・社会的・権利の各レベルで別々に評価する必要がある。
正統性も、体感された手続きの公平さと、多数意見によっても動かせない規範的な下限とに分けて扱う必要がある。
キーワード解説
【パレートフロンティア (Pareto frontier)】
複数の価値のあいだで、他の価値を犠牲にしなければどの価値も改善できない状態の境界線を指す経済学の概念。本稿では、政治的平等・熟議・参加・応答性という価値のトレードオフを、どこで妥協するかではなく、制度設計によってこの境界線自体をどこまで外側へ押し広げられるかを問う評価軸として用いている。
【レギュラトリー・サンドボックス (regulatory sandbox)】
対象者、地域、期間、取引額などを限定した管理環境のもとで、新しい製品やサービスを実際の利用者に試してもらう規制上の仕組み。目的は規制緩和そのものではなく、失敗時の被害範囲を限定しながら実環境でしか得られない経験的知識を得ることにある。
【討論型世論調査とミニ・パブリック (Deliberative Polling / mini-public)】
無作為抽出によって社会の縮図となる市民集団を形成し、十分な情報と討議の場を与えることで、熟慮された社会的選好を明らかにしようとする制度。政治的平等を近似しながら熟議の質を高める試みだが、参加者の判断をそのまま社会全体の意思として拘束力を持たせることには正統性の限界が伴う。
【可逆性の多層性】
決定を後から修正できるかどうかを、法律の撤回可能性だけでなく、技術的・経済的・社会的・権利侵害に関する可逆性として別々に評価する考え方。法的には撤回可能でも、個人情報の流出や市場の寡占化のように、実質的には元に戻らない帰結が生じうる。
【予見可能な変更可能性 (predictable revisability)】
制度の柔軟性を無制限に高めるのではなく、再検討を始める条件、開始できる主体、用いる証拠、既存投資への経過措置をあらかじめ明示しておく設計思想。柔軟性と法的安定性という別のトレードオフを緩和する試みである。

