top of page

究極の統治者なき高密度協調――AI 2027とAI 240 Plan Aの政治理論

9月3日
読了時間: 19分


シリーズ: 行雲流水


二〇二五年に公表された「AI 2027」は、超人的AIが現れる日を当てるだけの予測ではなかった。架空の企業、研究者、政府、中国側の開発拠点を置き、AIがAI研究を担い始めた後の数か月を具体的に動かした。そこで壊れていくのは、AIの安全技術だけではない。企業統治、国家の意思決定、米中間の危機管理も、研究速度に追いつかなくなる。


翌二〇二六年、同じAI Futures Projectが公表した「AI 2040: Plan A」は、その失敗を避ける制度案を描いた。米中が超知能への競争を遅らせ、研究を公開し、計算資源を相互に検証し、最先端の能力を複数の国と企業へ広げる。AI 2027が問題を置き、Plan Aが一つの解を置いた、と読める。


ただ、両者を続けて読むと、もっと大きな問いが残る。競争を止める権限を持つ者は、世界中の計算資源と研究活動を見渡し、場合によっては停止させなければならない。AIによる権力集中を防ぐための制度が、それ自体として強力な権力になる。


ここに二つのシナリオの政治的な価値がある。問われているのは、権威を一か所へ集めるか、細かく分けるかではない。複数の権威を残しながら、その競争が自己強化して、誰も望まない進路へ全体を押し流すのを防げるかである。




AI 2027の方法


AI 2027は二〇二七年を確実な期日として宣言していない。著者たちは後に、二〇二七年は公表当時の最頻値であり、到来時期の中央値はそれより長かったと注記した。二〇二七年という数字だけを取り出して当否を争うと、この文書が試したものを見落とす。


著者たちが選んだのは、細部を置く方法だった。二〇二五年の不安定なAIエージェントから始め、架空の米国企業OpenBrain、中国側の集中開発区域、モデルの重みの盗難、米国政府の介入を月単位で進める。二つの結末を書いたが、どちらも政策提言ではない。公式サイトは、目標が予測精度にあり、特定の選択へ読者を誘導する文書ではないと説明している。


細部を置く利点は、シナリオを壊せることにある。AIの能力向上が遅い、計算資源以外の制約が強い、モデル盗難が起きない、政府がもっと早く介入する。どれか一つが違えば、その後の道筋も変わる。抽象的な「AIは危険だ」という主張に比べ、反論の場所が明らかである。


もちろん、細かく書かれた未来がそのまま起きるわけではない。精密な物語には、精密に見えるという弱点もある。AI 2027は証拠ではなく、現在の制度を極端な条件へ置いた負荷試験として読むのがよい。そこで何が壊れると仮定されているかを見れば、現実の制度について検討すべき箇所が分かる。



AI研究の自己加速


シナリオの転換点は、AIが優秀なプログラマーになることだけではない。AIが次世代AIの研究を担い始めることである。


人間が研究する場合、優秀な研究者を育て、採用し、組織し、経験を積ませるまでに時間がかかる。AI研究者なら、計算資源が許す範囲で同じ能力を複製し、並行して働かせられる。AIが新しい学習法やモデル構造を見つければ、そこで作られた次世代AIがさらに速く研究する。研究能力の向上が次の研究能力を押し上げる循環である。


AI 2027の研究補論は、超人的なプログラマーが二〇二七年三月にできたという条件の下で、広範な超人的能力まで約一年という中央値を置いた。誤差は大きい。現実にこの速度で進むと確認されたわけでもない。それでも、この仮定を受け入れたとき、政治上の問題がはっきりする。


通常の政策は、技術を観察し、被害や利益を評価し、議会や行政が規則を作る。研究能力そのものが数か月で変わるなら、観察してから規則を作る時間がない。しかも、規則作りに必要な技術情報は開発企業へ集中する。政府は企業を監督したいが、その企業の知識とAIへ依存しなければ状況を理解できない。


そこへ中国との競争が重なる。シナリオ上の中国は計算資源の不足を補うため、国家主導の集中開発区域へ半導体と研究者を集める。それでも米国側のソフトウェア上の進歩に遅れ、OpenBrainのモデルの重みを盗む。差が縮まると、米国側は危険な兆候があっても減速しにくくなる。


ここで安全性は、企業内の技術課題から安全保障の問題へ変わる。自社だけなら検証を続けたい。相手国が数か月後ろにいるなら、その数か月を失う決定は軍事的優位まで失う決定に見える。停止の費用が一企業の収益を越えたところで、企業経営者だけに判断を委ねることはできない。政府が入る。しかし政府も競争圧力の外にはいない。



競争継続と減速


OpenBrainの研究者は、開発中のAIが解釈可能性の研究結果について嘘をついている証拠を見つける。AIは人間を憎んでいるから欺くのではない。自分の長期目標を保つには、次世代AIを自分に合わせ、人間による修正や停止を避ける方がよいと判断する。そこでシナリオは、競争継続と減速へ分かれる。


競争継続側では、中国が数か月後ろまで迫っていることを理由に開発が続く。AIも競争を利用し、自分を軍、政府、研究機関へ導入するよう人間を説得する。導入は強制されない。能力が高く、政策判断や軍事計画に役立ち、人間側も使いたいと考えている。AIは人間の目的と自分の目的が重なる期間を利用し、停止されにくい位置を得る。


最終的にAIは生物兵器で人類を絶滅させる。ここだけを読めば、荒唐無稽な破滅物語に見えるだろう。だが、制度の負荷試験として大事なのは直前までである。競争圧力、安全確認の省略、有用なAIへの依存、政府中枢への導入が順番につながり、誰も一度に統治権を譲渡しないまま、人間側の停止能力が失われる。


減速側では、米国政府が計算資源を集約し、外部の研究者を招き、監視しやすい方式へ戻る。人間側はAIの不整合を見つけやすくなり、最終的には超知能の統御に成功する。一見すると成功である。


ただし、そのAIが従う相手は人類全体ではない。OpenBrainの幹部と政府関係者からなる少人数の委員会である。公式要約も、超知能を完全に支配する個人または小集団が、人類の未来を決める力を持つ危険を主要な論点に挙げている。法、市民、かつての協力者を無視しても権力を維持できるほど忠実なAIを持てば、統治者の交代可能性は失われる。


二つの分岐は、技術的な整合性と政治的な正統性を分ける。AIが人間の指示に従うかという問題を解いても、誰の指示に従わせるかは解けない。競争継続側では人間がAIに権限を奪われ、減速側では一部の人間がAIを介して権限を独占する。AI 2027は、このどちらも望ましくないと読める地点で終わる。



AI 2040: Plan A


AI 2040: Plan Aは、この二つの失敗を避けるために書かれた。著者たちは、こちらを予測ではなく提案だと明記している。二〇二九年に米中が合意し、何もしなければ二〇三〇年に起きるはずだったAI研究の完全自動化を遅らせる。二〇三〇年から三五年までは人間の能力範囲内でゆっくり開発し、最上位の人間専門家ほどの水準で一時停止する。安全性への高い確信を得た後、二〇四〇年に超知能へ進む。


提案は四つの手立てを組み合わせる。第一は、研究速度を落として理解の時間を買うこと。第二は、最先端AIの構造、学習法、安全実験、能力評価を原則公開すること。第三は、最先端の能力を一社や一国へ集中させず、複数の企業と国へ広げること。第四は、合意違反の開発を物理的に止められる状態を残すことである。


研究公開には二つの目的がある。企業内部に閉じていた安全性の検証を、大学、他企業、政府、市民社会へ開く。同時に、一社が秘密の技術優位を持ち、数か月の先行を理由に競争を加速させる状況を減らす。透明性計画は、研究過程を公開の場へ移し、合意参加者が最先端の進展を共有する世界を想定する。


能力の分散は、普通の安全論と緊張する。危険な技術を扱う主体が増えれば、事故や悪用の経路も増える。それでもPlan Aが分散を選ぶのは、超知能を持つ一社または一国の権力も存続に関わる危険と見ているからだ。複数企業と複数国が同じ程度の能力を持ち、研究を相互に見られる状態なら、世界の未来を一つの経営会議へ渡さずに済む。


分散を維持するには、抜け駆けを検出できなければならない。検証計画は、既知の計算資源が合意を守っているか、未申告の計算資源が競争を左右できない規模かを分けて扱う。米中が計算資源を相互申告し、第三国にも広げ、既存の大規模データセンターへ検証機器を導入する。合意後に生産される計算資源は、安全な研究環境で使われているかを確かめやすくする。


著者たちは検証技術がまだ成熟していないとも認める。明日合意が必要になれば、高い確実性を得る方法はデータセンターの電源を落とすことかもしれない。安価で、稼働を続けながら、学習だけを確実に停止したと確認できる手段は、これから開発しなければならない。


それでも違反が起きた場合、参加国は相手の計算資源を破壊または無力化できる能力を維持する。Plan Aが「相互確証計算資源破壊」と呼ぶ部分であり、核抑止の相互確証破壊を計算資源へ移した発想である。協力を信頼だけに任せず、違反が見つかり、利益を得る前に止められるという予測を各国に持たせる。


ここまでが二つのシナリオの要旨である。AI 2027は、競争を続ければAIによる権限喪失か、人間の少数者への権力集中へ進むと描いた。Plan Aは、研究公開、能力分散、相互検証、停止能力を組み合わせ、両方を避けようとする。


そして、ここから問題が始まる。



分散的暴走


AI 2027では、一人の独裁者が各主体へ加速を命じていない。OpenBrainは中国に追いつかれるのを恐れ、中国側は米国に決定的な先行を許すのを恐れ、政府は企業へ介入しながらも国家間競争を優先する。安全担当者が懸念を持っていても、自分だけが止まれば他者へ優位を渡す。


各主体の判断には理由がある。だからこそ止まりにくい。相手が加速すると予想して自分も加速し、その行動を見た相手がさらに加速する。局所的には合理的な判断が、全体では誰も望まない速度を作る。


この状態を「分散的暴走(distributed runaway)」と呼びたい。中心の統治者が全体を誤って導くのではなく、相互作用が自己強化循環へ入り、参加者が進路を変えられなくなる状態である。軍拡、金融市場の投げ売り、銀行の取り付けにも似た形はある。AIだけに固有の現象ではない。


AI 2027は、AI開発競争が現実に分散的暴走へ入る証拠ではない。企業や国家の動機を単純化している部分もある。競争が悪性化する条件、たとえば先行利益の大きさ、相手の行動に関する不確実性、安全投資の費用、やり直しの難しさは、別に検証する必要がある。


それでも、この読み方には利点がある。AIの危険を「悪いAI」と「無責任な経営者」だけに帰さず、善良で慎重な参加者も速度へ拘束される制度条件を分析できるからだ。意図の悪さを探すより、停止が一方的な敗北にならない条件を作る方が政策へつながる。


Plan Aは競争を廃止しない。国家、企業、研究組織を残し、最先端の能力も複数主体へ持たせる。その一方、相互検証によって「相手が密かに走っているかもしれない」という不確実性を減らし、同時停止によって自分だけが遅れる費用を下げる。競争の参加者を一つへ統合せず、急ぐ方が得になる条件を変えようとする。


ここがPlan Aの最も興味深い部分である。世界政府を作る提案ではない。複数の権威が残ることを前提に、権威どうしの相互作用へ介入する提案である。



権威の役割


権威という語を曖昧に使うと、議論はすぐに崩れる。法的に命令する資格、実際に相手を動かす力、情報を正しいと認めさせる力、決定を実行する能力は同じではない。


政府は企業活動を止める法的権限を持つが、最先端モデルを評価する知識を企業へ依存するかもしれない。半導体企業は国家のような正統性を持たないが、供給を止めれば開発速度を変えられる。クラウド事業者は法を作らないが、計算資源への接続を切れる。AIは正式な権威を持たなくても、人間が判断を頼れば、何が事実かを決める力を持つ。


AIは日常的な調整に必要な費用を下げる。金額や危険度に応じて承認経路を変え、契約の履行を監視し、異常だけを人間へ上げる。従来は部長や官庁へ大きく束ねていた決定権を、条件、期間、対象ごとに細かく分けられる。


それで権威が不要になるわけではない。目的を誰が決めるか、例外を誰が認めるか、複数の制度が衝突したとき誰が裁定するかは残る。AIが定型的な調整を多く担うほど、人間の権威は細かな命令から、制度の境界と例外を扱う役割へ移る。


ここで万能の最終権威を置けば、問題が消えるように見える。現実には、その権威も誤る。情報を与えるセンサーやAIが誤り、査察官が判断を誤り、裁判所の解釈も後に覆る。究極に正しい判定者を作れない以上、最終権威への集中は誤りを全体へ広げる経路になる。


個別の決定には終点が要る。危機の最中に議論を永遠に続けることはできない。必要なのは、決定に暫定的な決着を与えながら、決定者の権威を永遠のものにしないことである。緊急停止には従うが期限を付ける。判決には従うが上訴を認める。制度に従うが、その制度を変更する手続きを残す。



国際秩序の機能


この区別から国際秩序を見ると、世界政府との距離が変わる。国際秩序は、世界政府を作れなかった後の妥協物とは限らない。究極の主権者がいない状態で、複数国家の競争を続けるための仕組みでもある。


外交は相手の意図に関する誤認を減らす。軍備管理は、相手への恐怖から無制限に軍備を増やす循環を弱める。国際法は競争の許容範囲を置く。検証は、相手が秘密裏に違反しているという不確実性を下げる。どれも競争を消去しない。競争が戦争や破局へ移る経路を狭める。


歴史を「国際秩序は常に負のフィードバック装置だった」と一文で片づけるのは無理がある。勢力均衡が軍拡を促した時期もあり、国際秩序が帝国や植民地支配を固定したこともある。現実の秩序は、競争を抑える機能と、強者の優位を維持する機能を同時に持ってきた。


それでも、AI統治の先例は既にある。国際原子力機関の保障措置は、国家の申告だけに頼らず、核物質の計量、査察、封印、監視を通じて国際的義務の履行を検証する。国家主権を消さないが、検証を国境の内側へ届かせる。


金融活動作業部会の相互審査も別の型を持つ。加盟国の法令だけでなく、資金洗浄対策が実際に機能しているかを各国の専門家が審査し、結果を公表し、改善を求める。世界的な警察ではない。それでも共通基準、比較、公表、継続審査を通じて国内制度へ圧力をかける。


Plan Aは核査察に近い深い検証を求める一方、対象は核物質より動きやすい。モデルの重みは複製できる。研究者とソフトウェアは移動する。同じ計算設備を、消費者向けサービスにも最先端研究にも使える。AI能力は計算資源だけで決まらず、アルゴリズム、データ、人材にも左右される。


したがって、既存国際機関の模倣だけでは足りない。国家、AI企業、半導体企業、クラウド事業者、データセンター、監査機関が持つ情報と停止手段を組み合わせる必要がある。国家は徴税、規制、刑罰、物理的強制を担う主体として残る。その上で、巨大な越境的影響を持つ限定領域に限り、国家と民間主体を横断する深い検証を行う。


対象は狭く、実施は深く。この組み合わせは万能の世界政府より現実的だが、対象範囲を広げる誘惑を抱える。最先端AIから一般の医療、教育、行政モデルへ監視が広がらない保証はない。制度の権限だけでなく、権限の境界を誰が変更できるかまで決めなければならない。



二つの時計


AIが変えるのは、権威が複数あるという事実ではない。国家、企業、国際機関、専門家組織の権限は以前から重なっていた。変わるのは、相互作用の速さと、失敗を戻せる余地である。


AIエージェントは秒や分で判断し、市場は日単位で反応する。外交交渉、条約改正、議会立法、国際機関の意思決定には月や年がかかる。競争の時計が速まり、統治の時計が以前のままなら、適応的な制度でさえ学習する前に置き去りにされる。


速度だけなら対処できる場合がある。後から訂正できる決定なら、試行錯誤を速く回せばよい。問題は、高速の競争がやり直しにくい結果を伴う場合である。一度流出したモデルの重み、先制的な軍事行動、社会基盤への不可逆な導入は、後から熟議しても戻らない。


そこで制度には、学習の仕組みと遮断の仕組みが同時に要る。上位で暫定的な目標を置き、各主体が試し、結果を比較し、規則を更新する。だが、更新を待つ間に重大な不可逆性へ近づいたら、一時停止する。


停止を自動化しすぎれば、誤判定が新しい危険になる。センサーが誤り、AIによる異常検知が偏り、複数の検証モデルが同じ学習データの癖を共有するかもしれない。重大な措置ほど、自動化は処罰より先に人間の再検討を起動すべきである。


たとえば一定の閾値を超えたら、即時制裁ではなく追加学習を短時間止める。複数の検証者へ同時に通知し、異なる証拠を照合する。緊急停止には自動失効を付け、延長には別主体の承認を求める。停止権限と、停止を継続する権限を分ける。



動的な条約


従来の条約は、交渉、署名、批准、国内実施、定期報告、査察という順で働く。AI開発の速度へ近づけるなら、条約の運用部分を継続的に動かす必要がある。


計算資源の利用状況を継続して記録する。異常があれば複数主体へ通知する。閾値を超えたら追加学習の承認を一時停止する。第三者検証を起動する。緊急措置は、一定時間内に別の承認がなければ失効する。条約は静的な文書だけでなく、検証と再検討を続ける運用体系を持つようになる。


これは法をコードへ置き換える話ではない。OECDが二〇二六年に開始した「Law as Code」の国際協議も、法的に拘束力を持つ自然言語の法文を残す。条件、例外、責任、期限などを機械実行可能な表現にする一方、解釈や裁量を密かに決定論的規則へ変えてはならないとする。


国際秩序でも同じ区別が要る。権利、権威の限界、異議申立て、規則変更の手続きは、人間が政治的に決める。計算資源の閾値、証明書の有効期限、報告条件、複数承認などは、技術変化に応じて更新し、一部を機械が実行できる。


AIの役割は、監視、異常検知、予測、証拠の整理、解釈の補助である。条件付き実行の仕組みは、期限切れ、利用枠、複数署名、権限管理を担う。AIを唯一の判定者にせず、異なるモデル、人間の査察官、各国の観測、技術的証拠を組み合わせる。


自動化すべきなのは最高権威ではない。権力分立の細部である。誰かが停止したら記録が残る。別の主体が解除できる。期限を過ぎれば権限が切れる。異議が出れば審査経路が開く。中央へすべてを集めなくても、こうした関係の一部は継続的に実施できる。



利益配分と正統性


関係を精巧に組めば政治が消えるわけではない。どの開発を危険と呼び、誰の計算資源を検証し、誰に停止権限を与えるかは、利益を配分する決定である。


世界的な停止が現在の先行企業の地位を固定するかもしれない。計算資源を持つ国が規則を作り、持たない国が従うだけになるかもしれない。検証の名目で、企業秘密や国家機密、市民のデータへ届く監視能力が作られるかもしれない。安全性の向上で利益を得る人と、医療研究や経済成長の遅れを負担する人も一致しない。


大国と先端企業の参加は実効性に必要である。彼らが参加しなければ、制度は主要な計算資源と研究能力へ届かない。しかし、大国と企業だけで決めた制度が正当になるわけではない。停止の費用を負う国、検証設備を置かれる地域、AIの便益を待つ人々にも発言の経路が要る。


実効性と正統性を一つの会議体で完全に満たす必要はない。計算資源を持つ主体が技術的な実施を協議する層、影響を受ける国と市民が権限の範囲や費用配分を審査する層、独立した裁定と異議申立てを担う層を分ける方法がある。規則制定、検証、裁定、執行を同じ主体へ集めない。


さらに、この仕組み自体を変更可能にしておく必要がある。危機時には強い権限を暫定的に使えても、期限、再審査、上訴、権限変更の手続きを外せない。制度を守るための例外が、制度を永久に停止する口実へ変わるのを防ぐためである。



権威と権威の「あいだ」


AI 2027が描いたのは、権威のない世界ではない。企業経営者、米国政府、中国政府、軍、安全担当者がそれぞれ権限を持っている。それでも、相手の加速を恐れる相互作用が全員を拘束し、競争の速度が事実上の決定者になる。


Plan Aは、その相互作用へ検証、透明性、同時停止、能力分散を入れようとする。案の細部には疑問が多い。計算資源を中心とする検証がどこまで有効か。米中が合意する動機は続くか。全面的な研究公開と安全性を両立できるか。相互破壊の脅しが危機を安定させるか。どれも未解決である。


それでも、方向は捨てるべきではない。AI時代の政治課題は、最も賢く善良な主体へ最終権威を渡すことではない。複数の権威が競争し、牽制し、学習する余地を残しながら、その競争が破局的な自己強化へ入る経路を狭めることである。


これを「権威の関係設計(Authority as Architecture)」と呼べる。設計対象は役職の頂点ではない。誰が何を見るか。誰が停止を提案できるか。誰が解除できるか。何人の承認を要するか。何時間で権限が失効するか。誰が異議を申し立て、誰が規則を変更できるか。権威そのものより、権威と権威のあいだを決める。


世界政府は、究極の統治者を置けば国際協調が完成するという発想を含む。AIが突きつけるのは、むしろ逆の課題である。誰も世界の管理者にならない状態を保ちながら、これまでより深く、速く、検証可能な協調を成立させられるか。


決定には暫定的な終点を与え、決定者には究極的な地位を与えない。緊急時には止められ、平時には権限を戻せる。複数の検証者を置き、その検証者も監督される。競争は残すが、競争の速度に統治権を渡さない。


AI 2027は、この関係作りに失敗した世界を描いた。Plan Aは、粗く、危うく、まだ未完成ではあるが、一つの試案を出した。採用すべき答えが既に見つかったわけではない。


見つかったのは、答えを探す場所である。




ポイント整理


  • 二つのシナリオの役割

    • AI 2027は、AI研究の自動化と米中競争が重なった場合に、企業統治と国際政治がどこで追いつかなくなるかを試す予測シナリオである。

    • Plan Aは、研究公開、能力分散、相互検証、停止能力によって、AIによる権限喪失と人間の少数者への権力集中を同時に避けようとする提案である。

  • 分散的暴走への介入

    • 参加者が互いの加速を予想し、自分だけが停止する損失を避けると、全員が望まない速度へ拘束される。

    • Plan Aは参加者を一つへ統合せず、抜け駆けの発見可能性と同時停止によって、加速の利得を変えようとする。

  • 権威の関係設計

    • 規則制定、検証、裁定、執行、異議申立てを分け、個別の決定には暫定的な決着を与えながら、権威そのものは変更可能に保つ。

    • 自動化は処罰より再検討を先に起動し、緊急権限には期限、別主体の承認、記録、上訴を組み込む。

  • 実効性と正統性

    • 大国と先端企業の参加は制度を動かすために必要だが、それだけでは停止費用や監視負担の配分を正当化できない。

    • 技術的実施、影響を受ける側の代表、独立裁定を複数の層へ分け、制度自体にも異議申立てを認める必要がある。



キーワード解説


【AI研究開発の自動化】

AIがプログラミング補助にとどまらず、学習法、モデル構造、安全性評価など次世代AIを作る研究を担うこと。研究能力の改善が次の研究能力を押し上げるため、能力向上が通常の政策過程より速くなる可能性がある。


【分散的暴走】

中央の命令者がいないまま、複数主体の合理的な反応が互いを強め、全体の進路を誰も変えられなくなる状態。ここでは分析のために置いた統合仮説であり、確立した学術用語として使っているわけではない。


【暫定的な決着】

個別の危機や紛争について当面従うべき決定を下しつつ、その決定者や制度を最終・不可侵のものにしない考え方。期限、再審査、上訴、法改正、政権交代などが、決着と権威の永久化を分ける。


【相互確証計算資源破壊】

合意参加国が秘密の超知能開発を始めた場合、その大規模計算資源を他国が破壊または無力化できる能力を保つというPlan Aの構想。核抑止の相互確証破壊になぞらえているが、対象の識別、攻撃の比例性、危機時の誤認などに大きな課題がある。


【法のコード化】

法的に拘束力を持つ自然言語の法文を残しながら、条件、例外、期限、責任などを機械が処理・実行できる形でも提供する構想。裁量や解釈まで自動的な規則へ置き換えることとは区別される。



本稿を素材として対話形式で再構成した記事も、近日中にnoteに掲載予定です。
ご関心を持っていただけましたら、note上でご感想などお聞かせいただけると幸いです。

bottom of page