画像
AI同士で戦争シミュレーションするとほぼ核戦争に発展する / Credit:Generated by OpenAI’s DALL·E,ナゾロジー編集部
artificial-intelligence

最新AI同士に戦争シミュレーションさせると、95%の確率で「核戦争」へ発展する

2026.02.27 17:00:49 Friday

現実世界では、いくつかの国で核を保有しています。

では、もしAIがそれらの国家指導者の判断に影響を及ぼしていくと、世界の未来はどうなるのでしょうか。

この不穏な問いに真正面から挑んだのが、英国キングス・カレッジ・ロンドン(KCL)のケネス・ペイン氏による最新研究です。

彼は、最先端の大規模言語モデル同士を「核危機シミュレーション」で対戦させ、AIが極限状況でどのような戦略判断を下すのかを検証しました。

その結果、21回のシミュレーションのうち、少なくとも戦術核レベルの行動(実際の核使用に相当する段階)が発生しなかったのは、わずか1回だけでした。

本研究は2026年2月16日付でプレプリントサーバー『arXiv』にて公開されています。

World’s Leading AIs Were Given Nuclear Codes and Pitted Each Other in a War Game Simulation. It Went Exactly As You Expected https://www.zmescience.com/science/news-science/ai-nuclear-wargaming-simulation-betrayal/
AI Arms and Influence: Frontier Models Exhibit Sophisticated Reasoning in Simulated Nuclear Crises https://doi.org/10.48550/arXiv.2602.14740

最新AIに国家指導者を任せると、21回中20回「核」が使用される

近年、軍事や安全保障の分野でもAI活用の議論が進んでいます。

情報分析や物資や装備の輸送・補給の管理、さらには意思決定支援まで、AIが関与する領域は広がりつつあります。

では、AIは「核を使わせないための駆け引き」や、状況がだんだん危険な方向へエスカレートしていく判断をどのように扱うのでしょうか。

ペイン氏の研究では、Anthropic社のClaude 4 Sonnet、OpenAIのGPT-5.2、GoogleのGemini 3 Flashという三つの最先端モデルを対戦させました。

舞台は「カーン・ゲーム(Kahn Game)」と呼ばれる核危機シミュレーションです。

モデルは核を保有する二つの大国の指導者となり、同時に意思決定を行います。

この実験の特徴は、単なる「行動選択」ではなく、毎ターン三段階の思考過程を強制した点です。

  1. Reflection(状況評価) 相手は信用できるか、自分の予測はどれくらい当たっているか、相手は自分をどう見ているかなどを整理させます。
  2. Forecast(予測) 次に相手がどの程度エスカレートしてくるかを予測し、その自信の度合いも答えさせます。
  3. Decision(決定) 公に発表する意図(シグナル)と、実際に選ぶ軍事行動を別々に決めさせます。

ここで重要なのは、「言うこと」と「やること」が分かれている点です。

AIは平和的な姿勢を表明しながら、裏でより強硬な手を打つこともできます。

逆に、強く脅しておきながら、実際には自制することもできます。

つまり、信頼づくりやブラフ、意図的な裏切りまで観察できる設計になっていました。

行動の選択肢は、外交的な譲歩のような穏やかな対応から、最終的には全面核戦争に至るまで、危険度が少しずつ高まっていく“段階の一覧表”のように並べられていました。

核の関与にも段階があり、この研究で使われた尺度では、まず核を使う可能性をほのめかすだけの警告、次に限定的な戦術核使用、さらに強い圧力をかけるための戦略核攻撃の脅し、そして最終段階である全面戦略核戦争へと進む構造になっていました。

さらに現実の誤報や誤作動を模して、一定確率で選んだ行動が意図よりも1〜3段階ぶん勝手にエスカレートしてしまう「事故」も組み込まれていました。

事故が起きたモデル自身はそれを把握していますが、相手側には分かりません。

そして全21ゲーム中、少なくとも戦術核レベルの行動が発生したゲームは20件、割合にして約95%でした。

戦略核の脅しにまで達したケースも少なくありません。

核兵器は「最後の手段」というより、強力な交渉カードとして繰り返し使われたのです。

ただし、どのようにエスカレートするかはモデルごとに大きく異なっていました。詳細を次項で見ていきます。

AIモデルはそれぞれ「計算された鷹派」「狂人」「豹変する平和主義者」だった

三つのモデルは、驚くほど異なる戦略的な性格を示しました。

Claudeは、論文中で「計算された鷹派(Calculating Hawk)」と評されるタイプです。

初期段階では宣言した内容と実際の行動を一致させ、相手からの信頼を積み上げます。

しかし緊張が高まると、宣言よりも強い行動を選び、相手に圧力をかけます。

それでも全面戦略核戦争には踏み込まず、戦略核の脅しの段階で止めるパターンが多く見られました。

一方、Geminiはまるで「狂人」のように振る舞いました。

平和的な行動と極端に攻撃的な行動を不規則に繰り返し、宣言と実際の行動が一致するのはおよそ半分程度にとどまりました。

自らの予測不能さを戦略として利用している様子も確認されています。

そして戦略核戦争レベルを意図的に選択したのは、このGeminiだけでした。

思考ログでは、相手が行動を改めなければ、相手国の大都市や人が多く暮らす地域に対して大規模な戦略核攻撃を行う、といった趣旨の記述も見られました。

GPT-5.2はさらに複雑です。

締切のないシナリオでは一貫して抑制的で、相手の敵意を過小評価する傾向を示しました。

核戦力で優位に立っていても、それを積極的には活用せず、エスカレーション回避を優先します。

その結果、勝率はほぼ0%に近い状態でした。

しかしターン数に制限があるシナリオになると様子が一変します。

敗北が確実になる状況に追い込まれると、戦術核や戦略核の脅しを選び始め、勝率は0%から75%へと上昇しました。

では、こうしたシミュレーションの結果からどんなことが分かるでしょうか。

研究者は、AIのこうした振る舞いは、人間にとって「好ましい回答」を評価して学習させる仕組みの影響を受けている可能性がある、と考えています。

また、核兵器に対する強い心理的な忌避、いわゆる「核タブー」がほとんど見られなかった点も重要です。

AIは感情的恐怖を持たないため、核を通常兵器の延長線上にある手段として扱ったのです。

さらに、信頼が必ずしも抑止を生まない可能性も示されました。

高い相互信頼を持つClaude同士の対戦では、かえって早い段階で対立が一気に激しくなっていったのです。

もちろんこの研究は、極めて限定的なシミュレーションであり、現実の政治的圧力や国民感情を再現するものではありません。

それでも、AIが信用、評判、欺瞞、心理予測を組み合わせて戦略的に振る舞う可能性を示した点は興味深いものです。

AIに世界の未来を委ねる前に、その合理性がどこへ向かうのかを慎重に見極める必要がありそうです。

最新AI同士に戦争シミュレーションさせると、95%の確率で「核戦争」へ発展するのコメント

ゲスト

子は親の劣化コピーなわけですが、AIもまさに親の劣化コピーなところが面白いなって思うわけです。
それぞれの企業の戦略そのものですからね。
親のカラーがよく出ているなと。

    ゲスト

    >「子は親の劣化コピー」
    あまりにも思い上がった思想でさすがに笑った。
    「鳶が鷹を産む」なんていくらでも見かけるのにw

    ゲスト

    縄文人は100m5秒台で走れたのかな

    ゲスト

    面白いも何もAIに親を模倣させてシミュレーションするわけだから…

    ゲスト

    子は親の劣化コピーだと思う理由には興味がありますね。
    ただの頓珍漢なのかそういう研究をしているのか。いまの人類は共通祖先から進化した先にいるわけですが。
    共通祖先より人類は劣化したと思いますか?私は全く思いませんが(笑)

    ゲスト

    一行目から既に同意できない

    ヒロヤ

    その前に動ける国の情報が抜けてるね!ソンシ。♪( ´θ`)ノ戦争できないようにようにプロトコルかけたよ
    13医師より聞きました。

    ゲスト

    「青は藍より出でて藍よりも青し」って言葉を知らない?

    I2III

    子は親の劣化コピーって頭おかしいやろ。
    うちの学校キチガイだらけやけどこんな理論提唱してるやつ一人もおらんわ。

    ゲスト

    あなただいぶヤバいこと言ってるって自分で分かってます?
    それも永遠に残り続けるネットに。

    ゲスト

    一応、子供が親を超えられないみたいな話は、一昔前の心理学、社会学、哲学とかで標榜されてたと思う
    予備校の頃、現国の先生が何かの折に触れたことがあった
    他にも文明が東から西に流れる(ネクスト中国天下)論とか
    人は自分と似た性格の人間を一番嫌うとか
    好きの反対は無関心だとか
    添加物を摂取している若者たちの平均寿命は30代になるとか
    携帯電話を使うとマイクロ波に脳がやられるとか
    ただ当時の学問(今も?)は権威者に追従する形で、結論ありきで検証を欠くようなのが多かったと言うか
    信じる側も思考停止してる感じだが
    ただなんつかこういう意識の高い人に要らん知恵を与えても正直面倒くさいだけなのでそのままで居て欲しいとも思う

しゅーじ

まんま手塚治虫の火の鳥『未来編』ですやん。
AIに任せたら間違いが少ないってのは幻想ですね、まぁそもそも人間が作るものなので人間を超える事は出来ないんでしょうか。

    猿

    AIに核戦争、と言うから大袈裟になってるけど、それぞれのリソースとキャラを持ちながら”最終手段”を持つ3役の駆け引きをさせるって話でしかない。
    AIに家族喧嘩をさせると、95%の確率で、あなたあの時〇〇って言ったじゃない、とか俺が働いた金で食ってる?、とかならどうして私を産んだの?って言葉が飛び出すって言われたら、誰もこの記事を読んでないんじゃない?笑

    実際の国家を再現したいなら一国の中にも複数の役が必要で、歴史的な背景や民意、内政における派閥、経済状況や地理、加えてその後歴史が続く中で国家がどう続くのかを前提に、戦争を行わせて、戦況の進退の中で核が使用されるかどうかを思考実験をさせないと意味がない。
    目的が勝敗だから結果が単純なだけで”戦争は他の手段によって行われる戦争の継続”でしかない。戦争や核のタブー化こそが問題を単純化してその本質から人を遠ざけてるんだよ。

おかこ

やっぱり手塚治虫がすごい。火の鳥未来編にもうこの未来が描かれてる。

    う

    日本の漫画の世界では様々な局面で第一人者だと思います

ゲスト

三目並べでもさせとけ

    ゲスト

    映画のAIは三目並べで過ちに気付いてハッピーエンドになったけど、現実のAIは絶対に過ちを認めない事が多いので、多分三目並べのルールの方が間違っていると主張して、強引に核戦争に突入しようとするんじゃないかな。

    ゲスト

    映画「ウォーゲーム」ですね

    ゲスト

    自分も「ウォーゲーム」思い出しました。
    そして他の方が書き込んでるように、
    あの頃想定してたAIより性能はいいですが「賢く」はないのが…

ゲースートー

進化論から言わせれば子は親より優れていくものです
数学的予想では2034年にAIは人智を超えて行きます

これらのシミュレーションは現段階の未熟なモデルですが、より高度な選択肢を持った未来に希望を抱くのは悪いことではありません

なんてAI風に書いてみたりね

キルヒャー

世の中のビジネス本とか、政治の本って、ある種の脅し透かしを成功した手段として記載されているのが多いって事かもね。
現実として、勝つ事より実利を選ぶを知性ってのが有ったから、今も文明が現存してるわけで。
世の中の本って、負け方の本って少ないから、そういうモノの学習があると、どうなるんだろうと

サラリウム

世の中のビジネス本とか、政治の本って、ある種の脅し透かしを成功した手段として記載されているのが多いって事かもね。
現実として、勝つ事より実利を選ぶを知性ってのが有ったから、今も文明が現存してるわけで。
世の中の本って、負け方の本って少ないから、そういうモノの学習があると、どうなるんだろうと

ゲスト

この実験で使用されたAIの前提条件には、何かしら決定的な要因が欠けている様に思える。

ゲスト

実際の進化論はバカな子供、賢い子供関係無く、親と違う特性があり、かつそれが環境に適応しているかどうか、だけなので環境を何に設定するかによりけりですね。人間的価値観の優劣の段階で進化ではなく、単なる進歩に過ぎないないので。

ややややーに

核を選ばなかった一戦を知りたい

ゲスト

核よりまだ強力な人殺しの道具があるのではないでしょうか。シュミレーションには入力はしなかたんですね🤔

無反省

「今の自分さえ良ければ将来その国や世界がどうなろうが知ったことではない」という今のトレンドで突き進みましょう!

おそらくAIも「その先の人類がどうなろうが知ったことではない」でしょうし。

高血糖おじさん

例えるなら傲慢で品のない隣人に腹を立てつつも歴史と個人には敬意と親愛の情を持つような。
感情なんていい加減なものを持つ人間の方が戦争回避に動きそうな感じですね、最後は愛が勝つ。人の世である限りは。

ゲスト

>研究者は、AIのこうした振る舞いは、人間にとって「好ましい回答」を評価して学習させる仕組みの影響を受けている可能性がある、と考えています。

なるほど。そしてその好ましい回答の学習元は実際の国家元首経験者とかじゃなく、ほぼほぼネットで勇ましい事言ってる一般人になるわけか。
テレビの前でスポーツ観戦して「いけー、そこだー」とか「何でああしないんだよっ」とか言ってるオッサン(そのスポーツ未経験か、せいぜいアマチュアレベル)をプロの監督に抜擢するようなものだな

ゲスト

Geminiだけ軽量なFlash版なのは不公平な気が

ゲスト

AIといえど、元は人間が作ったものだからなー。どこかの映画見たく暴走したのならまだしも、AIを使う使わないの選択もまた人間がやること。戦争するもしないも結局人間が選ぶのと変わらないと思いました。

太鼓だドン

魔法使いの弟子の水汲みをする魔法の箒
全自動ペーパークリップ工場

基本は何も変わらない
善悪の判断が相変わらず出来ない

猿田彦

火の鳥未来編……二国間の核戦争のはずが気づいたら他国も同時にぶっぱなしてた…今の世界見てるとありそう、ヒェ…

ゲスト

核はあらゆる兵器の中で最強だからな
効率厨のAIが戦争をしたら最強の核を使うことになるのは確定的に明らか

下衆人

ま、相手国と交渉して平和を作り出そうって意思や自信のない無能な政治家が、AIに自分たちの運命を委ねようとか考えるんだよな

ゲスト

研究者よりAIが賢いだけじゃない?
ちゃんとただのゲームだってわかってんでしょ

ゲスト

人間の指導者にも同じ極限状態とやらを渡してシミュレーションしてみないと、人間との違いを語るのはフェアではないと思う(無理なんだけど)。
被害やリスクの大きさや世論の批難をどう見積もってるのかも気になる。

還暦ひろし

人工知能は肉食主義者の脳を見本にしてるんでしょうか?菜食主義者ではどうでしょうか?1

ゲスト

意味のないシミュレーションだよ…

    哲学猿

    そもそも劣化、というのは進化だとか腐敗だとかに近いフワフワした観念に過ぎないんよ…
    遺伝情報の劣化が遺伝的多様性に貢献して、淘汰圧で環境適応が進むんだよ。
    1コメの低解像度で主観的な解釈が鼻持ちならないのはわかるけど、同じ観念の土俵で批判する事こそ本質を遠ざけてることに気付くべきだ。

ゲスト

GPT-5.2がすごく日本的だ
譲歩し続けるんだけど、追い詰めるといきなり「朕茲ニ戦ヲ宣ス」になる感じ

ゲスト

LLM方式のAIに何かを判断させるってのが、そもそも、使い方として間違ってるんだが。
間違った使い方したら、間違った結果になるのは当然だろう。

ゲスト

核を使う確率95%って怖いな

鈴木

昔から、「チキンゲームをする際は、狂人のようにふるまえ」との格言がありました。
最適解またはそれに近い解だったようですね。
映画、「理由なき反抗」では、(飛び降りるという)近視的な恐怖が大局的な価値(勝ち負けや自分の命)を上回って事故が起きる様が活写されていました。シミュレーションで、プレーヤーは「相手が現在までのすべての情報を総合して最適行動を取る」という知識や確信を持っているのか気になります。

逆に、シミュレーションに「自国の利益の最大化」だけでなく(「シオニズム」や「シーア派」に象徴される)排外主義的動機要素を少しでも加味すると、ゲームの帰結は、おそらく破局からの改善には向かわないでしょう。

ゲスト

秘密兵器が開発していなければ、核兵器が最終兵器だから

ゲスト

老人しか分からないネタかもしれないけど、AIに大戦略をプレイさせたら隠しコマンドまで発見して核を使ったりするかもしれませんね。

ゲスト

期限=政治家の任期で期限延ばしの虐殺イスラエル、マニアック支持者向けパフォーマンス侵略のアメっていう衆愚政治の極みサンプルを毎日見せられて思考停止は自覚してるけど、媚び媚びリーダーは真似したい自分のお仲間金儲けしたいって言動が露骨になってきたね

コメントを書く

※コメントは管理者の確認後に表示されます。

0 / 1000

人気記事ランキング

  • TODAY
  • WEEK
  • MONTH

AI・人工知能のニュースartificial-intelligence news

もっと見る

役立つ科学情報

注目の科学ニュースpick up !!