AI NPCはゲームを「共同創作」に変える?|GPT-5でも次の選択の的中は34%、Microsoft研究で見えた現在地【2026年】
本記事にはアフィリエイト広告(Amazon・楽天市場等)のリンクが含まれています。
GPT-5でも次の選択の的中は34%、Microsoft研究で見えた現在地
出典:Microsoft Research「Emergence」、arXiv「Rushes: A Human Preference Dataset for Pluralistic Alignment」、arXiv「Player-Driven Emergence in LLM-Driven Game Narrative」、arXiv「Echoes in AI」、arXiv「Game Plot Design with an LLM-powered Assistant」、ACL Anthology「Automatic Bug Detection in LLM-Powered Text-Based Games Using LLMs」、Ubisoft「Teammates」、ドラゴンクエストX 目覚めし冒険者の広場「おしゃべりスラミィ」、NVIDIA Technical Blog「How KRAFTON Built PUBG Ally」、arXiv「PUBG Ally: A Conversational Embodied Agent as an AI Teammate」、PUBG公式パッチノート(Ally Duo)、NVIDIA「inZOI・NARAKA」、inZOI公式ニュース(Steam)、Steamworks「コンテンツアンケート」
NPCに自分の言葉で話しかけ、NPCが状況を見て動く。そんな生成AIのNPCは、2025年から2026年にかけて、inZOIやPUBG: BATTLEGROUNDSの期間限定モードで実際に遊べるようになりました。次に注目されているのが、プレイヤーの遊び方から新しい展開が生まれ、プレイヤーが物語の「共同作者」になるという構想です。Microsoftはこの方向で研究を続け、特許も取っています。
2026年10月時点で実際に動いているのは、人が書いた物語の枠の中でNPCが即興するところまでです。物語の筋そのものをAIが変える段階には、まだ大きな壁があります。Microsoft Researchが7月に公開した研究「Rushes」では、8,167人が選んだ4万4,226回の選択をもとに次の選択を予測させました。過去の履歴を与えたGPT-5でも的中率は34.2%で、多くの人が選んだ展開を答えるだけの方法(36.4%)を下回っています。
AIは展開をいくらでも作れますが、目の前のプレイヤーがどの展開を面白がるかを選ぶ力はまだ足りません。当面のAI NPCは、作り手が決めた範囲でプレイヤーとAIが即興する形が中心になります。遊ぶ側が先に確かめたいのは、Steamストアの「AI生成コンテンツの開示」と、手元のGPUで動かす方式ならVRAMの量です。PUBG Allyの推奨はVRAM 12GBで、GeForce RTXが必要でした。
目次
要点会話と行動はAIへ、物語の筋は人が握っている
UbisoftやKRAFTONは、物語とキャラクターを人が作り、その範囲内でNPCに会話や行動を即興させています。プレイヤーの行動から新しい展開を足すMicrosoftの仕組みは研究と特許の段階で、製品への搭載は発表されていません。同社の研究では、好みの予測と物語の多様さという2つの弱点も数字で示されています。
| 段階 | AIが受け持つこと | 2026年10月時点の例 |
|---|---|---|
| 会話 | プレイヤーの言葉を読み取り、キャラクターらしい返事をその場で作る | Ubisoft「Teammates」(試験プレイ)、PUBG Ally(β終了) |
| 行動 | 周りの状況を読み、動き方や1日の予定を自分で決める | inZOIの「Smart Zoi」(早期アクセス中)、PUBG Ally |
| 物語 | プレイヤーの行動から新しい展開を足し、物語の構造を変える | Microsoftの研究と特許(製品化の発表なし) |
会話NPCは「作り手が立てた柵」の中で即興している
生成AIで最初に変わったのは会話です。従来のNPCは、開発者が書いた会話ツリーから条件に合う台詞を出していました。言語モデルを使うと、プレイヤーが口にした言葉そのものを読み取って返事を作れるため、「はい」「いいえ」「詳しく聞く」のような選択肢を用意しなくて済みます。
ただ、作り手は物語までAIに任せてはいません。Ubisoftは2024年のGDCで会話の実験「NEO NPC」を見せたあと、2025年11月にFPS形式の試験作「Teammates」を発表しました。プレイヤーは敵の基地を進みながら、AIアシスタントのJasparや仲間のPabloとSofiaに声で指示を出し、仲間は状況に合わせて返事をして動きます。数百人規模のクローズドテストも行われました。
両方に関わったナラティブディレクターのVirginie Mosser氏は、物語とキャラクターの性格は今も自分が書いていると話しています。決まった台詞の代わりに、世界観と動機の範囲から出ないための「柵」を作り、その中でNPCに即興させるやり方です。同氏はプレイヤーに対して、物語をなぞるのではなく自分で形づくっていると感じてほしいとも語っています。
国内では、スクウェア・エニックスが『ドラゴンクエストX オンライン』向けに対話型AIバディ「おしゃべりスラミィ」を開発しています。AIで話すのは冒険に寄り添う相棒1体で、冒険の記録が増えたり会話を重ねたりするほど関係が深まり、話す内容も変わっていく作りです。2026年4月20日ごろから約1か月のクローズドβテストを行うと告知した公式ページには、スラミィが事実と異なる発言をする可能性があることも明記されていました。
NPCが自由に話せることと、AIが自由に物語を作れることは同じではありません。今のAI NPCは、作り手が引いた線の内側でプレイヤーの言葉に応える存在です。
行動PUBG Allyは会話と操作を別の仕組みに分けている
会話に加えて「一緒にゲームを遊ぶ」ところまで進めたのが、KRAFTONの「PUBG Ally」です。2026年6月17日から7月1日まで、PC版PUBG: BATTLEGROUNDSのアーケードモード「Ally Duo」としてβが開かれ、プレイヤーはAIキャラクターのEllaとサノックで2人チームを組みました。

PUBG Allyは、仕事を2つの層に分けて動いています。移動、照準、撃たれたときのとっさの反応は、従来のゲームAIで使われてきたビヘイビアツリーが毎フレーム処理します。プレイヤーの意図を読み取り、どう連携するかを考え、話す言葉を作るのは小型の言語モデルです。反射的な動きが言語モデルの返事を待つことはありません。
Ellaは自分の状態、プレイヤーの状態、近くのアイテム、戦闘の状況を「観察用のツール」として持ち、そのとき必要な情報だけをゲームから取り出します。試合をまたぐ記憶もあり、プレイヤーの名前、好きな武器、よく降りる場所、Ellaに話した個人的なこと、過去の試合の記録を覚えます。
一方で限界もはっきりしていました。Ellaの知識はアップデート41.1より前の情報がもとで、5月以降に追加・変更されたアタッチメントなどはよく知らない場合があります。ゲームの更新に合わせてNPCの知識も作り直す必要がある、という生成AIならではの手間です。
プレイヤーの受け止め方は、KRAFTONの開発チームが9月に公開した技術報告に載っています。141か国で行ったアンケートでは、Allyを人に薦めたいかという質問で、肯定的な回答が否定的な回答を25.1ポイント上回りました。Ellaを「チームメイト」と答えた人が18.5%、「仲間・相棒」に近い答えを選んだ人が31.5%で、道具ではなく一緒に遊ぶ相手として受け止めた人が半数いたことになります。
生成AIが従来のゲームAIを置き換えたわけではありません。正確さと速さが要る処理はこれまでの仕組みに残し、あいまいな判断と会話だけを言語モデルに渡しています。ゲームの仕組みの上に、判断と会話の層を1枚足したと見るほうが実態に近い作りです。
創発Smart Zoiの自律は小さな出来事を生むが物語は書き換えない
生活シミュレーション『inZOI』の「Smart Zoi」は、キャラクターが自分で行動を決める例です。思いやりのある性格のキャラクターなら、道に迷った人に道を教えたり、お腹をすかせた人に食べ物を分けたりします。1日の終わりには、その日の出来事をもとに翌日の予定を組み直します。処理は手元のPCで動く小型の言語モデルが受け持ちます。
プレイヤーはキャラクターの心の声をリアルタイムで読めるうえ、自由な文章を打ち込んで行動や人生の目標を変えることもできます。キャラクターの生き方の方向をプレイヤーが言葉で決め、細かな行動はAIが埋める。小さな規模ですが、共同創作に近い分担がすでに遊べる形で入っています。
動かし続ける難しさもPUBG Allyと共通です。inZOIの開発チームは2026年7月、遊べる中身が増えるにつれてSmart Zoiがうまく反応しない不具合が出ていると認め、まずその修正から手をつけると告知しました。ゲームを更新するたびに、AIのキャラクターも合わせて直す必要があります。
こうした仕組みからは、開発者が1つずつ書いていない出来事が生まれます。あるキャラクターが誰かを助け、それで人間関係が変わり、後日の別の出来事につながる。プレイヤーにとっては、それだけでも自分だけの物語です。
ただし、ゲーム全体の筋書きが書き換わるわけではありません。キャラクターの行動が積み重なって偶然面白い出来事が生まれる「創発」と、ゲームのシナリオの構造そのものをAIが作る「生成ナラティブ」は、見た目は似ていても技術的には別の問題です。Microsoftが研究しているのは後者です。
研究Microsoftはプレイヤーが生んだ展開を物語に戻そうとしている
Microsoft Researchの「Emergence」は、ゲームの作り手、プレイヤー、生成AIが一緒にゲームを作り、時間をかけて育てていく方法を研究するプロジェクトです。今はNPCの設定や会話、ゲームの物語を対象にしていて、いずれはゲームの世界全体に広げることを目標に掲げています。
このプロジェクトが2024年に発表した論文では、GPT-4がNPCを演じる謎解きテキストアドベンチャー『Dejaboom!』を28人のゲーマーに遊んでもらいました。謎の前提は決まっていますが、NPCとは自由に話せます。プレイログを物語の出来事のつながりに直して調べると、開発者が用意していなかった新しい展開が実際に生まれていました。新しい展開を多く生んだのは、発見や探索、試行錯誤ができるゲームをよく好む人たちでした。
研究チームは、こうしたやり取りがデザイナーへの手がかりになるとしています。会話ツリーでは拾えなかった「プレイヤーが本当はやりたかったこと」が、ログに残るからです。従来のゲームなら、NPCに「村長を説得して一緒に旅に出たい」と話しかけても、そのイベントが用意されていなければ何も起きません。生成AIを使えば、そこから新しい出来事を成り立たせられる可能性があります。
同じ考え方は特許にも表れています。Microsoftは2026年3月31日に米国特許US 12,589,308「Generative narrative game experience with player feedback」を取得し、7月2日には範囲を広げた継続出願US 2026/0183672 A1も公開されました。物語の出来事を点と線でつないだ「Narrative State Graph」を使い、プレイヤーの行動や盛り上がり具合から、新しい出来事を物語に足す仕組みです。請求項の違いはMicrosoftの生成AI物語特許の記事で詳しく比べています。
ここまで実現すれば、プレイヤーの立場は変わります。開発者が100本のルートを用意してプレイヤーが1本を選ぶのではなく、プレイヤーの行動が101本目のルートの材料になります。面白い展開が見つかれば、ほかのプレイヤーに届けるゲームの中身に取り込むことも視野に入ります。「共同創作」という言葉にいちばん近いのはこの部分です。
好みRushes、GPT-5でも次に選ぶ展開を当てられない
プレイヤーごとに物語を合わせるには、その人が次にどんな展開を面白がるかを見抜く必要があります。Microsoft Researchが2026年7月22日に公開した「Rushes」は、それがどれだけ難しいかを数字で示しました。
Rushesは、AIが作った分岐する物語の中で、人がどの展開を選んだかを記録したデータです。参加者はXboxの先行テスト「Xbox Insider」の利用者で、6本の物語ゲームで8,167人が4万4,226回の選択をしました。物語の文章と選択肢はあらかじめGPT-4oで作っておき、各場面でたいてい4つの選択肢から1つを選びます。4回選ぶと1日分が終わり、物語は翌日以降も続きます。
研究チームは、それまでの物語、選べる選択肢、その人の過去の選択を見せたうえで、その人が実際にどれを選んだかをAIに当てさせました。各ユーザーの選択を時系列に並べ、前の8割で学ばせて後ろの2割で試しています。
| 予測の方法 | 的中率 | 中身 |
|---|---|---|
| 行列分解(SVD) | 37.7% | 利用者と選択肢の傾向を数値化する、推薦システムの古典的な手法 |
| 人気順 | 36.4% | その場面でいちばん多く選ばれた選択肢を答えるだけ |
| GPT-5(過去の選択あり) | 34.2% | 物語・選択肢・その人の選択履歴を読ませて予測 |
| GPT-5(過去の選択なし) | 30.9% | 物語と選択肢だけで予測 |
| でたらめに選ぶ | 25.4% | 4択なら約25%になる基準 |
GPT-4oからGPT-5に替えても、履歴なしの的中率は30.3%から30.9%とほとんど変わりません。過去の選択を読ませると34.2%まで上がりますが、それでも人気順には届きませんでした。研究チームは、言語モデルが「誰にとっても無難な答え」を出すように調整されていて、「その人にとって面白い答え」を選ぶのが苦手なのではないかと考察しています。強いモデルでも、結局は多数派の好みに寄ってしまうという結論です。
履歴の種類による差も出ています。行列分解で比べると、同じゲームでの選択履歴を使ったときの的中率は38.9%、別のゲームでの履歴だと29.1%でした。ある物語での好みは、別の物語にそのまま持ち越せないということです。戦闘を選びがちな人が、別の作品でも戦闘を選ぶとは限りません。
この数字だけで「GPT-5はゲームの物語を作れない」とは言えません。Rushesが測っているのは物語の出来ではなく、個人の次の選択を当てられるかどうかです。参加者は英語で遊ぶXbox Insiderに限られ、ゲームに慣れた人に偏っていると著者自身が書いています。
もう1つ、作る側の現実も見えます。Rushesでは分岐が際限なく増えないよう、1日の終わりに残った展開を言語モデルで4つの大まかな方向にまとめ直してから翌日分を作っていました。そのため、翌日の最初の場面では展開のばらつきがいったん小さくなります。プレイヤーごとに無限に枝分かれする物語は、作る手間とつじつまの面でまだ現実的ではなく、どこかで枝をまとめる設計が必要です。
多様性いくらでも作れることと毎回面白いことは別の問題
生成AIは物語をいくらでも作れます。問題は、その中身が本当にばらけているかです。
Microsoft Researchの研究チームが2025年8月に米国科学アカデミー紀要(PNAS)で発表した「Echoes in AI」は、物語の筋の多様さを測りました。Redditに投稿された短編50本とWikipediaにあるテレビ番組各話のあらすじ50本、計100本を使い、物語の各場面でGPT-4とLlama 3にそれぞれ20通りの続きを書かせます。そのうえで、ある筋の要素が別の続きにどれだけ繰り返し出てくるかを数えました。
結果は、人が書いた物語のほうが筋の独自性がはっきり高く、AIの物語では同じような筋の要素が何度も出てくるというものでした。同じ要素は、別の言語モデルの出力にも繰り返し現れています。
ゲームにあてはめると、NPCに何を聞いても答えてくれて、サブクエストがいくらでも作られ、街に行くたびに新しい事件が起きる、というゲームは作れます。ただ、中身が「行方不明の人を探す」「裏切り者が見つかる」「実は誤解だった」のような似た型の繰り返しになれば、プレイヤーはいずれAIの癖を覚えてしまいます。量の多さと新しさは同じではありません。
制作ゲームデザイナー14人の実験でも「AIだけでは新しくならない」
作る側から見た研究でも、同じ限界が出ています。ブリティッシュコロンビア大学とMicrosoft Research、Microsoft Gamingなどのチームは、言語モデルでゲームの筋書き作りを手伝うツールを、ゲーム開発者やナラティブデザイナー14人に使ってもらいました。対象はターン制のゲームです。
参加者は生成された筋書きに5点満点で平均4点の満足度をつけ、物語を自分で動かしている感覚と自分の作品だという感覚には平均4.5点をつけました。一方で論文は、言語モデルが複雑で本当に新しい内容を作る力には限りがあると結論づけています。
Microsoft Researchが2023年に公開した「GENEVA」も、役割を分ける方向の研究です。デザイナーが物語の概要と、始まりや結末、筋の数などの条件を決め、GPT-4がその条件に沿って分岐する物語を作って図にします。
人が世界観やテーマ、キャラクター、大事な出来事を決め、AIがその間を埋める選択肢を広げる。この形なら「作者のいない無限生成ゲーム」ではなく、作者が作った世界の中でプレイヤーとAIが即興するゲームになります。2026年時点では、こちらのほうが現実的です。
検証自由にしすぎると進行が壊れる、全部を試せないゲームの検証
面白さとは別に、ゲームには守るべきルールがあります。鍵を手に入れていないのにNPCが「扉はもう開いている」と言ったり、死んだはずの人物について生きているように話したり、本来知らないはずの情報を教えたりすれば、会話の違和感では済まず、ゲームの進行そのものが壊れます。
Microsoft Researchの研究者らは2024年の論文で、こうした問題を扱っています。言語モデルにはでっち上げ、物忘れ、指示の読み違えといった弱点があり、それが話のつじつまの合わなさや、作り手の意図から外れた展開を生みます。論文では、Dejaboom!のプレイログから、言語モデルを使ってこの種のバグを自動で見つける方法を提案しました。プレイヤーがアンケートで報告した7件のバグのうち、5件をこの方法で見つけています。
従来のゲームなら「このボタンを押せばこの文章が出る」と1つずつ確かめられます。生成AIでは、同じ質問をしても毎回同じ答えが返るとは限らず、全部の台詞を人が事前に読むこともできません。プレイヤーが共同作者になるということは、作り手から見れば発売前にすべての展開を確かめられないゲームを出すということでもあります。物語の生成を大きなゲームに入れるほど、この問題は重くなります。
影響プレイヤーが共同作者になると攻略やレビューも変わる
物語の生成が本格的に入れば、ゲームの周りの文化にも影響が出ます。これまでのRPGなら「このNPCに話しかけて選択肢Bを選べばサブクエストが始まる」という攻略情報をみんなで共有できました。会話の中身やそれまでの行動でクエストが変わるなら、別の人が同じ操作をしても同じ結果になるとは限りません。
攻略情報は「正解を教えるもの」から、「AIがどの情報を見て判断しているか」「どんな条件ならその展開が起きやすいか」を調べて伝えるものに変わっていくはずです。配信との相性も変わり、配信者ごとにNPCとの関係や起きる出来事が違えば、他人のプレイを見る理由が増えます。
一方でレビューは難しくなります。レビュアーが体験した素晴らしい展開が、買った人にも起きるとは限らないからです。生成AIは中身だけでなく、「同じゲームをみんなで遊んでいる」という前提も少しずつ変えていきます。
- NPCとの雑談や仲間の反応が、用意された数パターンを超えて広がる
- 過去の試合や会話を覚えた仲間が、遊ぶたびに違う声をかけてくる
- 想定外の行動にもNPCが付き合い、自分だけの出来事が生まれる
- 多くの人が面白がった展開を、作り手が正式な中身として取り込める
- 好みの予測はまだ人気順にも届かず、自分向けの物語になるとは限らない
- AIが作る筋は似た型を繰り返しやすい
- つじつまの合わない台詞で進行が止まるおそれがある
- 手元で動かすならGeForce RTXとVRAMの余裕、クラウドなら追加料金が要る
配信Steamは「プレイ中に生成するゲーム」を別枠で扱っている
販売の側も、プレイ中にAIが中身を作るゲームを前提にした決まりを用意しています。Steamは開発者向けのコンテンツアンケートで、生成AIの使い方を「事前生成」と「ライブ生成」に分けています。ライブ生成は、ゲームの実行中にAIで作られるコンテンツのことです。ライブ生成を使う開発者は、AIが違法なコンテンツを作らないための対策(ガードレール)も申告しなければなりません。
同じ資料のよくある質問には、外部の生成AIサービスにつなぐと入力や出力のたびに費用がかかり続ける、という相談への答えが載っています。費用をゲーム本体の価格に含める、使った分をゲーム内課金にする、使い放題のサブスクリプションにする、1回買えば使い放題になるDLCにする、という4つの回収方法が挙げられ、支払いはSteamが対応する方法で受け取るよう求めています。
プレイヤーからは見えにくい部分ですが、NPCが毎日何千人と話すなら、その計算を誰がどこで払うかという問題が必ず出てきます。クラウドで動かせばサーバー代がかかり続け、プレイヤーのPCで動かせばCPU、GPU、メモリに余裕が要ります。
PUBG Allyはこの問題にプレイヤーのPCで動かす答えを出しました。KRAFTONはクラウドの言語モデルも試しましたが、通信と推論の遅れが重なり、試合中の掛け合いには遅すぎると判断しています。1回のやり取りにかかった時間は、手元のPCで約1.6秒、クラウド構成で約3.4秒でした。
採用したのは20億パラメータの小型モデル「Mistral-NeMo-Minitron-2B」で、さらに軽く圧縮し、PUBG本体が使った残りのVRAMに収めています。マップをサノックに絞り、PUBGの用語やアイテムの知識だけを大きなモデルから教え込んだのも、小さなモデルで動かすための工夫です。
確認AI NPCのゲームを遊ぶ前に確かめたいこと
手元のGPUで動く2つの例を並べると、必要な環境の傾向が見えます。どちらもNVIDIAのAI NPC技術「ACE」を使っています。PUBG AllyはGeForce RTXを積んだPCでしか選べず、Smart Zoiも2025年3月に出た公式の要件にはGeForce RTXしか載っていません(その後はMac版でも使えるようになっています)。WindowsのPCでAMDやIntelのGPUを使っている人は注意が要ります。
| 項目 | PUBG Ally(Ally Duo β) | inZOIのSmart Zoi |
|---|---|---|
| 最低限のGPU | RTX 2080 Ti / RTX 3060(VRAM 8GB) | RTX 3060(VRAM 8GB) |
| 推奨のGPU | RTX 4070(VRAM 12GB) | RTX 5070 / RTX 4070 SUPER(VRAM 12GB) |
| メモリ(最低→推奨) | 16GB → 24GB | 12GB → 16GB |
| そのほかの条件 | ドライバー555.85以降、ハードウェアアクセラレータによるGPUスケジューリングを有効化 | インターネット接続が必要 |
| 提供状況 | βは7月1日に終了(10月6日時点で正式実装の発表なし) | 早期アクセス中のinZOIで、設定から有効にして使う |
パッチノートでは、Ellaの返事が遅いと感じたらグラフィック設定や解像度を下げるよう案内しています。ゲームの描画とAIが同じGPUを使うためです。どちらも推奨はVRAM 12GBなので、AI NPCを快適に試したいなら12GB以上がひとつの目安です。
- Steamストアの「AI生成コンテンツの開示」を読み、プレイ中にAIが文章や会話を作るかどうかを確かめる。開示欄には開発者が書いた説明がそのまま載っています
- 手元のPCで動かす方式なら、対応GPUのメーカーとVRAMを見る。PUBG AllyはGeForce RTX専用で、PUBG AllyとSmart Zoiの推奨はどちらもVRAM 12GBでした
- クラウドにつなぐ方式なら、追加料金の形(ゲーム内課金・サブスクリプション・DLC)と、オフラインでも遊べるかを確かめる
おすすめAI NPCを手元で試すならVRAM 12GB以上のGeForce
PUBG AllyとSmart Zoiの推奨に合わせると、VRAM 12GB以上のGeForce RTX 50シリーズが候補になります。ゲームの画質を上げながらAIにもVRAMを回したい人はRTX 5060 Tiの16GB版、描画の速さも重視するならRTX 5070です。
FAQよくある質問
まとめまとめ|作者は消えず「AIとプレイヤーが遊べる範囲」を設計する側に回る
2026年時点で、AIが毎回まったく新しい大作をその場で作る世界には届いていません。自由に話せるNPCは実際のゲームに入り、状況を読んで動くキャラクターもPUBG AllyやSmart Zoiで試せるようになりました。Microsoftはさらに先の、プレイヤーの行動から新しい物語を見つけてゲームを育てる研究と特許を進めています。
一方で、AIが作る物語は似た筋を繰り返しやすく、プレイヤーが次に何を面白がるかはGPT-5でも人気順の予測に届きません。つじつまの合わない展開をどう検証するかという課題も残ります。当面は、人のデザイナーが世界観やルール、キャラクター、大事な出来事を作り、AIがその間を即興で埋め、プレイヤーの行動でどの部分が膨らむかが決まる、という三者の分担になります。
プレイヤーも完全な作者にはなりませんが、作り手が書いていなかった出来事を自分の言葉と行動で生み出せる分、これまでより創作の側に近づきます。試すなら、Steamの開示欄でライブ生成かどうかを確かめ、手元で動く方式ならVRAM 12GB以上のGeForce RTXを用意するのが確実です。





