01 · Define
PUBLISHED · CHI PLAY COMPANION '26
ACM · DOI 10.1145/3800965.3834285 · arXiv:2606.16014
From Character Role-Play to Orchestrated Reality: LLM-Driven Game World Simulation as a Parameterized-Action POMDP
Yuhang Huang, Chenmiao Li (The University of Tokyo) · Chaowei Fang (Independent)
多くの LLM ロールプレイは連続性を対話履歴に暗黙のまま置いています。私たちはそれをアーキテクチャの選択として扱います。世界は単一のオーケストレーションエージェント——ゲームマスター——が持つ正典オブジェクト。ゲーム世界をパラメータ化行動 POMDP (状態=正典 JSON エンティティの木、行動=意図+構造化パラメータ)として形式化し、遷移は Plan–Diff–Validate–Apply パイプラインが駆動、スキーマ検証済み・内容ハッシュ付きの差分だけをコミットします。世界は自分で覚えている——語り手が何を言おうと。
soul α
soul β
soul γ
propose
Plan
Diff
Validate
Apply
✗ invalid → bounced, never committed
world state
├─ places · actors
├─ inventory · wounds
└─ promises · ledger
canonical JSON · content-hashed
概念図 · 筆は一本だけ——検証を通った行動だけが世界状態になる
論文より · 語り手は描き、世界エージェントは帳簿をつける
02 · Scale
PRESENTED · SEP 2026
IPSJ Entertainment Computing 2026, Kyoto — oral + playable demo
Multi-Agent LLM Simulation for Living Game Worlds: Coordinating World, Soul, and Player Agents over a Pub/Sub Message Bus
「"生きた"ゲーム世界のためのマルチエージェントLLMシミュレーション」— with the playable multi-agent world 時間陣 (Jikanjin)
Yuhang Huang, Chenmiao Li (The University of Tokyo, equal contribution) · Chaowei Fang (Independent)
一つのプロンプトが語り手・キャラクター・審判を同時に演じる——長いセッションが崩れる理由はそこにあります。このシステム論文は仕事を、pub/sub メッセージバス上で対等に出会う三種のエージェントに分けます。正典状態を持ち毎ターンを締める世界エージェント 、それぞれの人格・記憶・思惑を持つ M 体の並行ソウルエージェント 、プレイヤーごとに私的ビューを描く N 体のプレイヤーエージェント 。ソウルは有界プールで走り、世界エージェントが唯一の書き手としてスキーマ検証済みのターンをコミット。エージェント間はトランスポート非依存の JSON のみ——分散は後付けではなく設計に織り込まれています。
world agent
single writer · closes each turn
pub / sub message bus · transport-agnostic JSON
soul agents
×M · bounded pool
player agents
×N · a private view per player
概念図 · 三役が対等に出会う——書けるのは世界エージェントだけ
Hub 実況 · どのソウルも独立したエージェント——世界エージェントが語り、エージェントマップが全員を追う
03 · Prove
WORKING PAPER · UNDER REVIEW
2026
RP-Worlds: An Architecture for Unbounded yet Consistent World Simulation via PA-POMDP
プレイが正典世界そのものを拡張する——検証された世界の生長、ドリフトなし
Ludic Dynamics research · details withheld during anonymous review
世界の生長——シミュレーション中に操作可能な新しい実体が現れること——は、これまで検証された状態遷移ではなく無制約の生成として扱われてきた。LLM エージェント世界は構造的に固定 されている:実体集合は構築時に凍結され、状態は変わっても世界は育たない。自由形式の LLM 世界は育つが、検証された正典状態を欠くためドリフト する。私たちは RP-world を提案する:プレイ中心のエージェント世界シミュレーションで、相互作用が正典世界そのものを広げる。世界エージェント ——型付き実体木の唯一の書き手、パラメータ化行動 POMDP として定式化——が、自分の心だけを持つ M 体のソウルエージェントと向き合う。プレイが地図の外へ出ると、新しい場所・住人・関係を提案し、コミット時検証を通ったものだけを受け入れるため、正典状態は証明可能に矛盾を蓄積しない。六つの物語完結世界と三つのモデル系列で:検証は状態矛盾を消し、検証なしの同一アーキテクチャは例外なくドリフトする。有効状態次元(ESD)は固定抽出フレームワークの実体上限を超えつつ矛盾はゼロのまま。しかしテキストだけを見る LLM 審査員はドリフトする基線を好む——流暢な文章が状態のドリフトを隠す。ドリフトはアーキテクチャの問題であり、モデルの限界ではない。
turn 1
turn 200
state drift
prompt-only · drift compounds
commit-time validation · ~10× lower, flat
gap = architecture, not scale
概念スケッチ——論文の図ではありません · 定量結果は査読終了まで非公開