01 · Define
PUBLISHED · CHI PLAY COMPANION '26
ACM · DOI 10.1145/3800965.3834285 · arXiv:2606.16014
From Character Role-Play to Orchestrated Reality: LLM-Driven Game World Simulation as a Parameterized-Action POMDP
Yuhang Huang, Chenmiao Li (The University of Tokyo) · Chaowei Fang (Independent)
大多数 LLM 角色扮演把连续性藏在对话历史里。我们把它当成一个架构选择:世界是由单一编排代理——一位 Game Master——持有的正典对象。我们把游戏世界形式化为参数化动作 POMDP(状态是正典 JSON 实体树,行动是意图 + 结构化参数),转移由 Plan–Diff–Validate–Apply 流水线驱动,只提交过了 schema 校验、带内容哈希的增量。世界自己记得——旁白说什么都改变不了。
概念 · 只有一支笔——每个行动过了校验,才成为世界状态
论文实机 · 旁白负责演,世界代理负责记账
02 · Scale
PRESENTED · SEP 2026
IPSJ Entertainment Computing 2026, Kyoto — oral + playable demo
Multi-Agent LLM Simulation for Living Game Worlds: Coordinating World, Soul, and Player Agents over a Pub/Sub Message Bus
「"生きた"ゲーム世界のためのマルチエージェントLLMシミュレーション」— with the playable multi-agent world 時間陣 (Jikanjin)
Yuhang Huang, Chenmiao Li (The University of Tokyo, equal contribution) · Chaowei Fang (Independent)
一个 prompt 同时演旁白、角色和裁判,正是长局崩坏的原因。这篇系统论文把工作拆给三种在 pub/sub 消息总线上对等相遇的 agent:持有正典状态、收束每回合的世界代理;各有人格、记忆与盘算的 M 个并发 soul 代理;为每位玩家渲染私有视角的 N 个玩家代理。soul 跑在有界池里;世界代理是唯一写者,逐回合提交经 schema 校验的状态。代理之间只交换与传输无关的 JSON——分布式是设计进去的,不是后补的。
概念 · 三种角色对等相遇——落笔的只有世界代理
Hub 实况 · 每个灵魂都是独立 agent——世界代理旁白,agent 地图追踪全员
03 · Prove
WORKING PAPER · UNDER REVIEW
2026
RP-Worlds: An Architecture for Unbounded yet Consistent World Simulation via PA-POMDP
玩的过程会扩张正典世界本身——经校验的世界生长,不漂移
Ludic Dynamics research · details withheld during anonymous review
世界生长——模拟中出现新的可操作实体——一直被当成无约束的生成,而不是经校验的状态转移。LLM 智能体世界在结构上是固定的:实体集在构建时冻结,状态会变,世界长不大;自由文本的 LLM 世界会生长,却因没有经校验的正典状态而漂移。我们提出 RP-world:以游玩为中心的智能体世界模拟,交互扩张的是正典世界本身。一个世界代理——带类型实体树的唯一写者,形式化为参数化动作 POMDP——与 M 个只拥有自己心智的 soul 代理对弈;当游玩推出地图之外,它提出新的地点、居民、关系,只在提交时校验通过后才纳入,因此正典状态可证明不会积累矛盾。六个完整故事世界、三个模型家族:校验消除状态矛盾,而去掉校验的同一架构普遍漂移;有效状态维度(ESD)越过固定抽取框架的实体天花板而矛盾保持为零;只看文本的 LLM 评审却仍偏爱漂移的基线——流畅的文字掩盖了状态漂移。漂移是架构问题,不是模型局限。
示意草图——不是论文原图 · 定量结果等评审结束解锁