Research
← 返回产品总览
04 · Research

故事自己生长,世界依然为真。

我们做的是没有人写剧本的 LLM 游戏世界:角色带着私有情报自由行动,世界代理持有正典状态、校验每一个后果、收束每一个回合。这几篇论文,就是 WorldLines 背后的理论。

一条论证,三个证明—定义世界→扩成一群 agent→证明是架构说了算
01 · Define
PUBLISHED · CHI PLAY COMPANION '26 ACM · DOI 10.1145/3800965.3834285 · arXiv:2606.16014

From Character Role-Play to Orchestrated Reality: LLM-Driven Game World Simulation as a Parameterized-Action POMDP

Yuhang Huang, Chenmiao Li (The University of Tokyo) · Chaowei Fang (Independent)

大多数 LLM 角色扮演把连续性藏在对话历史里。我们把它当成一个架构选择:世界是由单一编排代理——一位 Game Master——持有的正典对象。我们把游戏世界形式化为参数化动作 POMDP(状态是正典 JSON 实体树,行动是意图 + 结构化参数),转移由 Plan–Diff–Validate–Apply 流水线驱动,只提交过了 schema 校验、带内容哈希的增量。世界自己记得——旁白说什么都改变不了。

soul α soul β soul γ propose Plan Diff Validate Apply ✗ invalid → bounced, never committed world state ├─ places · actors ├─ inventory · wounds └─ promises · ledger canonical JSON · content-hashed
概念 · 只有一支笔——每个行动过了校验,才成为世界状态
Live terminal session from the paper: the narrator opens a scene in Stoneford while the world agent reports canonical state — day, time, HP, gold, map position
论文实机 · 旁白负责演,世界代理负责记账
02 · Scale
PRESENTED · SEP 2026 IPSJ Entertainment Computing 2026, Kyoto — oral + playable demo

Multi-Agent LLM Simulation for Living Game Worlds: Coordinating World, Soul, and Player Agents over a Pub/Sub Message Bus

「"生きた"ゲーム世界のためのマルチエージェントLLMシミュレーション」— with the playable multi-agent world 時間陣 (Jikanjin)

Yuhang Huang, Chenmiao Li (The University of Tokyo, equal contribution) · Chaowei Fang (Independent)

一个 prompt 同时演旁白、角色和裁判,正是长局崩坏的原因。这篇系统论文把工作拆给三种在 pub/sub 消息总线上对等相遇的 agent:持有正典状态、收束每回合的世界代理;各有人格、记忆与盘算的 M 个并发 soul 代理;为每位玩家渲染私有视角的 N 个玩家代理。soul 跑在有界池里;世界代理是唯一写者,逐回合提交经 schema 校验的状态。代理之间只交换与传输无关的 JSON——分布式是设计进去的,不是后补的。

world agent single writer · closes each turn pub / sub message bus · transport-agnostic JSON soul agents ×M · bounded pool player agents ×N · a private view per player
概念 · 三种角色对等相遇——落笔的只有世界代理
WorldLines hub: Elena, Rowan, and the player agent each with their own feed and avatar, the world agent narrating, and the agent map tracking who is where
Hub 实况 · 每个灵魂都是独立 agent——世界代理旁白,agent 地图追踪全员
03 · Prove
WORKING PAPER · UNDER REVIEW 2026

RP-Worlds: An Architecture for Unbounded yet Consistent World Simulation via PA-POMDP

玩的过程会扩张正典世界本身——经校验的世界生长,不漂移

Ludic Dynamics research · details withheld during anonymous review

世界生长——模拟中出现新的可操作实体——一直被当成无约束的生成,而不是经校验的状态转移。LLM 智能体世界在结构上是固定的:实体集在构建时冻结,状态会变,世界长不大;自由文本的 LLM 世界会生长,却因没有经校验的正典状态而漂移。我们提出 RP-world:以游玩为中心的智能体世界模拟,交互扩张的是正典世界本身。一个世界代理——带类型实体树的唯一写者,形式化为参数化动作 POMDP——与 M 个只拥有自己心智的 soul 代理对弈;当游玩推出地图之外,它提出新的地点、居民、关系,只在提交时校验通过后才纳入,因此正典状态可证明不会积累矛盾。六个完整故事世界、三个模型家族:校验消除状态矛盾,而去掉校验的同一架构普遍漂移;有效状态维度(ESD)越过固定抽取框架的实体天花板而矛盾保持为零;只看文本的 LLM 评审却仍偏爱漂移的基线——流畅的文字掩盖了状态漂移。漂移是架构问题,不是模型局限。

turn 1 turn 200 state drift prompt-only · drift compounds commit-time validation · ~10× lower, flat gap = architecture, not scale
示意草图——不是论文原图 · 定量结果等评审结束解锁
从论文到产品 这些论文研究的同一套运行时,正驱动着 WorldLines 的三件事:有自己一天的独立人格 agent、Living Canvas 活画布、世界模拟引擎——引擎正在开源(起始世界与 web 壳已在 GitHub,AGPL)。