Research
← 제품 한눈에로 돌아가기
04 · Research

이야기는 스스로 자라도, 세계는 참으로 남는다.

아무도 플롯을 쓰지 않는 LLM 게임 세계를 만듭니다. 캐릭터는 사적인 정보로 자유롭게 행동하고, 월드 에이전트가 정본 상태를 쥐고 모든 결과를 검증하며 매 턴을 마감합니다. 이 논문들이 WorldLines 뒤에 있는 이론입니다.

하나의 논증, 세 가지 증명—세계를 정의→에이전트 무리로 확장→아키텍처가 결정함을 증명
01 · Define
PUBLISHED · CHI PLAY COMPANION '26 ACM · DOI 10.1145/3800965.3834285 · arXiv:2606.16014

From Character Role-Play to Orchestrated Reality: LLM-Driven Game World Simulation as a Parameterized-Action POMDP

Yuhang Huang, Chenmiao Li (The University of Tokyo) · Chaowei Fang (Independent)

대부분의 LLM 롤플레이는 연속성을 대화 기록에 암묵적으로 둡니다. 우리는 이를 아키텍처 선택으로 다룹니다. 세계는 단일 오케스트레이션 에이전트 — 게임 마스터 — 가 쥔 정본 객체입니다. 게임 세계를 매개변수화 행동 POMDP(상태=정본 JSON 엔티티 트리, 행동=의도+구조화된 매개변수)로 형식화하고, 전이는 스키마 검증·내용 해시를 거친 델타만 커밋하는 Plan–Diff–Validate–Apply 파이프라인이 구동합니다. 세계는 스스로 기억합니다 — 내레이터가 뭐라 하든.

soul α soul β soul γ propose Plan Diff Validate Apply ✗ invalid → bounced, never committed world state ├─ places · actors ├─ inventory · wounds └─ promises · ledger canonical JSON · content-hashed
개념도 · 펜은 하나뿐 — 검증을 통과한 행동만 세계 상태가 된다
Live terminal session from the paper: the narrator opens a scene in Stoneford while the world agent reports canonical state — day, time, HP, gold, map position
논문에서 · 내레이터는 그리고, 월드 에이전트는 장부를 쓴다
02 · Scale
PRESENTED · SEP 2026 IPSJ Entertainment Computing 2026, Kyoto — oral + playable demo

Multi-Agent LLM Simulation for Living Game Worlds: Coordinating World, Soul, and Player Agents over a Pub/Sub Message Bus

「"生きた"ゲーム世界のためのマルチエージェントLLMシミュレーション」— with the playable multi-agent world 時間陣 (Jikanjin)

Yuhang Huang, Chenmiao Li (The University of Tokyo, equal contribution) · Chaowei Fang (Independent)

하나의 프롬프트가 내레이터·캐릭터·심판을 동시에 연기하는 것 — 긴 세션이 무너지는 이유입니다. 이 시스템 논문은 그 일을 pub/sub 메시지 버스에서 대등하게 만나는 세 종류의 에이전트로 나눕니다. 정본 상태를 쥐고 매 턴을 마감하는 월드 에이전트, 저마다의 인격·기억·속셈을 가진 M개의 병렬 소울 에이전트, 플레이어마다 사적 뷰를 그리는 N개의 플레이어 에이전트. 소울은 유계 풀에서 돌고, 월드 에이전트가 유일한 기록자로 스키마 검증된 턴을 커밋합니다. 에이전트 간에는 전송 독립적인 JSON만 오갑니다 — 분산은 나중에 붙인 게 아니라 설계에 들어 있습니다.

world agent single writer · closes each turn pub / sub message bus · transport-agnostic JSON soul agents ×M · bounded pool player agents ×N · a private view per player
개념도 · 세 역할이 대등하게 만난다 — 기록은 월드 에이전트만
WorldLines hub: Elena, Rowan, and the player agent each with their own feed and avatar, the world agent narrating, and the agent map tracking who is where
Hub 라이브 · 모든 소울이 독립 에이전트 — 월드 에이전트가 서술하고, 에이전트 맵이 전원을 추적
03 · Prove
WORKING PAPER · UNDER REVIEW 2026

RP-Worlds: An Architecture for Unbounded yet Consistent World Simulation via PA-POMDP

플레이가 정전 세계 자체를 확장한다 — 검증된 세계 성장, 드리프트 없음

Ludic Dynamics research · details withheld during anonymous review

세계 성장 — 시뮬레이션 중 조작 가능한 새 개체가 나타나는 것 — 은 지금껏 검증된 상태 전이가 아니라 제약 없는 생성으로 다뤄져 왔다. LLM 에이전트 세계는 구조적으로 고정되어 있다: 개체 집합은 구축 시 동결되어 상태는 변해도 세계는 자라지 않는다. 자유 형식 LLM 세계는 자라지만 검증된 정전 상태가 없어 드리프트한다. 우리는 RP-world를 제안한다: 플레이 중심 에이전트 세계 시뮬레이션으로, 상호작용이 정전 세계 자체를 확장한다. 세계 에이전트 — 타입 개체 트리의 유일한 작성자, 매개변수화 행동 POMDP로 정식화 — 가 자기 마음만 가진 M개의 소울 에이전트와 마주한다. 플레이가 지도 밖으로 나가면 새 장소·주민·관계를 제안하고 커밋 시 검증을 통과한 것만 받아들이므로 정전 상태는 증명 가능하게 모순을 쌓지 않는다. 여섯 개의 완결 서사 세계와 세 모델 계열에서: 검증은 상태 모순을 없애고, 검증 없는 동일 아키텍처는 예외 없이 드리프트한다. 유효 상태 차원(ESD)은 고정 추출 프레임워크의 개체 상한을 넘으면서도 모순은 0을 유지한다. 그런데 텍스트만 보는 LLM 심사자는 여전히 드리프트하는 기준선을 선호한다 — 유려한 문장이 상태 드리프트를 가린다. 드리프트는 아키텍처의 문제이지 모델의 한계가 아니다.

turn 1 turn 200 state drift prompt-only · drift compounds commit-time validation · ~10× lower, flat gap = architecture, not scale
개념 스케치 — 논문 그림이 아닙니다 · 정량 결과는 심사 종료까지 비공개
논문에서 제품으로 이 논문들이 연구하는 바로 그 런타임이 WorldLines의 세 가지를 움직입니다: 자기 하루를 가진 캐릭터 에이전트, Living Canvas, 세계 시뮬레이션 엔진 — 엔진은 오픈소스 공개 진행 중(시작 세계와 웹 셸은 이미 GitHub, AGPL).