1.0
可玩
参与者交互式场景生成
和观众一起探索房间级场景:拨铃、展开地图,场景随操作回应。音视频持续生成,切换视角再回来,刚才的变化依然延续。
EVERWORLD
实时互动空间视频模型
探索场景、操作物品、与角色交流。你的输入决定接下来发生的事。

互动直播与互动影游
观众共同选择,让剧情转向。
进入角色,用行动与对话改变下一幕。
版本路线
和观众一起探索房间级场景:拨铃、展开地图,场景随操作回应。音视频持续生成,切换视角再回来,刚才的变化依然延续。
用自然语言构建更大的连通场景,从补给店扩展到街区、码头和灯塔。即时创建可交互对象,修改布局与规则,再进入试玩。
边探索边与向导交流,随时插话、调整路线。角色记得经历、比较行动后果,并围绕各自目标协作,持续推动场景演化。
架构

建立持续、一致的交互体验
在有限空间中与生成内容互动,让场景状态、空间几何和视听内容持续连贯。
有限空间互动 · 状态与几何一致 · 持续音视频生成让场景可创建、可编辑、可执行
创建、编辑并运行大规模场景,让物理、技能与事件按规则执行。
多模态创建与编辑 · 可执行场景规则 · 执行验证与修订让角色有记忆、有目标、会决策
与角色实时交流,让角色基于记忆、目标和所见环境自主选择行动。
实时多模态交互 · 记忆与目标驱动 · 行动推演与评价持续状态与长期记忆、空间感知与几何一致性、多模态理解与联合音视频生成。1.0 建立底座,2.0 与 3.0 继承并扩展。
候选行动 → 独立分支推演 → 评价选择 → 正式执行。3.0 复用 2.0 场景执行能力,推演不改写正式场景。
加入我们
欢迎参与模型、运行时、评测和交互体验的开发。
wenxiang@zju.edu.cn