EVERWORLD

下一幕因你而变

实时互动空间视频模型

探索场景、操作物品、与角色交流。你的输入决定接下来发生的事。

从工坊互动,到海港空间编排,再到自主角色协作:1.0 可玩、2.0 可编排、3.0 可演化。

互动直播与互动影游

把探索的自由,交给玩家

互动直播

观众共同选择,让剧情转向。

互动影游

进入角色,用行动与对话改变下一幕。

版本路线

可玩 · 可编排 · 可演化

1.0

可玩

参与者

交互式场景生成

和观众一起探索房间级场景:拨铃、展开地图,场景随操作回应。音视频持续生成,切换视角再回来,刚才的变化依然延续。

2.0

可编排

创造者

大规模空间编排

用自然语言构建更大的连通场景,从补给店扩展到街区、码头和灯塔。即时创建可交互对象,修改布局与规则,再进入试玩。

3.0

可演化

协作者

智能体驱动的场景演化

边探索边与向导交流,随时插话、调整路线。角色记得经历、比较行动后果,并围绕各自目标协作,持续推动场景演化。

架构

产品能力演进与共享底座

1.0 交互生成、2.0 空间编排与 3.0 智能体演化,共享持续状态、空间感知和联合音视频生成底座。候选行动先在独立分支中推演与评价,再进入正式执行。

1.0 / 交互生成

建立持续、一致的交互体验

在有限空间中与生成内容互动,让场景状态、空间几何和视听内容持续连贯。

有限空间互动 · 状态与几何一致 · 持续音视频生成

2.0 / 空间编排

让场景可创建、可编辑、可执行

创建、编辑并运行大规模场景,让物理、技能与事件按规则执行。

多模态创建与编辑 · 可执行场景规则 · 执行验证与修订

3.0 / 智能体演化

让角色有记忆、有目标、会决策

与角色实时交流,让角色基于记忆、目标和所见环境自主选择行动。

实时多模态交互 · 记忆与目标驱动 · 行动推演与评价

共享技术底座

持续状态与长期记忆、空间感知与几何一致性、多模态理解与联合音视频生成。1.0 建立底座,2.0 与 3.0 继承并扩展。

先推演,再执行

候选行动 → 独立分支推演 → 评价选择 → 正式执行。3.0 复用 2.0 场景执行能力,推演不改写正式场景。

产品能力演进与共享底座查看完整产品总览图 ↗
阅读技术文档

加入我们

一起实现下一代互动视频

欢迎参与模型、运行时、评测和交互体验的开发。

wenxiang@zju.edu.cn

声音默认关闭,可通过播放器开启。

制作说明

场景与声音使用 GPT Image 2 和 Seedance 制作,配合界面动画、角色对白和字幕展示产品使用过程。