Orbis 是 Visko 推出的基础生成模型,也是其世界生成产品线的核心底座,生成可交互的动态世界并实现实时流式输出。用户可以通过文字选择、语音输入等方式决定剧情走向与场景变化,也可以在开放沙盒中自由探索各类创意想法。模型输出的不是固定时长的视频片段,而是能实时响应输入的完整世界环境,所有操作指令都会立刻反映在画面中,适配叙事创作、模拟测试、创意探索等多类使用场景。

Orbis特点
实时流式生成画面,输入指令后场景动态变化同步输出,不需要等待完整片段渲染完成,交互过程流畅无停顿。
多模态输入支持,纯文本描述就能生成对应世界,也可以参考图片内容还原场景风格与元素,适配不同的创作起步方式。
强交互属性,世界内的元素与剧情走向可由用户实时干预,选择不同分支、输入新指令都会立刻作用于场景,而非预设好的固定内容。
开放探索空间,支持自由形式的创意玩法,用户可以输入任意想法展开场景,不受预设剧情与场景模板的限制。
Orbis项目地址
- 项目官网:https://www.visko.ai/models
Orbis技术原理
模型采用端到端的世界建模架构,将场景元素、物理规则、角色动作与叙事逻辑统一编码到参数体系中。不同于逐帧生成的视频模型,它先构建三维世界空间,再基于视角实时渲染画面流,所有交互指令直接作用于世界空间本身,画面输出同步跟随变化。
训练阶段融入大量场景、叙事与物理运动数据,让世界内的物体运动、角色行为符合真实逻辑,同时保证不同输入下的场景衔接自然。实时渲染层面做了计算路径优化,保证交互指令下达后画面快速响应,维持流式输出的流畅度。
Orbis功能
文本转世界,输入文字描述即可生成对应的动态场景与完整世界环境,支持场景风格、元素、剧情的自定义设置。
图像转世界,上传参考图片后,模型可参照图片的视觉风格、场景结构生成对应的可交互世界,还原视觉特征。
剧情分支选择,提供预设选项供用户决定故事走向,也支持自定义输入后续剧情,场景会跟随指令实时推进。
语音驱动场景,朗读文本内容即可触发对应画面生成,语音输入与画面输出同步进行,实现说什么就出现什么的效果。
自由创作沙盒,无固定任务与剧情限制,用户可随意输入想法探索模型的生成能力,尝试各类创意场景。
Orbis应用场景
互动叙事创作。创作者可以用它制作互动式故事、互动影视内容,快速生成不同剧情分支的对应场景,比如灾难瞬间、城市街景、空间站外景等特定情境,大幅降低互动内容的制作成本,也可以直接用于创意原型验证。
机器人仿真测试。研发团队可在生成的真实场景中训练和测试机器人,模拟不同环境下的任务执行与应急反应,在进入真实场景前完成充分的虚拟验证。
创意内容探索。设计师、编剧等创作者可以在沙盒中快速验证创意想法,直观看到场景呈现效果,辅助灵感发散与方案筛选。
教育与培训场景。可生成对应主题的虚拟场景,用于知识讲解、技能培训,学员可以在场景中互动操作,提升学习的沉浸感与实践效果。
娱乐内容制作。用于直播互动、互动游戏等内容场景,观众可以参与剧情走向,提升内容的参与感与趣味性。
Orbis同类产品对比
表格
| 对比维度 | Orbis(Visko) | Sora 2(OpenAI) |
|---|---|---|
| 研发主体 | Visko | OpenAI |
| 模型定位 | Live Model 实时流式世界视频模型,支持不间断长时交互式视频流生成,可生成小时级连续画面 | 离线式片段生成视频基础模型,面向高质量成片短视频输出,传统提示词生成完整视频片段 |
| 核心特色 | 实时流式输出 4K 24fps,生成过程中可随时修改提示词,内置持久场景记忆,长时生成画面漂移低,具备物理动力学约束 | 单轮提示词产出高质量视频片段,画面细节、光影质感表现优秀;生成完成输出完整文件,中途无法动态干预画面 |
| 适用场景 | 交互式虚拟场景、实时数字内容、虚拟直播、仿真环境、长叙事互动内容创作 | 影视短片、广告素材、短视频成片、概念视觉素材,需要产出完整独立视频片段的创作场景 |
© 版权声明
文章版权归作者所有,未经允许请勿转载。
相关文章
暂无评论...



