Odyssey-3 – 新一代基础世界模型

Odyssey-3 是 Odyssey 实验室推出的基础世界模型,分为标准版与 Pro 版本,Pro 版本在 Physics-IQ Verified 基准测试拿到 66.1 分,刷新该榜单记录。模型依托海量视觉观测数据学习物理规律、物体动力学与因果逻辑,接收文本提示或者画面输入,实时生成交互式虚拟环境。环境内物体会跟随动作指令产生符合现实规则的运动变化,支持第一人称、第三人称视角切换与自由相机移动。模型产出的虚拟场景可直接用于机器人、人形设备、无人机、自动驾驶等智能体的策略训练,少量场景样本即可完成新任务适配。

Odyssey-3 - 新一代基础世界模型

Odyssey-3特点

区分多档位模型规格,标准版输出 480p 画面,Pro 版本支持 720p,物理预测精度更高。

对物理现象的还原贴合现实规则,流体、刚体、光学、热力学等场景下物体交互不会出现违背常识的运动。

交互式场景实时响应,动作输入后画面同步演化,支持用户持续干预场景内事件走向。

跨硬件平台泛化能力强,同一模型产出的仿真环境,可迁移到不同类型实体设备训练。

浏览器预览版本开放体验,无需本地部署硬件,网页端直接体验场景生成与交互。

Odyssey-3技术原理

采用自回归扩散变换器架构,把世界建模视作动态时序生成任务。模型读取历史画面与动作信息,预测下一时刻环境状态,逐帧推演场景变化。训练阶段摄入大量真实世界视觉素材,学习物体之间的作用关系,建立物理规则的隐式表征。扩散模块负责画面细节生成,自回归链路管控时序逻辑,保障长序列场景推演保持一致性。任务训练使用少量目标场景样本,依托已经习得的世界知识快速适配新环境。

Odyssey-3功能

交互式虚拟环境生成,输入文本描述构建三维可交互场景。

时序物理状态预测,给定初始画面,预判物体后续运动与场景演变。

智能体策略训练,在仿真环境中完成机器人、人形机器人、无人机控制策略迭代。

视角自由切换,支持相机平移、旋转,切换第一人称、第三人称观察视角。

视频续写,基于单张图片或者一段视频,延续生成符合物理逻辑的动态画面。

Odyssey-3应用场景

机器人仿真训练,搭建虚拟作业场景,完成机械臂抓取、移动操作策略调试。

人形机器人研发,在仿真空间测试设备在不同环境下的动作响应。

自动驾驶与无人机模拟,构建道路、室内场景,开展避障、导航测试。

游戏内容制作,快速生成可交互虚拟场景,用于原型验证与关卡设计。

物理 AI 算法研究,作为测试平台评估各类智能体在动态环境中的表现。

Odyssey-3使用教程

1. 访问 Odyssey 官网,进入浏览器预览页面,选择 Flash 轻量化变体体验交互场景。

2. 输入场景描述文字,设定环境类型、物体种类,确认画面分辨率参数。

3. 发送动作指令,调整相机视角,向场景内添加事件,观察环境实时变化。

4. 完成场景测试,开发者可提交申请获取正式 API 访问权限。

5. 接入 API 后,把模型生成的仿真环境接入智能体训练代码,配置观测与动作接口。

6. 开展策略迭代,在虚拟环境完成训练后,把控制策略迁移到实体硬件做验证。

Odyssey-3同类产品对比

表格

项目Odyssey-3World Model 2
研发主体Odyssey SystemsOpenAI
产品定位基础世界模型(Foundation World Model),主打物理世界仿真、交互式环境生成与具身智能训练通用世界模型,聚焦视频预测、物理推演与机器人控制仿真
核心特色Physics-IQ 基准高分,实时交互式 3D 环境生成,支持动作输入动态推演物理因果,可用于机器人臂控制,浏览器预览可用擅长长时序视频预测,多模态输入,原生对接 OpenAI 智能体体系,机器人策略训练生态成熟
适用场景机器人仿真训练、交互式虚拟环境构建、物理因果模拟、数字孪生原型视频时序预测、机器人策略学习、AI 智能体的物理环境推演
© 版权声明
为这篇文章评分
10.0/ 10
1 人评价
点击⭐️进行评分

相关文章

暂无评论

none
暂无评论...