Rome OS – 一款可以用自然语言写应用的开源Agent操作系统

Rome OS是一款开源的Agent操作系统,定位在”人类与智能体协作的护栏环境”。它不追求替代传统操作系统,而是为AI Agent提供一个可以持续运行、积累能力、与人类协同工作的专门环境。

Agent应该有自己的运行环境,而不是每次被调用时才临时启动。在这个环境里,Agent可以构建自己的工具链(harness),设计自己的标准作业程序(SOP),在人类指导下编排工作流。被验证过的能力会沉淀下来,每一次交互都在抬高下一次的能力上限。

项目代码完全开源,托管在GitHub上。开发团队来自Anthropic、Google、TikTok、ByteDance、Meta、Dropbox等公司。用户可以选择三种使用方式:Rome Cloud预览版(云端托管)、Docker自托管、或从源码运行开发环境。

Rome OS - 一款可以用自然语言写应用的开源Agent操作系统

Rome OS核心特点

协作复利

Rome OS的设计假设是:人类与Agent的协作应该产生复利效应。Agent在运行中积累的经验、验证过的流程、沉淀下来的技能,都会成为下一次任务的起点,而不是每次从零开始。

隐私可控

用户自己决定Rome可以访问什么、连接什么、记住什么。数据主权掌握在用户手中,而非平台。

完全开源

代码可读、可自托管、可按需改造。采用pnpm monorepo架构,核心代码分为packages/core(Agent运行时)、packages/web(守护者仪表板)、packages/desktop(Electron壳与本地运行时)等模块。

兼容前沿模型

不绑定特定模型,支持用户已有的编码Agent和计划方案。


Rome OS技术架构

Rome OS的技术底座是一个Node.js monorepo,要求Node.js 24或更高版本,使用pnpm 11.6作为包管理器。

核心组件

表格

模块功能
packages/coreAgent运行时、会话、动作、事件、通道、策略、记忆与持久化
packages/web守护者专用Web仪表板
packages/desktopElectron壳与本地Rome运行时
packages/app-runtime-sdkRome App公共后端SDK
packages/app-web-sdk公共Web SDK与App构建工具
rome_apps/官方Rome App,通过同一App模型加载

Rome App的构成

每个Rome App以app.yaml清单文件为起点,可包含以下任意组合:

  • Actions:Agent、例程和App代码可调用的类型化操作

  • Agents:拥有独立指令和工具的App专属协作者

  • Skills:Agent需要时加载的自然语言过程

  • Hooks:消息、事件和Agent轮次生命周期的扩展点

  • Web UI & APIs:专用接口和App拥有的HTTP端点

  • Database & files:跨运行持久存在的App私有状态

这些元素共同构成一个能力(capability)——Rome在后续工作中发现和复用的单元。App是能力的人类界面:App组织人类交互,能力组织Agent行动。

部署方式

  • Rome Cloud:为每个守护者预配私有Rome环境,目前处于预览阶段

  • Docker自托管:一条命令检查Docker、拉取镜像、启动服务,仪表板默认绑定localhost:7663

  • 源码开发:pnpm dev:all启动生产形态的本地栈,包含Rome、可观测性、路由和Web开发服务器


Rome项目地址

  • 项目官网:https://romeos.cc/
  • GitHub仓库:https://github.com/rome-os/rome

Rome OS功能

Agent运行时

管理Agent的完整生命周期:会话创建、动作调度、事件处理、通道通信、策略执行、记忆存储与持久化。

Rome App商店

社区可以分享App,用户可以从商店浏览和安装。App将Agent能力产品化,让非技术用户也能使用复杂的Agent工作流。

持久化工作流

数据和流程默认携带前进。Agent设计的SOP、验证过的动作序列、积累的记忆,都会在后续会话中保留。

自我改进能力

Agent在Rome环境中可以检查并修改自身的任何部分。因为工具、框架、记忆和技能都是可执行文件和文件,Agent能够对自己的代码进行迭代。

多入口交互

通过Web仪表板、桌面应用或集成到现有工作流中与Agent交互。


Rome OS应用场景

表格

场景说明
个人AI助手长期陪伴的Agent,记住你的偏好、习惯和工作方式,越用越顺手
团队共享Agent团队成员与同一个Agent协作,Agent积累团队知识,成为”团队大脑”
编码工作流连接已有的编码Agent(如Claude Code、Codex),在Rome环境中编排复杂开发任务
自动化SOP将重复性工作流程编码为Agent技能,人类只需在关键节点审批或纠偏
知识管理Agent持续阅读、整理、归类信息,形成可检索、可引用的知识库
自托管AI基础设施对数据敏感的组织,在私有服务器上部署完整的Agent操作系统

Rome OS与同类产品的区别

Rome OS与Claude Code、Cursor等编码Agent工具的关系,类似于操作系统与应用程序的关系。Claude Code是一个强大的编码Agent,而Rome OS是运行多个Agent、管理它们的生命周期、记忆和协作的环境。

与Pancake、Make等偏向商业自动化的Agent OS不同,Rome OS更偏向个人和开发者,强调开源、自托管和Agent的自主成长。

© 版权声明
为这篇文章评分
0.0/ 10
0 人评价
点击⭐️进行评分

相关文章

暂无评论

none
暂无评论...