为什么要做 OryxOS
Agent 不该只属于大厂
每家公司此刻都有该交给 Agent 的活:有人手工汇总的日报、凌晨三点要分诊的告警、每天的 PR 摘要、被回答了一百遍的客户问题。模型早就准备好了——可在大多数公司,Agent 还停留在 demo。
为什么?四道门槛,没有一道是模型:
定义一个 Agent 需要工程师。 今天的主流路径是写代码——选框架、搭运行时、写胶水逻辑、做部署。最懂业务的人(运维、客服、HR、财务)能用一句话把活描述得清清楚楚,却完全没法交付一个 Agent。
数据必须出门。 云上的 Agent 平台解决基础设施问题的方式,是把你的数据一并拿走。对任何有数据驻留、网络边界、审计合规要求的公司,这条路走不通。
它是个黑盒。 一个能执行 Shell、写文件、调外部 API 的 Agent——做过什么没有记录、能做什么没有白名单、危险动作没人审批——企业不可能把它放进生产。
跑一个容易,跑一群难。 把一次 LLM 调用套进循环只是脚本。而运行几十个 Agent——共享 Provider、共享工具、定时调度、生命周期、治理——是一个操作系统级的问题,几乎没有人把这一层交给你。
我们的答案
OryxOS 一次拆掉这四道门槛:
- 用自然语言,不用代码。 一句话——或一个 markdown 目录——就定义一个 Agent。其余全由 OS 供给:记忆、24 个内置工具、MCP 连接器、Skill、通知、定时。定义一个 Agent 的成本趋近于零。
- 你的基础设施,你的数据。 一个私有部署的二进制,跑在你自己的服务器或 K8s 上。没有托管服务、没有遥测、不锁云。
- 玻璃盒,不是黑盒。 每次工具调用和 LLM 调用从第一天起就写进审计表——调了什么、传了什么参数、返回了什么、花了多久。文件 / Shell / HTTP 全走沙箱白名单。治理是地基,不是补丁。
- 为一群 Agent 准备的 OS。 Agent 是进程,OryxOS 是操作系统——生命周期、路由、共享注册表、调度、管理台和 API,一次给到全部。
让每一家公司,都能用自然语言跑起来自己的 Agent。
为什么是一支 Agent 团队,而不是一个超级 Agent
真实的活很少只需要一种技能。「调研市场、起草报告、找人核对数字、发给团队」——这是一个团队的活:拆解、并行、评审、交付。所以我们的北极星不是更聪明的单个 Agent,而是这个:
你用一句自然语言发布一个任务 → 底座把它拆解 → 组织一支 Agent 团队 → 多个 Agent 分工协作 → 交付一个结果。
业界已经证明这个范式可行(planner–worker–reviewer 班子、Agent 间协作协议)。缺的是企业真正敢用的那个版本:每个子 Agent 可审计、危险动作有人审批、成本按任务归集、迭代有界不失控。这个「值得信任的版本」,恰恰只有 Agent OS 这一层给得出来。见路线图。
为什么是 OS,而不是又一个框架
常见的误判是:更好的 Agent 需要更好的模型。生产环境里,瓶颈在 harness——模型和现实世界之间的那层脚手架:每次调用前组装对的上下文、工具走白名单而不是敞开、执行被隔离且可审计、消息可靠送达。
框架给你的是你自己代码里的一套 harness;OryxOS 把 harness 做成基础设施,并在其上运行一整队 Agent。这改变的是「谁能用」:有框架,是工程师造 Agent;有 OS,每个能把活说清楚的人都能跑 Agent。
OryxOS 不是什么
不是云平台。 没有托管服务、没有遥测采集、不依赖任何外部云。它就是跑在你自己基础设施上的一个二进制。
不是单 Agent 工具。 把一次 LLM 调用套进循环只是脚本——一套写死的 harness。OryxOS 把可复用的 harness 交给一整队 Agent:多个 Agent 各占一个目录、运行时创建和管理、共享全部能力。
不是某框架的移植版。 OryxOS 做了自己的架构选择:自实现、完全透明可查的 ReAct Loop,而不是框架托管;同步执行配虚拟线程,而不是异步 / 响应式;显式 Provider 路由,而不是自动装配;持久化落库,而不是内存态。
不是第一天就生产完整。 已交付的是运行时内核——五项核心能力,做完并测过。多租户、SSO、基于角色的工具策略、容器级隔离、多 Agent 团队都在路线图上,文档对这条边界说得明明白白。
为什么是现在
AI 编程改变了成本结构。 一个专注的小团队现在能构建和维护过去需要一个工程组织才能做的系统——OryxOS 自己就是这么造出来的:用 AI,由为结果负责的贡献者。
开放标准刚好成熟。 MCP 已成为工具互操作的事实标准,A2A 正在成为跨 Agent 协作的标准。OryxOS 从第一天就构建在两者之上——接进 OryxOS 的东西在更大的生态里同样可用,反之亦然。
另一条路更糟。 不用专门的 Agent OS,就只能临时拼凑:手搓 Prompt 组装、自制工具调度、只靠日志审计、没有共享记忆。短期能跑,出事的时候排查像考古。一个有清晰契约、持久审计、明确扩展模型的运行时,才是更好的地基。