OpenAI 与 Cerebras 确认到 2028 年分阶段部署 750MW 推理算力
OpenAI and Cerebras Confirm 750MW AI Inference Deployment Through 2028
OpenAI 与 Cerebras 确认多年期合作,将分阶段部署 750MW Cerebras 晶圆级算力用于超低延迟 AI 推理。2025 年 12 月 24 日生效的主关系协议约定三个 250MW 交付段,2026 年底、2027 年底、2028 年底分别累计达到 250MW、500MW、750MW,并包含可选额外容量、硬件购买路径和服务条款。
原文梳理了监管文件中的分阶段交付时间表,读者可以据此区分短期落地与长期规模,避免把算力协议当成产品承诺。
OpenAI 与 Cerebras 已确认达成一项多年期合作,将向 OpenAI 平台部署 750MW 的 Cerebras 晶圆级 AI 算力,用于 超低延迟 AI 推理。该算力将在 2028 年前分阶段整合,将此前关于两家公司关系的猜测转变为一项有明确交付时间表的既定基础设施部署。
根据 OpenAI 关于 Cerebras 合作的官方公告,两家公司旨在为 OpenAI 平台带来更快的推理能力。推理是指在用户提交提示词后生成输出的过程,而非此前的模型训练过程。对用户而言,更低的推理延迟可以让 AI 交互感觉更即时,尤其是在对话、编程及其他实时使用场景中。
该公告之所以重要,是因为它描述的是一项大规模、分阶段的承诺,而非一次性的基础设施测试。Cerebras 还表示,此次部署旨在服务 OpenAI 客户,并支持更快、实时的 AI 交互。在所提供的公告中,两家公司并未公布逐模型的性能数据、定价或详细的客户接入方案。
分阶段部署 750MW
监管文件为公开公告背后的协议提供了更多细节。一份于 2025 年 12 月 24 日生效的《主关系协议》规定了三个 250MW 的算力阶段,到 2028 年底总计达到 750MW。该协议还规定了可能的额外算力、硬件采购路径、服务级别条款,以及 OpenAI 与 Cerebras 之间拟议的排他性安排。
| 交付里程碑 | 已交付算力 | 累计算力 |
|---|---|---|
| 到 2026 年底 | 250MW | 250MW |
| 到 2027 年底 | 额外 250MW | 500MW |
| 到 2028 年底 | 额外 250MW | 750MW |
分阶段计划之所以重要,是因为全部算力预计不会一次性到位。OpenAI 表示,算力将在 2028 年前分多批上线,而合同里程碑为每个阶段设定了年末时间表。这一区别对于评估近期影响的读者很有用:该合作在 2026 年有一个早期交付目标,但其全部规模是一项更长期的建设项目。
为何该协议以推理为核心
AI 基础设施通常以模型训练的角度来讨论,而模型训练需要大量算力来创建或更新模型。此次合作专门针对推理算力,即人们和应用程序实际运行模型时所使用的基础设施。
这一重点与 AI 采用中的运营层面相契合。当应用程序需要维持自然交互或在用户离开前返回输出时,更快的响应时间可能很重要。示例可能包括依赖来回交互的面向客户的助手、编程工具和工作流界面。
另一份 SEC 文件显示,一款由 Cerebras 基础设施驱动的 OpenAI Codex Spark 模型于 2026 年 2 月 12 日前后推出。这表明该合作已进入早期运营使用阶段,但这并不能证明每一个 OpenAI 模型或服务都在使用 Cerebras 算力。
企业应该和不应该从中推断出什么
这一合作表明,双方将持续投入,使 AI 服务在大规模下更具响应能力。对于围绕 AI 工具构建业务的公司而言,这一方向可能使低延迟体验在选用例时变得越来越重要。在速度会影响 AI 功能对员工或客户是否实用的情况下,这一点尤其重要。
然而,已宣布的容量不应被视为对每位 OpenAI 客户具体响应时间、功能、降价或可用性水平的承诺。已核实材料并未说明:
- 哪些 OpenAI 产品、模型或客户层级将获得由 Cerebras 支持的推理服务。
- 用户在特定产品或地区应预期获得怎样的延迟改善。
- 访问权限是否会附带不同的定价或使用条款。
- 可选容量或协议中的硬件采购路径将如何使用。
因此,最直接的结论是基础设施方向,而非采购保证。考虑采用 AI 功能的团队应继续评估自身对响应时间、可靠性、集成和成本的要求,而不是假定一份大型算力协议就能解决这些实施问题。
更快的模型响应只有在契合有用工作流时才有意义。Scalevise 帮助企业评估低延迟 AI 可在哪些环节减少手动步骤、选择合适的工具,并制定切实可行的实施计划,而不假定基础设施容量等同于立竿见影的成果。我们的AI 咨询服务将技术选项与客户、运营和产品需求连接起来。申请咨询,以确定值得优先考虑的 AI 用例。
常见问题
OpenAI 与 Cerebras 的合作是什么?
OpenAI 与 Cerebras 已宣布一项多年合作,将向 OpenAI 平台部署 750MW 的 Cerebras 晶圆级 AI 算力,用于超低延迟推理。
750MW 部署何时完成?
该协议设定的交付目标为:到 2026 年底达到 250MW,到 2027 年底总计达到 500MW,到 2028 年底总计达到 750MW。
Cerebras 的容量用于 AI 训练还是推理?
已宣布的部署用于 AI 推理,即当用户或应用运行 AI 模型时用于生成响应的算力。
所有 OpenAI 产品都会使用 Cerebras 基础设施吗?
所提供的公告并未说明所有 OpenAI 产品或模型都将使用 Cerebras 基础设施。另一份 SEC 文件显示,该基础设施早期曾用于 2026 年 2 月 12 日前后的一款 OpenAI Codex Spark 模型。
结论
OpenAI 与 Cerebras 的协议确立了一项已确认的分阶段计划,即到 2028 年新增 750MW 的晶圆级推理容量。其最具体的意义在于,两家公司共同专注于大规模下更快的 AI 响应。对各个 OpenAI 产品、客户和定价的实际影响,将取决于尚未披露的推出细节。
来源:Google AI:DEV 作者专属(RSS) · dev.to