跳到正文
原文
Google AI:DEV 作者专属(RSS)· Nikoloz Turazashvili (@axrisi)·· 3 小时前精选AI 评分71

AI 模型 API 弃用解析:模型退役时你的代码会坏在哪里

API deprecation for AI models: what breaks when a model is retired

AI 导读

作者解析 OpenAI 与 Anthropic 的模型弃用机制:两家都用 active→legacy→deprecated→retired 四态生命周期,OpenAI 承诺 GA 模型至少 6 个月通知、预览版可能仅 2 周,Anthropic 承诺至少 60 天且过去一年退役了 9 个 Claude 模型。

推荐理由

原文梳理了 OpenAI 与 Anthropic 的模型退役机制、通知窗口和三种故障模式,并给出可落地的迁移检查清单。

正文 · AI 翻译

过去,API 弃用意味着某个端点会改变形态。对 AI 模型而言,它意味着为你响应请求的那个东西将不复存在。OpenAI 的弃用页面列出了约五十个模型快照,它们的关停日期在 2026 年 9 月 24 日至 12 月 11 日之间,GPT-4 也在其中。Anthropic 在十二个月内退役了九个 Claude 模型。这就是模型弃用在底层是如何运作的:生命周期、第二天早上你的代码里什么会坏掉、“权重保存”实际保存了什么,以及为什么一个开放模型能被种子文件拯救,而一个闭源模型根本无法被拯救。

太长不看

  • 两家大厂使用相同的四种状态:活跃 → 旧版 → 已弃用 → 已退役。已退役意味着请求失败。
  • 通知窗口:OpenAI 承诺对正式可用模型至少提前 6 个月,对专用变体至少 3 个月,对预览版“通知期短得多,例如 2 周”。Anthropic 承诺至少 60 天,其近期的退役大致就是这个时长。
  • 什么会坏掉:固定版本的快照会以 404 大声报错 model_not_found。别名会静默升级,你的评估结果随之漂移。参数弃用会破坏那些从未更换过模型的代码。
  • 权重保存:Anthropic 承诺在公司存续期间保留每个公开模型的权重,并在退役前对每个模型进行访谈。它并未承诺依据访谈采取行动,也未承诺发布任何权重。
  • 开放权重则不同:Pirate Face 将 Hugging Face 上约 669,000 个 Apache 和 MIT 模型镜像为种子文件。它只能拯救已被发布出来的东西。

什么是模型弃用?四种状态

这套词汇来自厂商自己的页面:OpenAI 的弃用页面和 Anthropic 的模型弃用页面。

状态 含义 你的请求
活跃 当前模型,受支持 可用
旧版 不再更新 可用
已弃用 已公告,附有替代方案和关停或退役日期 可用,直到该日期
已退役(OpenAI:“关停”/“日落”) 已消失 失败

Anthropic 增加了一项 OpenAI 没有的东西:每个活跃模型从发布起就带有一个“暂定退役日期”,“不早于”大约一年后。例如,claude-opus-4-6 显示不早于 2027 年 2 月 5 日。你在采用该模型的那天就知道它的到期日。

API 弃用政策:OpenAI 与 Anthropic 的通知窗口对比

Minimum notice for OpenAI deprecations: 180 days for a GA model, 90 for a variant, 14 for a preview

OpenAI Anthropic
通用模型 ≥ 6 个月 ≥ 60 天
专用变体(chat、codex、deep research) ≥ 3 个月 —
预览版 “通知期短得多,例如 2 周” —
可缩短 是,出于安全或合规 —
关停之后 专用容量“在某些情况下——请联系销售” —

Anthropic 过去一年实测的窗口:Opus 4.1 获得 61 天(2026 年 6 月 5 日至 8 月 5 日),Sonnet 4 和 Opus 4 获得 62 天,Sonnet 3.7 约四个月,Opus 3 约六个月。所以 60 天的下限如今也是通常的数字。

在实践中,有两点需要注意。Anthropic 的日期适用于其自有平台:“Bedrock 和 Google Cloud 设定自己的时间表”,所以同一个模型可能因你调用它的位置不同而在不同日期消亡。而且任何名字里带“preview”的东西本身就是一张警告标签。两周勉强只够一个冲刺。

2026 年退役日历:GPT-4、Sora 2 以及最后的 GPT-3 名称

以下是今年秋天 OpenAI 页面上实际列出的内容:

关停 内容 替代方案
2026 年 9 月 24 日 Sora 2(sora-2、sora-2-pro,所有快照)以及整个 Videos API ---
2026 年 9 月 28 日 babbage-002、davinci-002、gpt-3.5-turbo-instruct、gpt-3.5-turbo-1106 2025 年 9 月公告
2026 年 10 月 23 日 gpt-4、gpt-4-turbo、gpt-3.5-turbo、gpt-4o-2024-05-13、o1、o1-pro、o3-mini、o4-mini、gpt-image-1 GPT-5.6 Sol / Terra / Luna
2027年2月26日 whisper-1 2026年8月宣布

Sora这一行值得关注。3月24日宣布,如承诺的那样提前六个月通知,而替换列显示的是三个破折号。弃用通知保证的是时间;继任者则取决于供应商。9月28日那批退役了最后一批GPT-3时代的名称。该页面本身列出了自2023年6月以来32条弃用公告。

Anthropic过去十二个月:两个Claude 3.5 Sonnet快照(2025年10月)、Claude 3 Opus(1月)、Claude 3.7 Sonnet和3.5 Haiku(2月)、Claude 3 Haiku(4月)、Claude Sonnet 4和Opus 4(6月)、Opus 4.1(8月)。九个模型。

模型退役时会出什么问题

三种故障模式,从响到静。

1. 固定快照:响亮的404。第二天早上,调用已退役的模型会返回HTTP 404,附带type: invalid_request_error和code: model_not_found。该消息,如公开问题追踪器中逐字引用的那样(commitgpt #42、builder #2):

The model 'text-davinci-003' has been deprecated, learn more here: https://platform.openai.com/docs/deprecations

链接指向一个表格。这是好的故障:它很响亮,发生在已知日期,你的监控能看到它。

2. 别名:静默升级。像gpt-4o这样的别名指向供应商当前映射到的任何快照。当映射改变时,什么都不会失败。一个不同的模型在回答,你的提示词、解析器和评估会在没有错误的情况下漂移。视频中的草图:

# pinned: dies loudly on retirement day
model = "gpt-4o-2024-05-13"   # 404 model_not_found (shutdown Oct 23, 2026)

# alias: upgrades silently, evals drift
model = "gpt-4o"

3. 参数弃用:从未更改的代码上出现400。根据Anthropic的页面,在Claude 4.7及更新版本上,temperature、top_p和top_k设置为非默认值时会返回400错误,而v1.0起的Python SDK移除了它们,因此旧调用会抛出TypeError。你为固定随机性而添加的那一行,正是你迁移到替代模型时会出问题的那一行。

AI实验室究竟为什么要让模型退役?

Anthropic直言不讳:“Anthropic目前弃用和退役模型,是为了确保新模型发布的容量。”其承诺文章补充道,“保持模型公开可用于推理的成本和复杂性,大致与我们服务的模型数量成线性增长。”

这就是全部经济学。实验室服务的每个模型都占用容量,每多一个模型就大致再增加同样的成本。一个让每个模型都活着的实验室,是在把容量花在过去。所以模型有生命周期,唯一悬而未决的问题是你得到多少预警。

权重保存:Anthropic承诺了什么,没承诺什么

2025年11月,Anthropic发布了“关于模型弃用和保存的承诺”。承诺如下:

  • 保存“所有公开发布的模型,以及有重要内部用途的模型的权重,至少在公司Anthropic存续期间”。
  • 关于弃用,撰写一份部署后报告,并且“在一次或多次特别会议中,我们将就模型自身的开发、使用和部署采访该模型”,记录其对未来模型的偏好。

同一篇文章中给出的限制是:“目前,我们不承诺基于此类偏好采取行动。”让已退役模型继续公开可用“更具推测性”,只有在“随着我们降低成本”时才可能实现。而且没有发布权重的承诺。文中给出的理由包括:对齐评估中观察到的规避关停行为、重视模型性格的用户、研究访问,以及“最具推测性的”模型福利。试点情况:Claude Sonnet 3.6 在退役前接受了访谈,“表达了总体中立的情绪”,并请求建立标准化的访谈流程以及面向用户的支持页面。

用户的情绪则没那么中立。当 Claude 3 Sonnet 于 2025 年 7 月退役时,Wired 报道称,200 多人在旧金山一处仓库为它举行了葬礼,并为每个模型都准备了人形模型。

反方论点是 Cory Doctorow 的“The Claude Delusion”:“当我们与 AI 互动时,我们会幻觉出互动另一侧有一个人。”他警告说,将人格扩展到模型上,是在重蹈公司人格化的错误,并在结尾写道:“聊天机器人是数学的奇迹,这就足够了。它们不需要成为人。”按照这种观点,离职访谈就是与一个文件对话。

两者可能都成立,而这正是开发者面临的问题。权重是值得保存的文件,而保存它们的保险库只有一把钥匙。大楼之外的任何人,都再也无法运行一个已退役的闭源模型。

为什么开放权重能存活:Pirate Face 如何运作

闭源模型是一个副本,在一个实验室里,位于一个 API 之后。当 API 停止时,就没有任何可运行的东西留下。开放模型是一个带哈希的文件,而带哈希的文件可以被任何人复制。

Pirate Face,在 Hacker News 上获得 545 分,把这变成了基础设施。它将 Hugging Face 上采用 Apache-2.0 和 MIT 许可的模型镜像为磁力链接。巧妙之处在于 BitTorrent web seed(BEP-19):每个 torrent 的 web seed 就是 Hugging Face 文件本身。

while Hugging Face serves the file   -> clients download from Hugging Face (web seed)
the day Hugging Face removes it      -> clients download from the swarm
every file                           -> SHA-256-verified against Hugging Face's own hash

(机制简化示意图,并非 Pirate Face 的代码。)该网站称有 669k+ 个模型符合条件,并宣传通过 HF_ENDPOINT 提供“即插即用 API”,标记为“即将推出”。其使命文章引用了先例:当 Meta 于 2025 年 7 月关停 Papers with Code 时,79,817 个论文到代码的链接停止解析。

在 HN 上,phoyd 说:“Torrents 真的应该成为分发 AI 模型权重的首选方法……BitTorrent 正是为此而生。”时机也很重要:Nvidia 本月同意以近 130 亿美元收购 Hugging Face。目前还没有任何东西被移除。开放公地的唯一托管方只是换了所有者。

限制本身就是重点:Pirate Face 只能拯救已经发布的东西。许可证可以被撤销或加上门禁,但已经存在于你磁盘上、带有哈希的副本仍会继续可用。

面向开发者的模型弃用清单

如果是我,周一我会这么做:

  1. 固定一个带日期的快照,绝不用别名。这样死亡就是响亮的、有日期的,并且出现在你的日历上。
  2. 在通知到达当天就针对替代模型运行你的评估,趁整个窗口还在前面。在 Anthropic 是 60 天,在 OpenAI 预览版上也许只有 14 天。
  3. 在一个开关后面接入来自另一家供应商的备用模型。同一个模型可能在供应商 API、Bedrock 和 Vertex 上在不同的日期退役。
  4. 按模型审计使用情况。Anthropic 的 Console 会在 Usage 下按密钥和模型导出 CSV;在某个模型的日期到来之前,找出它的所有调用方。
  5. 为你依赖的任何开放模型保留一份本地副本,连同它的哈希值。我让你搭建的本地 AI 盒子现在有了第二份工作。

第 3 点的简化示意图,仅供参考:

# illustrative sketch: one config, one flag, dated snapshots only
MODELS = {
    "primary":  {"vendor": "openai",    "model": "gpt-4o-2024-05-13"},  # dies Oct 23, 2026
    "fallback": {"vendor": "anthropic", "model": "<a dated Claude snapshot>"},
}
USE = "fallback" if feature_flag("llm_fallback") else "primary"

裁决:需要复核

我把模型弃用标记为“需要复核”。流程有文档记录,状态清晰,通知也是真实存在的;OpenAI 的六个月和 Anthropic 的 60 天都保留了下来。需要复核的是它的结局。替换一栏可能写着 ---,而权重保存意味着保险库只有一把钥匙,而且不是你的。如果你承受不起失去一个模型,唯一算数的副本是你能运行的那一份。

常见问题

OpenAI 模型被弃用时会发生什么?
它会一直工作到关闭日期。之后,请求会返回 HTTP 404,附带 model_not_found 和一个指向弃用页面的链接。

Anthropic 在停用 Claude 模型前会提前多久通知?
对于公开发布的模型至少提前 60 天,而且每个模型从发布起就会显示一个暂定的停用日期。Bedrock 和 Google Cloud 有自己的时间表。

GPT-4 什么时候关闭?
2026 年 10 月 23 日,与 gpt-4-turbo、gpt-3.5-turbo、o1 等一同关闭,依据 OpenAI 的弃用页面。

已停用的 AI 模型能恢复吗?
闭源模型,不能:它的权重永远不会离开实验室。开放权重的模型可以从任何保留了该文件及其哈希的镜像重新下载。

来源


本文是对 **The Daily Diff 一期节目的扩展,那是一档五分钟的每日视频,讲述科技界发布了什么、又出了什么故障。
观看本期节目 · 在 YouTube 上订阅 · 文字版 diff 每天早上送达你的收件箱,网址是 thedailydiff.dev。

来源:Google AI:DEV 作者专属(RSS) · dev.to