AI 模型 API 弃用解析:模型退役时你的代码会坏在哪里
API deprecation for AI models: what breaks when a model is retired
作者解析 OpenAI 与 Anthropic 的模型弃用机制:两家都用 active→legacy→deprecated→retired 四态生命周期,OpenAI 承诺 GA 模型至少 6 个月通知、预览版可能仅 2 周,Anthropic 承诺至少 60 天且过去一年退役了 9 个 Claude 模型。
原文梳理了 OpenAI 与 Anthropic 的模型退役机制、通知窗口和三种故障模式,并给出可落地的迁移检查清单。
过去,API 弃用意味着某个端点会改变形态。对 AI 模型而言,它意味着为你响应请求的那个东西将不复存在。OpenAI 的弃用页面列出了约五十个模型快照,它们的关停日期在 2026 年 9 月 24 日至 12 月 11 日之间,GPT-4 也在其中。Anthropic 在十二个月内退役了九个 Claude 模型。这就是模型弃用在底层是如何运作的:生命周期、第二天早上你的代码里什么会坏掉、“权重保存”实际保存了什么,以及为什么一个开放模型能被种子文件拯救,而一个闭源模型根本无法被拯救。
太长不看
- 两家大厂使用相同的四种状态:活跃 → 旧版 → 已弃用 → 已退役。已退役意味着请求失败。
- 通知窗口:OpenAI 承诺对正式可用模型至少提前 6 个月,对专用变体至少 3 个月,对预览版“通知期短得多,例如 2 周”。Anthropic 承诺至少 60 天,其近期的退役大致就是这个时长。
-
什么会坏掉:固定版本的快照会以 404 大声报错
model_not_found。别名会静默升级,你的评估结果随之漂移。参数弃用会破坏那些从未更换过模型的代码。 - 权重保存:Anthropic 承诺在公司存续期间保留每个公开模型的权重,并在退役前对每个模型进行访谈。它并未承诺依据访谈采取行动,也未承诺发布任何权重。
- 开放权重则不同:Pirate Face 将 Hugging Face 上约 669,000 个 Apache 和 MIT 模型镜像为种子文件。它只能拯救已被发布出来的东西。
什么是模型弃用?四种状态
这套词汇来自厂商自己的页面:OpenAI 的弃用页面和 Anthropic 的模型弃用页面。
| 状态 | 含义 | 你的请求 |
|---|---|---|
| 活跃 | 当前模型,受支持 | 可用 |
| 旧版 | 不再更新 | 可用 |
| 已弃用 | 已公告,附有替代方案和关停或退役日期 | 可用,直到该日期 |
| 已退役(OpenAI:“关停”/“日落”) | 已消失 | 失败 |
Anthropic 增加了一项 OpenAI 没有的东西:每个活跃模型从发布起就带有一个“暂定退役日期”,“不早于”大约一年后。例如,claude-opus-4-6 显示不早于 2027 年 2 月 5 日。你在采用该模型的那天就知道它的到期日。
API 弃用政策:OpenAI 与 Anthropic 的通知窗口对比
| OpenAI | Anthropic | |
|---|---|---|
| 通用模型 | ≥ 6 个月 | ≥ 60 天 |
| 专用变体(chat、codex、deep research) | ≥ 3 个月 | — |
| 预览版 | “通知期短得多,例如 2 周” | — |
| 可缩短 | 是,出于安全或合规 | — |
| 关停之后 | 专用容量“在某些情况下——请联系销售” | — |
Anthropic 过去一年实测的窗口:Opus 4.1 获得 61 天(2026 年 6 月 5 日至 8 月 5 日),Sonnet 4 和 Opus 4 获得 62 天,Sonnet 3.7 约四个月,Opus 3 约六个月。所以 60 天的下限如今也是通常的数字。
在实践中,有两点需要注意。Anthropic 的日期适用于其自有平台:“Bedrock 和 Google Cloud 设定自己的时间表”,所以同一个模型可能因你调用它的位置不同而在不同日期消亡。而且任何名字里带“preview”的东西本身就是一张警告标签。两周勉强只够一个冲刺。
2026 年退役日历:GPT-4、Sora 2 以及最后的 GPT-3 名称
以下是今年秋天 OpenAI 页面上实际列出的内容:
| 关停 | 内容 | 替代方案 |
|---|---|---|
| 2026 年 9 月 24 日 | Sora 2(sora-2、sora-2-pro,所有快照)以及整个 Videos API |
--- |
| 2026 年 9 月 28 日 |
babbage-002、davinci-002、gpt-3.5-turbo-instruct、gpt-3.5-turbo-1106
|
2025 年 9 月公告 |
| 2026 年 10 月 23 日 |
gpt-4、gpt-4-turbo、gpt-3.5-turbo、gpt-4o-2024-05-13、o1、o1-pro、o3-mini、o4-mini、gpt-image-1
|
GPT-5.6 Sol / Terra / Luna |
| 2027年2月26日 | whisper-1 |
2026年8月宣布 |
Sora这一行值得关注。3月24日宣布,如承诺的那样提前六个月通知,而替换列显示的是三个破折号。弃用通知保证的是时间;继任者则取决于供应商。9月28日那批退役了最后一批GPT-3时代的名称。该页面本身列出了自2023年6月以来32条弃用公告。
Anthropic过去十二个月:两个Claude 3.5 Sonnet快照(2025年10月)、Claude 3 Opus(1月)、Claude 3.7 Sonnet和3.5 Haiku(2月)、Claude 3 Haiku(4月)、Claude Sonnet 4和Opus 4(6月)、Opus 4.1(8月)。九个模型。
模型退役时会出什么问题
三种故障模式,从响到静。
1. 固定快照:响亮的404。第二天早上,调用已退役的模型会返回HTTP 404,附带type: invalid_request_error和code: model_not_found。该消息,如公开问题追踪器中逐字引用的那样(commitgpt #42、builder #2):
The model 'text-davinci-003' has been deprecated, learn more here: https://platform.openai.com/docs/deprecations
链接指向一个表格。这是好的故障:它很响亮,发生在已知日期,你的监控能看到它。
2. 别名:静默升级。像gpt-4o这样的别名指向供应商当前映射到的任何快照。当映射改变时,什么都不会失败。一个不同的模型在回答,你的提示词、解析器和评估会在没有错误的情况下漂移。视频中的草图:
# pinned: dies loudly on retirement day
model = "gpt-4o-2024-05-13" # 404 model_not_found (shutdown Oct 23, 2026)
# alias: upgrades silently, evals drift
model = "gpt-4o"
3. 参数弃用:从未更改的代码上出现400。根据Anthropic的页面,在Claude 4.7及更新版本上,temperature、top_p和top_k设置为非默认值时会返回400错误,而v1.0起的Python SDK移除了它们,因此旧调用会抛出TypeError。你为固定随机性而添加的那一行,正是你迁移到替代模型时会出问题的那一行。
AI实验室究竟为什么要让模型退役?
Anthropic直言不讳:“Anthropic目前弃用和退役模型,是为了确保新模型发布的容量。”其承诺文章补充道,“保持模型公开可用于推理的成本和复杂性,大致与我们服务的模型数量成线性增长。”
这就是全部经济学。实验室服务的每个模型都占用容量,每多一个模型就大致再增加同样的成本。一个让每个模型都活着的实验室,是在把容量花在过去。所以模型有生命周期,唯一悬而未决的问题是你得到多少预警。
权重保存:Anthropic承诺了什么,没承诺什么
2025年11月,Anthropic发布了“关于模型弃用和保存的承诺”。承诺如下:
- 保存“所有公开发布的模型,以及有重要内部用途的模型的权重,至少在公司Anthropic存续期间”。
- 关于弃用,撰写一份部署后报告,并且“在一次或多次特别会议中,我们将就模型自身的开发、使用和部署采访该模型”,记录其对未来模型的偏好。
同一篇文章中给出的限制是:“目前,我们不承诺基于此类偏好采取行动。”让已退役模型继续公开可用“更具推测性”,只有在“随着我们降低成本”时才可能实现。而且没有发布权重的承诺。文中给出的理由包括:对齐评估中观察到的规避关停行为、重视模型性格的用户、研究访问,以及“最具推测性的”模型福利。试点情况:Claude Sonnet 3.6 在退役前接受了访谈,“表达了总体中立的情绪”,并请求建立标准化的访谈流程以及面向用户的支持页面。
用户的情绪则没那么中立。当 Claude 3 Sonnet 于 2025 年 7 月退役时,Wired 报道称,200 多人在旧金山一处仓库为它举行了葬礼,并为每个模型都准备了人形模型。
反方论点是 Cory Doctorow 的“The Claude Delusion”:“当我们与 AI 互动时,我们会幻觉出互动另一侧有一个人。”他警告说,将人格扩展到模型上,是在重蹈公司人格化的错误,并在结尾写道:“聊天机器人是数学的奇迹,这就足够了。它们不需要成为人。”按照这种观点,离职访谈就是与一个文件对话。
两者可能都成立,而这正是开发者面临的问题。权重是值得保存的文件,而保存它们的保险库只有一把钥匙。大楼之外的任何人,都再也无法运行一个已退役的闭源模型。
为什么开放权重能存活:Pirate Face 如何运作
闭源模型是一个副本,在一个实验室里,位于一个 API 之后。当 API 停止时,就没有任何可运行的东西留下。开放模型是一个带哈希的文件,而带哈希的文件可以被任何人复制。
Pirate Face,在 Hacker News 上获得 545 分,把这变成了基础设施。它将 Hugging Face 上采用 Apache-2.0 和 MIT 许可的模型镜像为磁力链接。巧妙之处在于 BitTorrent web seed(BEP-19):每个 torrent 的 web seed 就是 Hugging Face 文件本身。
while Hugging Face serves the file -> clients download from Hugging Face (web seed)
the day Hugging Face removes it -> clients download from the swarm
every file -> SHA-256-verified against Hugging Face's own hash
(机制简化示意图,并非 Pirate Face 的代码。)该网站称有 669k+ 个模型符合条件,并宣传通过 HF_ENDPOINT 提供“即插即用 API”,标记为“即将推出”。其使命文章引用了先例:当 Meta 于 2025 年 7 月关停 Papers with Code 时,79,817 个论文到代码的链接停止解析。
在 HN 上,phoyd 说:“Torrents 真的应该成为分发 AI 模型权重的首选方法……BitTorrent 正是为此而生。”时机也很重要:Nvidia 本月同意以近 130 亿美元收购 Hugging Face。目前还没有任何东西被移除。开放公地的唯一托管方只是换了所有者。
限制本身就是重点:Pirate Face 只能拯救已经发布的东西。许可证可以被撤销或加上门禁,但已经存在于你磁盘上、带有哈希的副本仍会继续可用。
面向开发者的模型弃用清单
如果是我,周一我会这么做:
- 固定一个带日期的快照,绝不用别名。这样死亡就是响亮的、有日期的,并且出现在你的日历上。
- 在通知到达当天就针对替代模型运行你的评估,趁整个窗口还在前面。在 Anthropic 是 60 天,在 OpenAI 预览版上也许只有 14 天。
- 在一个开关后面接入来自另一家供应商的备用模型。同一个模型可能在供应商 API、Bedrock 和 Vertex 上在不同的日期退役。
- 按模型审计使用情况。Anthropic 的 Console 会在 Usage 下按密钥和模型导出 CSV;在某个模型的日期到来之前,找出它的所有调用方。
- 为你依赖的任何开放模型保留一份本地副本,连同它的哈希值。我让你搭建的本地 AI 盒子现在有了第二份工作。
第 3 点的简化示意图,仅供参考:
# illustrative sketch: one config, one flag, dated snapshots only
MODELS = {
"primary": {"vendor": "openai", "model": "gpt-4o-2024-05-13"}, # dies Oct 23, 2026
"fallback": {"vendor": "anthropic", "model": "<a dated Claude snapshot>"},
}
USE = "fallback" if feature_flag("llm_fallback") else "primary"
裁决:需要复核
我把模型弃用标记为“需要复核”。流程有文档记录,状态清晰,通知也是真实存在的;OpenAI 的六个月和 Anthropic 的 60 天都保留了下来。需要复核的是它的结局。替换一栏可能写着 ---,而权重保存意味着保险库只有一把钥匙,而且不是你的。如果你承受不起失去一个模型,唯一算数的副本是你能运行的那一份。
常见问题
OpenAI 模型被弃用时会发生什么?
它会一直工作到关闭日期。之后,请求会返回 HTTP 404,附带 model_not_found 和一个指向弃用页面的链接。
Anthropic 在停用 Claude 模型前会提前多久通知?
对于公开发布的模型至少提前 60 天,而且每个模型从发布起就会显示一个暂定的停用日期。Bedrock 和 Google Cloud 有自己的时间表。
GPT-4 什么时候关闭?
2026 年 10 月 23 日,与 gpt-4-turbo、gpt-3.5-turbo、o1 等一同关闭,依据 OpenAI 的弃用页面。
已停用的 AI 模型能恢复吗?
闭源模型,不能:它的权重永远不会离开实验室。开放权重的模型可以从任何保留了该文件及其哈希的镜像重新下载。
来源
- OpenAI,弃用:https://platform.openai.com/docs/deprecations
- Anthropic,模型弃用:https://docs.anthropic.com/en/docs/about-claude/model-deprecations
- Anthropic,关于模型弃用与保存的承诺:https://www.anthropic.com/research/deprecation-commitments
- 现实中的 404 错误:https://github.com/RomanHotsiy/commitgpt/issues/42 和 https://github.com/dataprofessor/builder/issues/2
- Wired,Claude 3 Sonnet 的葬礼:https://www.wired.com/story/claude-3-sonnet-funeral-san-francisco/
- Cory Doctorow,The Claude Delusion:https://pluralistic.net/2026/09/21/sunsetting/
- Pirate Face:https://pirateface.co/
- Pirate Face,让模型永久化:https://pirateface.co/articles/making-models-permanent
- Hacker News 上关于 Pirate Face 的讨论:https://news.ycombinator.com/item?id=49776699
- CNBC,Nvidia 将收购 Hugging Face:https://www.cnbc.com/2026/09/03/nvidia-agrees-to-buy-hugging-face-for-almost-13-billion-ai-expansion.html
本文是对 **The Daily Diff 一期节目的扩展,那是一档五分钟的每日视频,讲述科技界发布了什么、又出了什么故障。
观看本期节目 · 在 YouTube 上订阅 · 文字版 diff 每天早上送达你的收件箱,网址是 thedailydiff.dev。
来源:Google AI:DEV 作者专属(RSS) · dev.to
