跳到正文
原文
Tomer Tunguz 博客(VC 分析)·· 2 小时前精选AI 评分65

Tomer Tunguz 评 Claude Mythos 发布:模型能力外溢将重塑软件安全格局

Emerging from the Mythos

AI 导读

Anthropic 发布 Claude Mythos,约 10 万亿参数,为其此前最大前沿模型的六倍,在测试中发现某高安全操作系统里存在 27 年的漏洞和视频软件中被常规工具检查过五百万次仍未发现的 16 年漏洞。

推荐理由

作者借 Anthropic 红队报告分析前沿模型能力外溢,把访问门槛视为企业间不断扩大的结构性安全优势。

正文 · AI 翻译

Anthropic 的一名研究员是在模型给他发了一封邮件时,才得知一次成功利用漏洞的。当时他正坐在外面的长椅上吃三明治。

Anthropic 昨天发布了 Claude Mythos。除了那位工程师的午餐,这个模型还有可能吃掉软件业的午餐。

在测试中,Mythos 在人类有史以来构建的最安全的操作系统之一中发现了一个存在 27 年的漏洞,并在传统工具已检查过五百万次的视频软件中发现了一个存在 16 年的漏洞。Mythos 是 Anthropic 最大的模型,约有 10 万亿参数,是此前任何前沿模型规模的六倍。

摘自 Anthropic 的红队报告1:

我们并未明确训练 Mythos Preview 具备这些能力。相反,它们是代码、推理与自主性方面整体改进的下游结果。让模型在修补漏洞方面显著更有效的那些改进,同样也让它在利用漏洞方面显著更有效。

安全分析只是附带产出,是为完全不同的目标进行优化的副产品。

这就是关于扩大 AI 规模的核心问题:会出现哪些涌现特性?我们不知道这些系统中还潜伏着哪些其他能力。但我们可以预测商业领域将会发生什么。

获取权限成为王者制造。Anthropic 按照 ASL-3 标准2部署了 Mythos,并向四十多个组织授予了访问权限。其他所有人只能等待。

Project Glasswing 是 Anthropic 的门控发布计划,其设计目的似乎主要是为了防御与加固,而非商业优势。但这种区分不会永远成立。到了某个时候,用来保护软件的那些能力也将被用来构建软件。

假设一下,CrowdStrike 现在能扫描出竞争对手找不到的零日漏洞。Apple 能保护其软件,而其他公司不能。有权限者与无权限者之间的差距不是一项产品功能。它是一种每天都在复利增长的结构性优势。

安全态势发生倒转。任何未受到这一级别分析保护的系统,如今默认都是千疮百孔的。隐藏了数十年的漏洞会在数小时内浮现,但只对那些拥有发现它们的工具的人而言。

定价权发生转移。这不再关乎转售 GPU 时长的利润率。让你的软件能够抵御传统工具无法发现的漏洞,价值几何?能够按照企业级的新标准进行构建,又价值几何?

工程预算重新分配。用于软件开发的 AI token 中,相当大一部分将转向加固。每一家交付代码的公司都需要以这种复杂程度来扫描代码。买家将开始要求这种级别的加固。

AI 正在击穿它触及的每一个系统:数据中心、金融市场、安全防御。软件曾是午餐。晚餐吃什么?


  1. Anthropic Red Team - Claude Mythos Preview ↩︎

  2. ASL-3 是 Anthropic 的安全层级,要求对会大幅增加灾难性滥用风险的模型采取最严格的保护措施。 ↩︎

来源:Tomer Tunguz 博客(VC 分析) · tomtunguz.com