跳到正文
原文
OpenRouter:Announcements(RSS)·· 2026-06-30精选AI 评分65

OpenRouter 数据:DeepSeek V4 智能体 token 份额翻倍至 18%

DeepSeek V4 Is Earning Agentic Token Share

AI 导读

OpenRouter 基于 2026 年 1 月 1 日至 6 月 14 日超 450 万亿 token 的请求日志分析,DeepSeek V4 于 4 月 24 日发布后,DeepSeek 的 token 份额从年初约 9% 翻倍至 6 月初近 18%,并自 5 月中旬起成为 OpenRouter 上份额最高的模型,增长主要由智能体负载驱动。

推荐理由

OpenRouter 用自家 450 万亿 token 日志拆解 DeepSeek V4 的份额变化,读者可以据此了解智能体负载与中美模型格局的实际走向。

正文 · AI 翻译

DeepSeek,这家对许多人来说仍与开源 LLM 同义的公司,于 4 月 24 日发布了其新的旗舰 V4 模型。

V4 重置了发展轨迹。六个月内,DeepSeek 在 OpenRouter 上的 token 份额大约翻了一番,而智能体工作负载推动了大部分增长。

当今推动 token 使用量的模型作者

Model authors driving token usage

今年年初,DeepSeek 在 OpenRouter 每周 token 流量中的占比略低于 10%。随着 2 月和 3 月智能体工作开始站稳脚跟,以前所未有的速度推高 token 使用量,DeepSeek 实际上跌至总 token 的 5%。该公司正受到来自上方专有模型和下方一波其他开源 LLM 的挤压。

V4 模型系列的发布产生了立竿见影的积极影响。到 6 月初,DeepSeek 已获得近 20% 的 token 份额,并自 5 月中旬以来一直是 OpenRouter 上的顶级模型。

Token share comparison between January and June 2026

对 2026 年 1 月和 6 月的直接比较显示,模型作者之间的偏好可以多快发生转变。DeepSeek 在此期间实际上将其 token 份额翻了一番(从 9% 到 18%),但许多其他模型提供商经历了命运的重大波动。

包括小米、Minimax 和腾讯在内的一组中国开源模型,在过去 6 个月中 token 份额均有所上升。这似乎是以几家领先的美国模型公司为代价的,特别是 Google 和 OpenAI。

DeepSeek token usage by user type

DeepSeek 的翻倍并不局限于单一用户类型。到 6 月初,各类公司和个人都在使用越来越多的 DeepSeek token。爱好者用户(通常通过角色扮演、通用聊天、个人智能体等面向消费者的应用类别产生大量使用)现在将其所有 token 的近三分之一路由到 DeepSeek 模型。

即使在 AI 原生公司或大型组织的用户中——这两类用户可能都被预期会优先使用前沿闭源模型——他们在 6 月初发送给 DeepSeek 的 token 流量也远多于年初。

DeepSeek V4 pricing comparison

DeepSeek V4 Flash 在最便宜的端点上,每百万 token 输入成本为 0.09 美元 / 输出为 0.18 美元。作为对比,GPT-5.5 目前定价为每百万 token 输入 5 美元 / 输出 30 美元。

因此,看到 V4 的 token 量突然激增并未导致支出份额出现相同幅度的飙升,并不令人意外。V4 的性价比与输出质量之比是同类最佳——事实上,它足够好,以至于各种规模的组织都已开始信任 DeepSeek 处理真正的智能体工作。

V4 是首个足以胜任智能体工作负载的 DeepSeek 模型

Agentic workloads token breakdown

我们在 API 密钥层面将 token 流量分为三个主要类别(智能体、混合和人类)。这些类别根据一个 7 信号加权综合评分来分配,该评分包括工具调用率、轮次计数、间隔时间等输入。

众所周知,智能体工作比普通人类 AI 使用消耗更多 token(根据 OpenRouter 数据,每次请求约多 15 倍)。但值得记住的是,这种智能体 token 的爆炸式增长是 2026 年的现象,直到今年 2 月初才真正开始。

不过,对某些模型作者来说,即使这样说也还是夸大了。

Agentic vs human token usage over time

智能体工作负载使用的 token 在 2 月 1 日前后超过了人类使用的 token。起初,智能体工作仅集中在少数模型作者中,而这一精选群体并不包括 DeepSeek。

V4 的发布标志着 DeepSeek 真正进入智能体工作流竞赛。

V4 Flash agentic token flow

并非所有工作负载都会同时切换到最新模型。上图展示了,在今年前 5 个月里,DeepSeek token 使用中的人类活动如何一直与 DeepSeek V3.2 绑定。

然而,智能体工作负载已将 V4 作为首选模型。到 5 月底,即发布仅一个月后,V4-Flash 已占 DeepSeek 使用中智能体 token 流量的 70%。

DeepSeek 与中国模型的崛起

US vs China token volume

Token 流向由两个国家创建的 LLM:美国和中国(另有极少数其他国家,体现在那一小块米色扇区中)。2026 年 token 总量呈爆炸式增长,但增长并未扩散到其他国家的 LLM。

China token share in 2025 vs 2026

2025 年是美国 token 之年,来自美国的模型约占所用 token 的 3/4。2026 年的竞争则激烈得多,截至 6 月初,中国模型在 token 份额上实际上已超过美国模型。

Chinese models token surge

毫不意外,自 4 月底 V4 发布以来,DeepSeek 在中国模型中一马当先。过去 6 周里,几家美国领先者的 token 使用量趋于平稳,而随着 6 月开始,多家中国竞争对手的 token 量激增。

随着高性价比的 token 使用占据今夏头条,我们预计这些更便宜但依然强大的开源模型将随时间推移继续吸引更多 token。正如《华尔街日报》在这篇近期报道中(引用了 OpenRouter 数据)所提到的,“初创公司和科技巨头都在混合搭配 AI 模型,以避开高昂的价格”。

DeepSeek V4 必定是这一组合的一部分。

方法论说明

关于我们如何汇总这些数字,有几点说明:

  • 来源:OpenRouter 的请求日志。
  • 样本量:2026 年 1 月 1 日至 2026 年 6 月 14 日期间超过 450 万亿 token。
  • 份额指标:所有“份额”数字均指 token 量份额(输入与输出合计),而非支出份额。正如定价部分所述,对于 V4 这类低成本模型,两者可能差异巨大。
  • 活动类型:我们在 API 密钥层面将 token 流量分为三大类(智能体、混合和人类)。这些类别根据一个包含工具调用率、轮次数、间隔时间等输入信号的 7 信号加权综合评分来分配。由于分类发生在密钥层面,一个执行混合工作的单一密钥会按其主导模式而非逐请求来分类。

来源:OpenRouter:Announcements(RSS) · openrouter.ai