跳到正文
原文
Tomer Tunguz 博客(VC 分析)·· 2 小时前精选AI 评分72

Tomer Tunguz 分析:从 GPT-4o 到 Gemma 4 E4B,前沿能力 23 个月进入手机

Pocket Power : From State of the Art to Your Phone in 23 Months

AI 导读

Google 上周发布 Gemma 4 E4B,可在手机上完全本地运行,在 MATH、GSM8K、GPQA Diamond、HumanEval 等基准上匹配或超过 GPT-4o。

推荐理由

作者用 450 倍参数压缩和 23 个月时滞两个数字,把前沿模型能力下沉到手机的节奏讲成可量化的规律。

正文 · AI 翻译

简而言之: 最先进的 AI 只需 3-4 个月就能到达你的笔记本电脑,23 个月到达你的手机。Google 的 Gemma 4 E4B 与 GPT-4o 相当,并且完全在你的手机上运行。

两年前,在手机上使用有用的 AI 还是天方夜谭。Siri 连一句话都说不完整。本地模型会胡言乱语。

上周,Google 发布了 Gemma 4 E4B1,这是一个免费模型,与 GPT-4o 相当,并且完全在你的手机上运行。2

接下来几周还会有更先进的袖珍模型问世。市场预计 DeepSeek3、Qwen4、Kimi5 和 Minimax6 将发布新版本。

前沿模型不会长期保持前沿。三到四个月内,你就能在笔记本电脑上运行性能相近的模型;23 个月后,你就能在手机上运行同样的模型。

Parameters Required for GPT-4o-Level HumanEval Score : 450x compression in 23 months

有三股力量在推动这种压缩。更好的算法:蒸馏和强化学习将更多能力压缩进更少的参数中。人才密度:资本主义中最大的奖赏吸引着该领域最优秀的人才。这些是历史上增长最快的软件公司。还有资本:一万亿美元投入数据中心,为训练提供算力。

在 23 个月里,曾经需要 1.8 万亿参数的能力如今只需 40 亿参数。压缩了 450 倍。按照这个速度,在你换手机之前,你口袋里的手机就能运行今天的前沿模型。


  1. iOS App Store 上的 Google AI Edge Gallery ↩︎

  2. Gemma 4 E4B 在包括 MATH、GSM8K、GPQA Diamond 和 HumanEval 在内的多项基准测试中达到或超过 GPT-4o。完整基准对比 ↩︎

  3. DeepSeek 的新 AI 模型 ↩︎

  4. Qwen 3.6 ↩︎

  5. Kimi K3 ↩︎

  6. MiniMax M2.5 发布 ↩︎

下一期发送到你的收件箱

用 1 分钟阅读,把技术数据转化为战略优势。
150k+ 创始人和运营者正在阅读。

Theory Ventures 的 GP。前 Google PM。分享关于 AI、web3 和风险投资的数据驱动洞察。

Bloomberg • WSJ • Economist

来源:Tomer Tunguz 博客(VC 分析) · tomtunguz.com