跳到正文
热点事件持续更新

本地模型实测:质量接近云端,可完成约半成日常任务

2 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年9月30日,Tom Tunguz 在博客发布实测:用25个VC任务对比 DeepSeek V4 云端模型与两个本地模型,judge 模型盲评显示三者质量接近(8.0左右),但路径不同。10月2日,Tunguz 再发博客称,五周实测显示本地35B模型可完成约一半日常任务,其中 Email & Inbound、Scheduling、Summarization 与 Admin 合计618项(41.8%)。

AI 根据报道生成 · 1 小时前更新

事件进展

2 个进展

  1. 10月2日 22:49 · 1 篇报道
    Localmaxxing:本地模型能完成一半日常工作
    Tomer Tunguz 博客(VC 分析):Localmaxxing:本地模型能完成一半日常工作
  2. 9月30日 23:27 · 1 篇报道
    本地小模型通过更多推理达到云端大模型同等能力
    Tomer Tunguz 博客(VC 分析):Tom Tunguz 实测 Qwen3.8-27B 本地模型, birds fly like bumblebees 而非飞机

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. Tomer Tunguz 博客(VC 分析)
    Localmaxxing:本地模型能完成一半日常工作

    五周实测显示,本地 35B 模型可完成约一半日常任务,其中 Email & Inbound、Scheduling、Summarization 与 Admin 合计 618 项(41.8%)。

9月30日
  1. Tomer Tunguz 博客(VC 分析)精选
    Tom Tunguz 实测 Qwen3.8-27B 本地模型, birds fly like bumblebees 而非飞机

    Tom Tunguz 用 25 个 VC 任务对比 DeepSeek V4 云端模型与两个本地模型,judge 模型盲评显示三者质量接近(8.0 左右),但路径不同。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。