热点事件持续更新
本地模型实测:质量接近云端,可完成约半成日常任务
2 篇报道1 个报道来源2 小时前更新
先了解这件事
AI 综述
2026年9月30日,Tom Tunguz 在博客发布实测:用25个VC任务对比 DeepSeek V4 云端模型与两个本地模型,judge 模型盲评显示三者质量接近(8.0左右),但路径不同。10月2日,Tunguz 再发博客称,五周实测显示本地35B模型可完成约一半日常任务,其中 Email & Inbound、Scheduling、Summarization 与 Admin 合计618项(41.8%)。
AI 根据报道生成 · 1 小时前更新
最新进展10月2日 22:49
Tunguz 称五周实测中本地35B模型可完成约一半日常任务。事件进展
2 个进展
- 10月2日 22:49 · 1 篇报道Localmaxxing:本地模型能完成一半日常工作Tomer Tunguz 博客(VC 分析):Localmaxxing:本地模型能完成一半日常工作
- 9月30日 23:27 · 1 篇报道本地小模型通过更多推理达到云端大模型同等能力Tomer Tunguz 博客(VC 分析):Tom Tunguz 实测 Qwen3.8-27B 本地模型, birds fly like bumblebees 而非飞机
报道时间线
沿着报道,了解事件的不同侧面。
10月2日
- Tomer Tunguz 博客(VC 分析)Localmaxxing:本地模型能完成一半日常工作
五周实测显示,本地 35B 模型可完成约一半日常任务,其中 Email & Inbound、Scheduling、Summarization 与 Admin 合计 618 项(41.8%)。
9月30日
- Tomer Tunguz 博客(VC 分析)精选Tom Tunguz 实测 Qwen3.8-27B 本地模型, birds fly like bumblebees 而非飞机
Tom Tunguz 用 25 个 VC 任务对比 DeepSeek V4 云端模型与两个本地模型,judge 模型盲评显示三者质量接近(8.0 左右),但路径不同。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。