跳到正文
热点事件持续更新

METR提出AI任务时长能力指数增长趋势

1 篇报道1 个报道来源13 小时前更新

先了解这件事

AI 综述

2026年9月30日,METR发布研究提出用“任务时长”衡量AI能力,即按人类专家完成任务所需时间计算模型能以50%可靠性自主完成的任务长度。研究发现,过去6年该指标呈指数增长,翻倍时间约7个月。当前模型对耗时4分钟以内任务成功率近100%,超过约4小时则不足10%;Claude 3.7 Sonnet的50%成功率时间视界约一小时。

AI 根据报道生成 · 10 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. METR:Research精选
    METR 提出"任务时长"指标:AI 可完成任务长度每约 7 个月翻倍

    METR 提出用任务长度(按人类专家耗时衡量)来度量 AI 能力,发现 6 年来模型能以 50% 可靠性自主完成的任务长度呈指数增长,翻倍时间约 7 个月。当前模型对耗时 4 分钟以内任务成功率近 100%,超过约 4 小时则不足 10%;Claude 3.7 Sonnet 的 50% 成功率时间视界约一小时。

本事件热度走势

当前热度 7·可比范围峰值 9(10月1日 02:00)·近 24 小时可比范围变化 –

02.557.51010月1日02:0010月1日05:0010月1日08:0010月1日11:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。