Prime Intellect用AI Agent刷新nanoGPT纪录
先了解这件事
2026年9月30日,Prime Intellect发布消息称,其让Codex(gpt 5.5 xhigh)与Claude Code(opus 4.7 xhigh)两个AI Agent在nanoGPT speedrun Track 3优化器赛道上自主迭代两周,累计约10k次运行、约14k H200小时。报道称两个Agent均打破人类基线,其中Opus以2930步刷新纪录,人类基线为2990步。同日,METR发布分析,对NanoGPT speedrun的77条记录进行分类,指出2024年5月至2026年3月间36名贡献者将训练时间从45分钟降到1.43分钟,共31x提速。METR同日还提出“支出视界”指标,用人类与智能体在优化问题上成本收益曲线的交点来量化智能体优化能力,并以NanoGPT speedrun为例指出人类每提升1%训练速度约需16小时劳动。这是该事件目前已知的最新进展,此前暂无更早报道可供对照。
AI 根据报道生成 · 11 小时前更新
事件进展
- 9月30日 23:28 · 1 篇报道Prime Intellect用Codex和Claude Code刷新nanoGPT速度记录Prime Intellect:Prime Intellect 让 Codex 与 Claude Code 自主刷新 nanoGPT speedrun 优化器纪录
- 9月30日 23:28 · 1 篇报道METR分析NanoGPT速度挑战中AI与人类贡献METR:Notes:METR 分析 NanoGPT speedrun 中人类与 AI 智能体的贡献
- 9月30日 23:28 · 1 篇报道METR提出“支出地平线”衡量AI代理优化能力METR:Research:METR 提出支出视界指标,以 NanoGPT 竞速度量 AI 智能体优化能力
报道时间线
沿着报道,了解事件的不同侧面。
- Prime Intellect精选Prime Intellect 让 Codex 与 Claude Code 自主刷新 nanoGPT speedrun 优化器纪录
Prime Intellect 让 Codex(gpt 5.5 xhigh)和 Claude Code(opus 4.7 xhigh)在 nanoGPT speedrun Track 3 优化器赛道上自主迭代两周,约 10k 次运行、约 14k H200 小时,两个 Agent 均打破人类基线,Opus 以 2930 步刷新纪录(人类基线 2990)。
- METR:NotesMETR 分析 NanoGPT speedrun 中人类与 AI 智能体的贡献
METR 研究人员对 NanoGPT speedrun 的 77 条记录分类,2024 年 5 月至 2026 年 3 月间 36 名贡献者将训练时间从 45 分钟降到 1.43 分钟,共 31x 提速。
- METR:ResearchMETR 提出支出视界指标,以 NanoGPT 竞速度量 AI 智能体优化能力
METR 提出"支出视界"指标,用人类与智能体在优化问题上成本收益曲线的交点来量化智能体优化能力。以 NanoGPT speedrun 为例,人类每提升 1% 训练速度约需 16 小时劳动。
本事件热度走势
当前热度 22·可比范围峰值 29(10月1日 01:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。