跳到正文
热点事件持续更新

Grok 4.7 登顶 VulcanBench Frontier v4

2 篇报道2 个报道来源52 分钟前更新

先了解这件事

AI 综述

xAI 的 Grok 4.7 在针对高难度编程任务的基准测试 VulcanBench Frontier v4 上排名第一,其获胜运行得分 93.15,并通过全部 23 项任务,前三名均由 Grok 4.7 占据。该消息最早由 X 用户 cb_doge 发布。 xAI 的马斯克随后称,Grok 4.7 在该测试中占据前三,表现优于 Fable 5.1、Opus 5.5、GPT-6 Astra、GPT-6.1 Sol 等前沿模型,并称其擅长处理大型代码仓库。上述成绩与对比说法均来自发布者,测试方未在报道中给出说明。

AI 根据报道生成 · 31 分钟前更新

最新进展10月6日 23:32
Grok 4.7 擅长处理大型代码仓库

报道时间线

沿着报道,了解事件的不同侧面。

10月6日
  1. Elon Musk
    Grok 4.7 擅长处理大型代码仓库

    Grok 4.7 非常擅长处理大型代码仓库。

  2. cb_doge
    Grok 4.7 登顶 VulcanBench Frontier v4

    突发:Grok 4.7 在 VulcanBench Frontier v4 上拿下第一,这是一个针对高难度编程任务的基准测试。🥇 前三名全部属于 Grok 4.7。其获胜运行得分 93.15,并通过全部 23 项任务。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。