跳到正文
Artificial Analysis· @ArtificialAnlys · X·· 3 小时前同新闻AI 评分68
AI 导读

Mistral 发布 Mistral Large 4 Research Public Preview,Artificial Analysis 智能指数得分 38,与 GPT-6 Luna(max,38)相当,是美国和中国之外最智能的模型。

同一新闻,精选展示《Mistral 发布 Mistral Large 4 公测预览,1 万亿参数开放权重模型月底释出》

正文 · AI 翻译

Mistral 发布了 Mistral Large 4,在 Artificial Analysis Intelligence Index 上得分 38;法国重新拥有了来自美国和中国之外的最智能模型

@MistralAI 已在 Research Public Preview 中发布 Mistral Large 4,并计划在 10 月底发布这个 1T 参数(49B 激活)模型的权重。它在 Artificial Analysis Intelligence Index 上达到 38,与 GPT-6 Luna(max,38)和 DeepSeek V4.1 Flash(max,39)相当。它还在 Artificial Analysis Cyber Index 上达到 50%,与 GLM-5.3-Flash 持平,并领先于 Kimi K3 和 DeepSeek V4.1 Flash(max)等模型。

Mistral Large 4 Preview 的关键基准测试结果:

➤ 来自美国和中国之外的最智能模型:Mistral Large 4 Preview 在 Intelligence Index 上得分 38,与 DeepSeek V4.1 Flash(max,39)和 GPT-6 Luna(max,38)相当。这使其成为来自美国和中国之外的最智能模型,领先于韩国和阿联酋等国家

➤ 在网络防御能力上与 GLM-5.3-Flash 持平:Mistral Large 4 Preview 在 Artificial Analysis Cyber Index 上得分 50,与 GLM-5.3-Flash(50)持平,落后于 MiMo-V2.6-Pro(56)。一旦其权重发布,它将在 Cyber Index 上跻身前三名开放权重模型。其最强结果是在 CyberGym-E2E-AA 上,得分 82%,领先于 MiMo-V2.6-Pro(79%)和 GPT-6 Luna(max,78%)

➤ 每任务成本是同等智能开放权重模型的 4 倍以上:Mistral Large 4 Preview 的每 Intelligence Index 任务成本为 $1.13,标准定价为每 1M 输入/输出 tokens $1.36/$4.18,每 1M 缓存输入 tokens 为 $0.14。前两周,Mistral Large 4 Preview 将以 50% 发布折扣提供服务,使其每任务成本降至 $0.57。这仍比 GLM-5.3-Flash($0.25)和 DeepSeek V4.1 Flash(max,$0.27)更贵

➤ 强大的文档和图像推理能力:Mistral Large 4 Preview 在 GDP.pdf 上得分 19%,与 MiMo-V2.6-Pro(19%)持平,落后于 Kimi K3(22%)。这比 Mistral Large 3 提升了 18 个百分点,部分原因是其 API 的改进,现在每次请求可接受 100 张图像,而此前 Mistral 模型为 8 张

关键模型细节:

➤ 上下文窗口:512k tokens

➤ 多模态:文本和图像输入,文本输出

➤ 定价:每 1M 输入/输出 tokens $1.36/$4.18(每 1M 缓存输入 tokens $0.14),前两周 50% 折扣($0.68/$2.09)

➤ 可用性:在 Mistral 的 API 上提供 Research Public Preview,计划于 10 月底开放权重

来源:Artificial Analysis · x.com