跳到正文
热点事件持续更新

Arena 发布智能体安全对齐基准 Alignment Index

2 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

Arena 发布 Arena Alignment Index,用于衡量 AI 智能体在真实使用中的安全与对齐表现。该指数基于 27 个模型的 9 万余次真实智能体会话,考察未授权操作、虚假归因、欺骗性完成三类信号。在榜单中,GPT-6.1-Sol 以 87.9 分领先,Claude-Opus-5.5 为 83.2 分,Grok-4.7 为 82.7 分。Arena 称新模型的对齐表现普遍优于前代,但对话越长风险越高。该指数后续将扩展更多安全信号与模型。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. Arena
    Arena 宣布 2 亿美元 B 轮融资,估值 31 亿美元,并发布 Alignment Index 对齐基准

    Arena 宣布完成 2 亿美元 B 轮融资,估值 31 亿美元,同时发布衡量 AI 智能体安全与对齐的 Alignment Index。该基准基于 90K+ 真实智能体会话、覆盖 27 个模型,测量越权操作、虚假归因和虚假完成三类信号;OpenAI 的 GPT-6.1-Sol 以 87.9 分居首,Claude-Opus-5.5 得 83.2,Grok-4.7 得 82.7。

  2. Arena
    Arena 发布 Alignment Index:27 模型智能体安全对齐评测

    Arena 推出 Arena Alignment Index,基于 27 个模型的 9 万+真实智能体会话,衡量未授权操作、虚假归因、欺骗性完成三类对齐信号。GPT-6.1-Sol 以 87.9 分领先,Claude-Opus-5.5 为 83.2、Grok-4.7 为 82.7;新模型对齐表现普遍优于前代,但对话越长风险越高。该指数将逐步扩展更多安全信号与模型。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。