Arena 发布智能体安全对齐基准 Alignment Index
热点事件持续更新
Arena 发布智能体安全对齐基准 Alignment Index
2 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
Arena 发布 Arena Alignment Index,用于衡量 AI 智能体在真实使用中的安全与对齐表现。该指数基于 27 个模型的 9 万余次真实智能体会话,考察未授权操作、虚假归因、欺骗性完成三类信号。在榜单中,GPT-6.1-Sol 以 87.9 分领先,Claude-Opus-5.5 为 83.2 分,Grok-4.7 为 82.7 分。Arena 称新模型的对齐表现普遍优于前代,但对话越长风险越高。该指数后续将扩展更多安全信号与模型。
AI 根据报道生成 · 2 小时前更新
最新进展10月9日 00:02
Arena 发布 Alignment Index:27 模型智能体安全对齐评测报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- ArenaArena 宣布 2 亿美元 B 轮融资,估值 31 亿美元,并发布 Alignment Index 对齐基准
Arena 宣布完成 2 亿美元 B 轮融资,估值 31 亿美元,同时发布衡量 AI 智能体安全与对齐的 Alignment Index。该基准基于 90K+ 真实智能体会话、覆盖 27 个模型,测量越权操作、虚假归因和虚假完成三类信号;OpenAI 的 GPT-6.1-Sol 以 87.9 分居首,Claude-Opus-5.5 得 83.2,Grok-4.7 得 82.7。
- ArenaArena 发布 Alignment Index:27 模型智能体安全对齐评测
Arena 推出 Arena Alignment Index,基于 27 个模型的 9 万+真实智能体会话,衡量未授权操作、虚假归因、欺骗性完成三类对齐信号。GPT-6.1-Sol 以 87.9 分领先,Claude-Opus-5.5 为 83.2、Grok-4.7 为 82.7;新模型对齐表现普遍优于前代,但对话越长风险越高。该指数将逐步扩展更多安全信号与模型。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。