跳到正文
原文
METR:Research(网页)·· 12 小时前精选AI 评分68

ARC 发布 GPT-4 与 Claude 危险能力评估更新

Update on ARC's recent eval efforts March 17, 2023 More information about ARC's evaluations of GPT-4 and Claude Read more

AI 导读

ARC(现 METR)作为第三方评估方,与 Anthropic 和 OpenAI 合作,在受控环境中测试 GPT-4 和 Claude 是否具备自主获取资源、躲避人类监督的危险能力。

推荐理由

ARC 以第一方视角给出红队评估的方法与任务实例,读者可了解自主复制能力测试如何设计与执行。

来源:METR:Research(网页) · metr.org