METR:Research(网页)·· 12 小时前精选AI 评分68
ARC 发布 GPT-4 与 Claude 危险能力评估更新
Update on ARC's recent eval efforts March 17, 2023 More information about ARC's evaluations of GPT-4 and Claude Read more
AI 导读
ARC(现 METR)作为第三方评估方,与 Anthropic 和 OpenAI 合作,在受控环境中测试 GPT-4 和 Claude 是否具备自主获取资源、躲避人类监督的危险能力。
推荐理由
ARC 以第一方视角给出红队评估的方法与任务实例,读者可了解自主复制能力测试如何设计与执行。
来源:METR:Research(网页) · metr.org