跳到正文
原文
METR:Blog(网页)·· 13 小时前AI 评分40

METR 谈前沿 AI 模型风险应披露哪些信息

What should companies share about risks from frontier AI models? June 27, 2025 Current views on information relevant for visibility into frontier AI risk. Read more

AI 导读

METR 提出前沿 AI 风险透明度框架,主张企业披露训练与开发过程信息,而非仅公开部署时的 system cards。其列举的风险领域包括内部与外部能力差距、模型是否追求错位目标、模型能否破坏安全研究,以及少数员工能否窃取模型权重或植入后门。METR 同时提醒透明度存在权衡,如可能促使开发者回避发现安全问题,并建议采用仅向政府或外部安全研究者披露、经可信中介脱敏汇总等部分透明方案。

来源:METR:Blog(网页) · metr.org