跳到正文
原文
METR:Blog(网页)·· 13 小时前AI 评分40

METR:AI 模型在公开发布前就可能带来危险

AI models can be dangerous before public deployment January 17, 2025 Why pre-deployment testing is not an adequate framework for AI risk management Read more

AI 导读

METR 指出,仅靠部署前测试不足以管理 AI 风险,因为模型在内部使用、训练或存储阶段就可能造成危害。模型权重可能被窃取滥用,实验室员工可能内部误用,AI 智能体也可能自主追求非预期目标。METR 建议加强更早期的危险能力测试与能力预测、模型权重安全与内部监控,并提升透明度与举报人保护。

来源:METR:Blog(网页) · metr.org