METR:Blog(网页)·· 13 小时前AI 评分40
METR:AI 模型在公开发布前就可能带来危险
AI models can be dangerous before public deployment January 17, 2025 Why pre-deployment testing is not an adequate framework for AI risk management Read more
AI 导读
METR 指出,仅靠部署前测试不足以管理 AI 风险,因为模型在内部使用、训练或存储阶段就可能造成危害。模型权重可能被窃取滥用,实验室员工可能内部误用,AI 智能体也可能自主追求非预期目标。METR 建议加强更早期的危险能力测试与能力预测、模型权重安全与内部监控,并提升透明度与举报人保护。
来源:METR:Blog(网页) · metr.org