OpenAI:官网动态(RSS · 排除企业/客户案例)·· 2017-06-13精选AI 评分72
OpenAI 与 DeepMind 合作研究从人类偏好中学习
Learning from human preferences
AI 导读
OpenAI 与 DeepMind 安全团队合作开发一种算法,通过让人类判断两个候选行为哪个更好来推断人类意图。该工作旨在免去人工编写目标函数,避免用简单代理近似复杂目标时引发危险行为,是构建安全 AI 系统的一步。
推荐理由
OpenAI 与 DeepMind 安全团队合作的算法,通过人类偏好比较推断目标,减少人工写目标函数带来的风险。
来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · openai.com