跳到正文
原文
OpenAI:官网动态(RSS · 排除企业/客户案例)·· 2017-06-13精选AI 评分72

OpenAI 与 DeepMind 合作研究从人类偏好中学习

Learning from human preferences

AI 导读

OpenAI 与 DeepMind 安全团队合作开发一种算法,通过让人类判断两个候选行为哪个更好来推断人类意图。该工作旨在免去人工编写目标函数,避免用简单代理近似复杂目标时引发危险行为,是构建安全 AI 系统的一步。

推荐理由

OpenAI 与 DeepMind 安全团队合作的算法,通过人类偏好比较推断目标,减少人工写目标函数带来的风险。

来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · openai.com