OpenAI:官网动态(RSS · 排除企业/客户案例)·· 2017-07-20精选AI 评分75
OpenAI 发布强化学习算法 Proximal Policy Optimization(PPO)
Proximal Policy Optimization
AI 导读
OpenAI 发布一类新的强化学习算法 Proximal Policy Optimization(PPO),性能与当时最先进方法相当或更好,且实现和调参更简单。凭借易用性和良好表现,PPO 已成为 OpenAI 的默认强化学习算法。
推荐理由
原文说明 PPO 性能可比肩或超过 SOTA 方法且更易实现调参,读者可据此了解它为何成为 OpenAI 默认强化学习算法。
来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · openai.com