AI圈报
模型发布 / 更新精选

OpenAI 发布强化学习算法 Proximal Policy Optimization (PPO)

信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例)·
原始标题:Proximal Policy Optimization

内容摘要

OpenAI 发布一类新的强化学习算法 Proximal Policy Optimization(PPO),性能与当时最先进方法相当或更好,同时实现和调参更简单。因易用且表现良好,PPO 已成为 OpenAI 内部默认的强化学习算法。
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源OpenAI:官网动态(RSS · 排除企业/客户案例)
站内情报编号intel-1ce05c3fcf69e1000af1e9ee