2019 年 1月 29 日随笔档案 - 刘建平Pinard

2019年1月29日

摘要：在强化学习(十四) Actor-Critic中，我们讨论了Actor-Critic的算法流程，但是由于普通的Actor-Critic算法难以收敛，需要一些其他的优化。而Asynchronous Advantage Actor-critic(以下简称A3C)就是其中比较好的优化算法。本文我们讨论A3C 阅读全文

posted @ 2019-01-29 18:09 刘建平Pinard 阅读(68002) 评论(144) 推荐(4) 编辑

刘建平Pinard

十五年码农，对数学统计学，数据挖掘，机器学习，大数据平台，大数据平台应用开发，大数据可视化感兴趣。

公告