您好,欢迎光临本网站![请登录][注册会员]  

搜索资源列表

  1. 一种基于启发式奖赏函数的分层强化学习方法

  2. 针对强化学习在应用中经常出现的"维数灾"问题,即状态空间的大小随着特征数量的增加而发生指数级的增长,以及收敛速度过慢的问题,提出了一种基于启发式奖赏函数的分层强化学习方法.该方法不仅能够大幅度减少环境状态空间,还能加快学习的收敛速度.将此算法应用到俄罗斯方块的仿真平台中,通过对实验中的参数进行设置及对算法性能进行分析,结果表明:采用启发式奖赏函数的分层强化学习方法能在一定程度上解决"维数灾"问题,并具有很好的收敛速度.
  3. 所属分类:其它

    • 发布日期:2021-02-24
    • 文件大小:454kb
    • 提供者:weixin_38556737