标签【q-learning】 - 码上欢乐

【强化学习】python 实现 q-learning 例一

本文作者：hhh5460 本文地址：https://www.cnblogs.com/hhh5460/p/10134018.html 问题情境 -o---T# T 就是宝藏的位置, o 是探索者的位置这一次我们会用 q-learning 的方法实现一个小例子，例子的环境是一个一维世界，在世 ...

【强化学习】python 实现 q-learning 例二

本文作者：hhh5460 本文地址：https://www.cnblogs.com/hhh5460/p/10134855.html 问题情境一个2*2的迷宫，一个入口，一个出口，还有一个陷阱。 ...

【强化学习】python 实现 q-learning 例五（GUI）

本文作者：hhh5460 本文地址：https://www.cnblogs.com/hhh5460/p/10143579.html 感谢pengdali，本文的 class Maze 参考了他的博 ...

【强化学习】python 实现 q-learning 迷宫通用模板

本文作者：hhh5460 本文地址：https://www.cnblogs.com/hhh5460/p/10145797.html 0.说明这里提供了二维迷宫问题的一个比较通用的模板，拿到后 ...

【强化学习】python 实现 q-learning 例三（例一改写）

本文作者：hhh5460 本文地址：https://www.cnblogs.com/hhh5460/p/10139738.html 例一的代码是函数式编写的，这里用面向对象的方式重新撸了一遍。好处 ...

【强化学习】python 实现 q-learning 例四（例二改写）

将例二改写成面向对象模式，并加了环境！不过更新环境的过程中，用到了清屏命令，play()的时候，会有点问题。learn()的时候可以勉强看到:P 0.效果图 1.完整代码相 ...

【强化学习】用pandas 与 numpy 分别实现 q-learning, saras, saras(lambda)算法

本文作者：hhh5460 本文地址：https://www.cnblogs.com/hhh5460/p/10159331.html 特别感谢：本文的三幅图皆来自莫凡的教程 https://morv ...

相关标签