对于大迷宫(例如 100x100)的求解问题,哪些强化学习算法是适合的?
作者: TimDingg创建于 2020年6月12日更新于 2024年5月1日
教学中的迷宫规模都比较小,不复杂。如果想要求解大规模的迷宫,且环境比较复杂,应该选择什么强化学习算法?我尝试了几种算法,发现Q-learning似乎没有求出最优解,而DQN的训练速度太慢,难以求得解。我想问一下是什么原因导致了这些问题,是随机策略选择还是其他参数设置的问题?或者有什么比较适合的强化学习算法吗?求大神指导!谢谢!
内容来源: MorvanZhou/Reinforcement-learning-with-tensorflow