关于 open AI gym 运行报错
作者: Jackmeory创建于 2022年9月17日更新于 2024年5月25日
我下载了DQN的代码,发现运行时出现错误,主要错误出现在两个地方: 1.choose_action(self, observation): observation = observation[np.newaxis, :] 出现错误为TypeError: tuple indices must be integers or slices, not tuple 2.在修改第一部分的错误之后(通过课程讨论区的一位朋友提供的想法先将observation=np.array(observation)再进行reshape,发现在transition部分又出现错误,提示输入的transition和self.memory列数不同,在打印observation之后发现它的格式很奇怪,是(array([0.00107828, -0.02266533, -0.03175206, -0.04841794], dtype=float32), {}))这样的形式,和observation_的形式也不同,我又回去检查了maze的observation和observation_的形式发现maze是相同的,不知道该如何修改RL_brain的代码,希望大神们能给点建议
内容来源: MorvanZhou/Reinforcement-learning-with-tensorflow