关于DDPG算法
作者: zhenbin-li创建于 2022年10月26日更新于 2022年11月20日
def choose_action(self, s): s = s[np.newaxis, :] # single state return self.sess.run(self.a, feed_dict={S: s})[0] # single action
内容来源: MorvanZhou/Reinforcement-learning-with-tensorflow
def choose_action(self, s): s = s[np.newaxis, :] # single state return self.sess.run(self.a, feed_dict={S: s})[0] # single action
内容来源: MorvanZhou/Reinforcement-learning-with-tensorflow