问题: 关于 "gym.vector.SyncVectorEnv"
作者: Missourl创建于 2022年12月17日更新于 2025年4月29日
你好, 关于 "gym.vector.SyncVectorEnv",在文档中有这样的解释:"不同的环境副本是按顺序执行的。" 我的问题是,你的意思是顺序执行吗?每个回合我们执行一个环境吗? 也许可以澄清我的问题,我解释一下我要做的事情: 我试图使用 DDPG(stable baseline3)来解决一个问题。 我想知道,我们如何在每个回合中改变环境的采样值,并且它应该是可重现的。 例如,假设我们有一个环境,我们采集能量,我们假设采集的能量是正态分布,然后在每个回合中,我将采样不同的采集能量值。 我只想再次强调,我希望采集的不同能量值是可重现的,这样我就可以将 RL 方法与其他方法进行比较。 PS:客户环境已经创建好了,我可以在每个回合中更改采样值(使用 seed,其输入为回合 "i"),现在我的问题是如何将其与 gym 和 stable baseline 的代码相结合。 我认为 "gym.vector.SyncVectorEnv" 是我的解决方案,但我不确定。 谢谢
内容来源: openai/gym