"SimulatedCartPole" (强化的学习环境)
"SimulatedCartPole" (强化的学习环境)
范例
基本范例 (2)
env = DeviceOpen["SimulatedCartPole"]observe1 = DeviceRead[env]DeviceExecute[env, "Render"]action = DeviceExecute[env, "RandomAction"]observe2 = DeviceExecute[env, "Step", action]observe1["ObservedState"] == observe2["ObservedState"]重设环境为初始状态. 返回初始的 "ObservedState":
DeviceExecute[env, "Reset"]DeviceClose[env]env = DeviceOpen["SimulatedCartPole"]DeviceExecute[env, "Reset"];ListAnimate[Table[(DeviceExecute[env, "Step", DeviceExecute[env, "RandomAction"]];DeviceExecute[env, "Render"]), 30]]历史
2019年引入 (12.0)