"SimulatedCartPole" (強化学習環境)
"SimulatedCartPole" (強化学習環境)
例題
例 (2)
env = DeviceOpen["SimulatedCartPole"]observe1 = DeviceRead[env]DeviceExecute[env, "Render"]action = DeviceExecute[env, "RandomAction"]observe2 = DeviceExecute[env, "Step", action]アクションを取ると,通常"ObservedState"が修正される:
observe1["ObservedState"] == observe2["ObservedState"]環境を初期状態に再設定する.初期の"ObservedState"が回復される:
DeviceExecute[env, "Reset"]DeviceClose[env]env = DeviceOpen["SimulatedCartPole"]ランダムなエージェントがカートを抑制している様子を可視化する:
DeviceExecute[env, "Reset"];ListAnimate[Table[(DeviceExecute[env, "Step", DeviceExecute[env, "RandomAction"]];DeviceExecute[env, "Render"]), 30]]履歴
2019 で導入 (12.0)