Comparing SARSA(λ) and PPO algorithms for bicycle riding tasks.. No. of environments: 2
Solving Twisty Puzzles with Reinforcement Learning(Parallel Q-Learning). No. of environments: 7
This repo contains two safety RL benchmark environments: safety-gym, and bullet-safety-gym.. No. of environments: 18
Safety-Gymnasium is a standard API for safe reinforcement learning, and a diverse collection of reference environments.. No. of environments: 555