Descrição
Ambientes de reinforcement learning de agente único podem ser criados e exercitados por uma API padrão. Pesquisadores e engenheiros de ML usam Gymnasium em experimentos, benchmarks e ambientes de referência. Resultados dependem de versões de ambientes, sementes, recompensas e limites de segurança para ações simuladas.