overview
O que é Stable-Baselines3?
Stable-Baselines3 é uma biblioteca de aprendizado por reforço desenvolvida por DLR-RM que permite a pesquisadores e profissionais da indústria implementar e treinar agentes de aprendizado por reforço. Ela fornece implementações modulares e bem testadas de algoritmos de RL de última geração construídos sobre PyTorch. Projetado tanto para pesquisa quanto para aplicações práticas, Stable-Baselines3 simplifica o processo de treinamento e avaliação de agentes de aprendizado por reforço, abstraindo detalhes de implementação de baixo nível. Ele oferece algoritmos pré-construídos e otimizados, permitindo que os usuários se concentrem na experimentação e implantação. A biblioteca é compatível com ambientes OpenAI Gym e Gymnasium, facilitando o treinamento em tarefas padronizadas e a prototipagem rápida de novos algoritmos de RL, arquiteturas de política e estratégias de modelagem de recompensa.
