overview
Qu'est-ce que Stable-Baselines3 ?
Stable-Baselines3 est une bibliothèque d'apprentissage par renforcement développée par DLR-RM qui permet aux chercheurs et aux professionnels de l'industrie d'implémenter et d'entraîner des agents d'apprentissage par renforcement. Elle fournit des implémentations modulaires et bien testées d'algorithmes d'apprentissage par renforcement (RL) de pointe construits sur PyTorch. Conçue pour la recherche et les applications pratiques, Stable-Baselines3 simplifie le processus d'entraînement et d'évaluation des agents d'apprentissage par renforcement en masquant les détails d'implémentation de bas niveau. Elle offre des algorithmes pré-construits et optimisés, permettant aux utilisateurs de se concentrer sur l'expérimentation et le déploiement. La bibliothèque est compatible avec les environnements OpenAI Gym et Gymnasium, facilitant l'entraînement sur des tâches standardisées et le prototypage rapide de nouveaux algorithmes RL, d'architectures de politiques et de stratégies de façonnage des récompenses.
