overview
Stable-Baselines3란 무엇인가요?
Stable-Baselines3는 DLR-RM이 개발한 강화 학습 라이브러리로, 연구원과 산업 전문가가 강화 학습 에이전트를 구현하고 훈련할 수 있도록 합니다. PyTorch를 기반으로 구축된 최첨단 RL 알고리즘의 모듈식이며 잘 테스트된 구현을 제공합니다. 연구 및 실제 응용 프로그램 모두를 위해 설계된 Stable-Baselines3는 낮은 수준의 구현 세부 사항을 추상화하여 강화 학습 에이전트 훈련 및 평가 프로세스를 단순화합니다. 미리 구축된 최적화된 알고리즘을 제공하여 사용자가 실험 및 배포에 집중할 수 있도록 합니다. 이 라이브러리는 OpenAI Gym 및 Gymnasium 환경과 호환되어 표준화된 작업에 대한 훈련과 새로운 RL 알고리즘, 정책 아키텍처 및 보상 형성 전략의 신속한 프로토타이핑을 용이하게 합니다.
