overview
Qu'est-ce qu'AWS SageMaker Triton ?
AWS SageMaker Triton simplifie le déploiement et la mise à l'échelle des modèles d'IA en utilisant des conteneurs Triton gérés. Grâce à ses capacités d'autoscaling, il garantit que vos applications répondent efficacement aux variations de charge de travail.
- Déployez efficacement des modèles dans un environnement géré.
- Exploitez l'autoscaling pour maintenir des performances optimales.
- Intégrez-vous à TensorRT pour une vitesse d'exécution améliorée.
