overview
¿Qué es NVIDIA Triton Inference Server?
El servidor de inferencia NVIDIA Triton es una solución de código abierto que permite a los desarrolladores desplegar modelos de IA de alto rendimiento en diversos entornos. Con soporte para los principales marcos de trabajo, Triton simplifica el servicio de modelos mientras maximiza el rendimiento y la utilización de recursos.
- Compatibilidad con TensorFlow, PyTorch, ONNX y TensorRT.
- Diseñado para aplicaciones en la nube, en el borde y en centros de datos.
- Opciones de implementación flexibles que incluyen integraciones en servidor y de biblioteca compartida.
