overview
¿Qué es oMLX?
oMLX es una herramienta de servidor de inferencia LLM local desarrollada por oMLX.ai que permite a desarrolladores, investigadores de IA y usuarios de Mac con Apple Silicon ejecutar modelos de lenguaje grandes localmente con un rendimiento mejorado. Utiliza batching continuo y una caché KV de dos niveles (RAM + SSD) para optimizar la ejecución local de modelos de IA. Diseñado específicamente para Macs con Apple Silicon, oMLX actúa como un motor de inferencia de IA especializado, compatible con varios modelos de machine learning, incluyendo LLMs de texto, vision-language models (VLMs), OCR models, embedding models y rerankers directamente en el dispositivo del usuario. Su gestión está integrada en la macOS menu bar, proporcionando una experiencia de usuario nativa.
