overview
Qu'est-ce qu'oMLX ?
oMLX est un outil de serveur d'inférence LLM local développé par oMLX.ai qui permet aux développeurs, aux chercheurs en IA et aux utilisateurs de Mac avec Apple Silicon d'exécuter des grands modèles de langage localement avec des performances améliorées. Il utilise le batching continu et un cache KV à deux niveaux (RAM + SSD) pour optimiser l'exécution locale des modèles d'IA. Conçu spécifiquement pour les Mac Apple Silicon, oMLX agit comme un moteur d'inférence IA spécialisé, prenant en charge divers modèles d'apprentissage automatique, y compris les LLM textuels, les modèles vision-langage (VLM), les modèles OCR, les modèles d'embedding et les rerankers directement sur l'appareil de l'utilisateur. Sa gestion est intégrée à la barre de menu de macOS, offrant une expérience utilisateur native.
