overview
Was ist oMLX?
oMLX ist ein lokales LLM inference server Tool, das von oMLX.ai entwickelt wurde und es Entwicklern, KI-Forschern und Mac-Benutzern mit Apple Silicon ermöglicht, große Sprachmodelle lokal mit verbesserter Leistung auszuführen. Es nutzt continuous batching und einen zweistufigen KV cache (RAM + SSD), um die lokale Ausführung von KI-Modellen zu optimieren. Speziell für Apple Silicon Macs entwickelt, fungiert oMLX als spezialisierte AI inference engine, die verschiedene machine learning Modelle unterstützt, darunter text LLMs, vision-language models (VLMs), OCR models, embedding models und rerankers direkt auf dem Gerät des Benutzers. Die Verwaltung ist in die macOS menu bar integriert und bietet eine native Benutzererfahrung.
