MLX ускорил Ollama в 2 раза на Mac — почему MoE-модели выиграли больше всех Ollama 0.19 переходит с llama.cpp на Apple MLX и получает двукратный прирост на Mixture of Experts моделях. Обычные плотные архитектуры ускоряются на 40-60%, а MoE вроде Qwen3.5-35B-A3B — в 2 раза. Причина — MLX заточен под унифицированную память Apple Silicon и эффективно маршрутизирует экспертов без копирования данных между CPU и GPU. Почему MLX быстрее llama.cpp на Apple Silicon Четыре технических преимущества: Унифиц…