← Все статьи

MTPLX против oMLX

· Источник: оригинал

🏎️ MTPLX против oMLX: разница в скорости локального инференса LLM на Mac — 2,8–6,4×

Сравнение двух MLX-серверов — MTPLX и oMLX — вышло 03 October 2026. Прогоны шли на MacBook Pro с чипом M4 Max, тестовая модель — Qwen3.8-27B. Заявленная разница в скорости локального инференса LLM на Mac: 3–6×. По результатам прогонов MTPLX заканчивал задачу в 2,8–6,4 раза быстрее, чем oMLX.

Фишка MTPLX — multi-token prediction (MTP), многотокенное предсказание.

Поводом для сравнения стал разговор с ChatGPT: тот посоветовал oMLX как более быстрый и качественный вариант на M4 Max. На практике совет не подтвердился 🧪

Это продолжение серии. Первая часть статьи называлась «Локальный агент для кода на Mac: MTPLX + pi + Qwen3.8-27B» — там кодовый агент pi посадили на локальную Qwen3.8-27B через MTPLX.

Нюансы тестов: на скрытых прогонах связки MTPLX и oMLX сравнялись. Сборки модели разные, и каждый режим на oMLX запускался по одному разу. Разбор целиком — в статье на habr.com

🛠️ Хочешь применять это на практике?

По мотивам новости — подборка промптов для разработчиков из нашей библиотеки:

🔗 Вся библиотека промптов · Категория «Программирование»

Готовый продукт по теме: 50 промптов для ChatGPT, которые экономят 10+ часов в неделю — забрать и применить сразу.

AIАвтоматизация

🎁 Забери бесплатный набор AI-промптов

6 отобранных промптов для бизнеса, кода и контента + доступ к библиотеке 2000+. Без оплаты.

✈️ Получить набор в Telegram

Нужны готовые автоматизации для вашего бизнеса?

Смотреть продукты