MTPLX против oMLX
· Источник: оригинал
🏎️ MTPLX против oMLX: разница в скорости локального инференса LLM на Mac — 2,8–6,4×
Сравнение двух MLX-серверов — MTPLX и oMLX — вышло 03 October 2026. Прогоны шли на MacBook Pro с чипом M4 Max, тестовая модель — Qwen3.8-27B. Заявленная разница в скорости локального инференса LLM на Mac: 3–6×. По результатам прогонов MTPLX заканчивал задачу в 2,8–6,4 раза быстрее, чем oMLX.
Фишка MTPLX — multi-token prediction (MTP), многотокенное предсказание.
Поводом для сравнения стал разговор с ChatGPT: тот посоветовал oMLX как более быстрый и качественный вариант на M4 Max. На практике совет не подтвердился 🧪
Это продолжение серии. Первая часть статьи называлась «Локальный агент для кода на Mac: MTPLX + pi + Qwen3.8-27B» — там кодовый агент pi посадили на локальную Qwen3.8-27B через MTPLX.
Нюансы тестов: на скрытых прогонах связки MTPLX и oMLX сравнялись. Сборки модели разные, и каждый режим на oMLX запускался по одному разу. Разбор целиком — в статье на habr.com
🛠️ Хочешь применять это на практике?
По мотивам новости — подборка промптов для разработчиков из нашей библиотеки:
- Codebase Ecosystem Atlas
- Code Review Agent
- Comprehensive Repository Analysis and Bug Fixing Framework
🔗 Вся библиотека промптов · Категория «Программирование»
Готовый продукт по теме: 50 промптов для ChatGPT, которые экономят 10+ часов в неделю — забрать и применить сразу.