Всем привет! Меня зовут Никита Нагорнов, я iOS-разработчик в компании «Исходный Код». В этой статье разберем, как запускать локальные LLM на iPhone.Поговорим про:1. Архитектуру Apple Silicon и Unified Memory — почему не можем использовать всю доступную память;2. Память, квантование и KV Cache — где…
Всё началось с простой, на первый взгляд, задачи.Я хотел использовать локально Qwen3.8-27B именно в BF16. Причём не исходный PyTorch-чекпойнт через случайный слой совместимости, а mlx-community/Qwen3.8-27B-bf16 — специально подготовленную в формате MLX версию для Apple Silicon. Вся линейка Qwen3.8 от mlx-community…
Я запустил Ideogram 4 локально на Mac, а затем собрал для него нативное приложение на Swift и MLX — без отдельного Python-процесса во время рендера. Сразу честно: «6 часов против 11 минут» — не ускорение одной картинки в 35 раз, а два разных режима: максимальный Quality 2048×2048 на 48 шагах и повседневный Turbo 1152×768 на 12. Это продолжение серии о Typhoonminigen. В статье — архитектура приложения, реальные замеры, удачные решения, ограничения и ошибки, которые пришлось исправлять по пути. Читать далее
Система водяного охлаждения Cooler Master MasterLiquid 240 MLX-D24M-A20PW-R1 S775 / 1150 / 1155 / S1156 / 1356 / 1366 / 2011, AM2, AM2+, AM3+ / AM4 / FM1, FM2 / FM2+ Производитель Cooler Master Применение Процессор (СВО) Воздушный поток (CFM) 66,7 Подсветка Нет Скорость вращения вентилятора (об/мин) 650 — 2000 об/мин Регулятор оборотов Да Socket […]