Всем привет! Меня зовут Никита Нагорнов, я iOS-разработчик в компании «Исходный Код». В этой статье разберем, как запускать локальные LLM на iPhone.Поговорим про:1. Архитектуру Apple Silicon и Unified Memory — почему не можем использовать всю доступную память;2. Память, квантование и KV Cache — где…
Всё началось с простой, на первый взгляд, задачи.Я хотел использовать локально Qwen3.8-27B именно в BF16. Причём не исходный PyTorch-чекпойнт через случайный слой совместимости, а mlx-community/Qwen3.8-27B-bf16 — специально подготовленную в формате MLX версию для Apple Silicon. Вся линейка Qwen3.8 от mlx-community…
Я запустил Ideogram 4 локально на Mac, а затем собрал для него нативное приложение на Swift и MLX — без отдельного Python-процесса во время рендера. Сразу честно: «6 часов против 11 минут» — не ускорение одной картинки в 35 раз, а два разных режима: максимальный Quality 2048×2048 на 48 шагах и повседневный Turbo 1152×768 на 12. Это продолжение серии о Typhoonminigen. В статье — архитектура приложения, реальные замеры, удачные решения, ограничения и ошибки, которые пришлось исправлять по пути. Читать далее
Кабель Red Line S7 USB — Apple Lightning Silver Имя модели Apple iPhone 5 Apple iPhone 6 Apple iPhone 6 Plus Apple iPhone 5s Apple iPhone 5c Apple iPad mini 3 Apple iPad mini 2 Apple iPad mini Apple iPad Air 2 Apple iPad Air Apple iPad 4 Apple iPhone 7 Apple iPhone 7 Plus […]