Локальные LLM на iPhone: память, Core ML, MLX и ограничения
Всем привет! Меня зовут Никита Нагорнов, я iOS-разработчик в компании «Исходный Код». В этой статье разберем, как запускать локальные LLM на iPhone.
Поговорим про:
1. Архитектуру Apple Silicon и Unified Memory — почему не можем использовать всю доступную память;
2. Память, квантование и KV Cache — где приложения начинают падать и как это отловить;
3. Core ML и MLX — чем отличаются, где какой быстрее и почему нельзя всё запускать на нейронном процессоре;
4. Температуру и троттлинг — что происходит с телефоном на длинной сессии;
5. Гибридный пайплайн — как взять сильные стороны обоих фреймворков и получить стабильную генерацию.
Читать далее
Источник: habr.com
Похожие записи
Оцените материал:
Похожие записи
Может ли 2026 год стать годом, когда мы начнем использовать квантовые компьютеры в химии?
31.12.2025
День 1387: российский рынок полуприцепов за десять месяцев 2025 года упал почти в три раза
11.12.2025
Канадская мать подала в суд на компанию OpenAI, утверждая, что ChatGPT подтолкнул ее дочь к самоубийству.
14.06.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
