Железо

Нейросеть на MacBook: что реально запускается на ноутбуке и сколько это стоит

Михаил Мозг2 минуты чтения

Нейросеть на MacBook стала простым входом в локальный ИИ: единая память до 128 ГБ, программы в один клик, тишина. Ниже что запускается на каждом объеме памяти, скорость по замерам, цена на сегодня и границы, за которыми нужен Mac Studio или сервер.

Что запускается по объему памяти

16–24 ГБ: модели 4–8 млрд параметров в 4-битной квантизации, помощник для текста и кода, 5 ГБ на модель. 36–48 ГБ: модели 20–35 млрд, включая T-Pro 2.0 на 32 млрд, а на 48 ГБ еще и модель зрения рядом. 64 ГБ: модели 70 млрд в 4 битах с коротким контекстом. 128 ГБ: 70 млрд с длинным контекстом, несколько моделей сразу, модели с малым числом активных параметров на 35–120 млрд. Персональный агент ИТ-руководителя банка живет на Mac на модели 35 млрд с 3 млрд активных параметров при 70 токенах в секунду.

Скорость

По таблице сообщества llama.cpp на модели 7 млрд в 4 битах: M4 Pro 50,7 токена в секунду, M4 Max 83,1, M5 Max 119,9; обработка запроса у M5 Max 3 220 токенов в секунду, у M4 Max 886. Для чата и агента на ноутбуке этого более чем достаточно; ограничение ноутбука в тепле и батарее при многочасовой нагрузке.

Цена на 29.09.2026

MacBook Pro 14 M5 Max, 128 ГБ памяти, 2 ТБ: 671 594 ₽ у российского продавца, в наличии. Конфигурации с 48 и 64 ГБ дешевле, цены смотрите у продавца на день покупки. Для сравнения: одна видеокарта на 32 ГБ стоит 749 990 ₽ без компьютера (30.09.2026), а Mac Studio M4 Max со 128 ГБ 886 757 ₽.

Программы

LM Studio и Ollama ставят модель за минуты и дают локальный API, совместимый с привычными библиотеками; агенты подключаются к нему как к облаку. Так работает персональный агент из банковского кейса и агент облачного провайдера. Для нескольких пользователей нужен сервер и движок пакетной выдачи.

Границы ноутбука

Один пользователь, не сервис для отдела. Длинные документы обрабатываются медленнее, чем на серверной карте. Ноутбук уезжает с сотрудником вместе с моделью и данными: шифрование диска обязательно. Для команды следующий шаг Mac Studio или сервер с видеокартой.

Вопросы и ответы

Хватит ли MacBook Air?

Для моделей 4–8 млрд да, при 16–24 ГБ памяти. Для 30 млрд и выше нужен Pro с 36 ГБ и больше.

Нужен ли интернет?

Только чтобы скачать модель. Дальше все работает без сети, что и есть смысл локального ИИ.

Источники и даты

Михаил Мозг

Михаил Мозг

Основатель MMOOZZGG, ИИ-директор

Подробнее о Михаиле@mmoozzggru

Кейсы по теме: 3

  • Кейс рынка · Россия

    Т-Банк собственные LLM решают 45% обращений, по оценке затраты на поддержку ниже минимум на 25% в год

    Банк встроил в чат-бот собственные языковые модели семейства Gen-T: около 45% обращений клиентов решаются без оператора. В октябре 2025 года запущены ИИ-копайлоты для операторов первой линии, ими ежедневно пользуются более 90% сотрудников поддержки. Модели развернуты в периметре банка, данные вовне не передаются.

    Банки и финансы

    источник: platforms.su

    Читать кейс
  • Кейс рынка · Россия

    Т-Технологии ИИ-ассистент для задач с деньгами на собственных моделях Gen-T, бета с 20 июля 2026

    Группа разработала ИИ-ассистента для задач, связанных с деньгами и покупками, на собственных больших языковых моделях семейства Gen-T. Чтобы избежать выдумок, система опирается на верифицированные источники данных, а не только на знания модели. Бета представлена 20 июля 2026 года, полноценный запуск запланирован на осень.

    Банки и финансы

    2 сентября 2026 · источник: platforms.su

    Читать кейс
  • Кейс рынка · Россия

    Альфа-Банк, ИТ-руководитель локальный агент на модели Qwen 3.6-35B-A3B: около 70 токенов в секунду на Mac

    Автономный рабочий агент работает на локально развернутой модели с 35 млрд параметров и примерно 3 млрд активных на токен через LM Studio, скорость около 70 токенов в секунду на Mac. Сначала агент запускался в Docker на Mac, затем переехал на виртуальную машину, что стало переломным моментом по удобству.

    Банки и финансы

    2 сентября 2026 · источник: platforms.su

    Читать кейс
Все кейсы: 18

Цены и замеры в разделе проверены 29.09.2026 по источникам внизу страниц. Мы собираем ИИ-агентов на облачных и локальных моделях и не продаем железо. Расчеты оценочные, юридические выводы по 152-ФЗ и 243-ФЗ дает ваш юрист.

Контакты

Разберем, где вашей компании нужен локальный ИИ, а где хватит облака

Посчитаем железо, токены и людей на ваших цифрах и скажем честно, что дешевле. Бесплатно, 30 минут.

Telegram

@mmoozzggru

Ответим в течение рабочего дня. Все контакты

Написать в Telegram