Для кого

Локальный ИИ для малого бизнеса: без сервера и без инженера

Михаил Мозг2 минуты чтения

Локальной нейросети для малого бизнеса не нужен сервер. Один Mac или ноутбук с большой памятью закрывает задачи небольшой команды, а если данные могут выходить наружу, облако за несколько тысяч рублей в месяц выгоднее любого железа. Ниже что брать, что оно решит и когда не брать вовсе.

Что брать

Один пользователь: MacBook Pro с 36–64 ГБ памяти, конфигурация со 128 ГБ стоит 671 594 ₽ на 29.09.2026. Небольшая команда: Mac Studio M4 Max со 128 ГБ за 886 757 ₽ на столе, до 145 Вт в базовой конфигурации M4 Max по данным Apple. Модели 8–32 млрд параметров: T-Pro 2.0, YandexGPT 5 Lite, мировые открытые. Программы: LM Studio или Ollama. Полная стоимость около 24 500–32 400 ₽ в месяц без инженера по нашему расчету, обслуживание берет на себя сотрудник, который умеет обновлять программы.

Что это решит

Черновики писем и коммерческих предложений по вашим шаблонам, ответы на типовые вопросы клиентов по базе знаний, разбор входящих заявок в таблицу, сверка договоров с реквизитами, протоколы встреч из транскриптов. Персональный агент ИТ-руководителя банка на Mac работает с почтой, транскриптами встреч и мессенджерами при скорости около 70 токенов в секунду.

Когда облако выгоднее

Если в данных нет персональных данных клиентов, кода и финансов, или объем меньше 60 млн токенов в месяц: облачная средняя модель стоит 7 600–22 800 ₽ в месяц, дешевая 1 000–4 000 ₽, российское облако с договором поручения 3 900–72 000 ₽. По нашему расчету Mac Studio окупается против счета 30 000 ₽ за 40 месяцев, против 20 258 ₽ за 71 месяц, а против счета ниже 7 800 ₽ не окупается никогда. Локальный вариант для малого бизнеса это про данные клиентов и независимость от провайдера, а не про экономию.

Как начать за неделю

Соберите 50 реальных запросов. Поставьте LM Studio на любой Mac с 16 ГБ и модель на 8 млрд, прогоните. Если качество устраивает, купите память под задачу по калькулятору. Если нет, попробуйте модель 32 млрд на арендованной карте от 43 ₽ в час. Пилот у нас: один агент за 14 дней от 150 000 ₽ на вашем Mac или на арендованных GPU в России, с метрикой в договоре.

Вопросы и ответы

Хватит ли обычного ноутбука с 16 ГБ?

Для модели 8 млрд в 4 битах да: 6,3 ГБ с контекстом 8 000 токенов. Для 32 млрд в 4 битах около 23 ГБ, то есть Mac от 36 ГБ памяти.

Нужно ли платить за модель?

Веса открытых моделей скачиваются бесплатно; условия коммерческого использования смотрите в лицензии каждой модели: у T-Pro 2.0 это Apache 2.0, которая его разрешает. Платите за железо и за внедрение.

Источники и даты

Михаил Мозг

Михаил Мозг

Основатель MMOOZZGG, ИИ-директор

Подробнее о Михаиле@mmoozzggru

Кейсы по теме: 3

  • Кейс рынка · Россия

    Т-Банк собственные LLM решают 45% обращений, по оценке затраты на поддержку ниже минимум на 25% в год

    Банк встроил в чат-бот собственные языковые модели семейства Gen-T: около 45% обращений клиентов решаются без оператора. В октябре 2025 года запущены ИИ-копайлоты для операторов первой линии, ими ежедневно пользуются более 90% сотрудников поддержки. Модели развернуты в периметре банка, данные вовне не передаются.

    Банки и финансы

    источник: platforms.su

    Читать кейс
  • Кейс рынка · Россия

    Т-Технологии ИИ-ассистент для задач с деньгами на собственных моделях Gen-T, бета с 20 июля 2026

    Группа разработала ИИ-ассистента для задач, связанных с деньгами и покупками, на собственных больших языковых моделях семейства Gen-T. Чтобы избежать выдумок, система опирается на верифицированные источники данных, а не только на знания модели. Бета представлена 20 июля 2026 года, полноценный запуск запланирован на осень.

    Банки и финансы

    2 сентября 2026 · источник: platforms.su

    Читать кейс
  • Кейс рынка · Россия

    Альфа-Банк, ИТ-руководитель локальный агент на модели Qwen 3.6-35B-A3B: около 70 токенов в секунду на Mac

    Автономный рабочий агент работает на локально развернутой модели с 35 млрд параметров и примерно 3 млрд активных на токен через LM Studio, скорость около 70 токенов в секунду на Mac. Сначала агент запускался в Docker на Mac, затем переехал на виртуальную машину, что стало переломным моментом по удобству.

    Банки и финансы

    2 сентября 2026 · источник: platforms.su

    Читать кейс
Все кейсы: 18

Цены и замеры в разделе проверены 29.09.2026 по источникам внизу страниц. Мы собираем ИИ-агентов на облачных и локальных моделях и не продаем железо. Расчеты оценочные, юридические выводы по 152-ФЗ и 243-ФЗ дает ваш юрист.

Контакты

Разберем, где вашей компании нужен локальный ИИ, а где хватит облака

Посчитаем железо, токены и людей на ваших цифрах и скажем честно, что дешевле. Бесплатно, 30 минут.

Telegram

@mmoozzggru

Ответим в течение рабочего дня. Все контакты

Написать в Telegram