собственные LLM решают 45% обращений, по оценке затраты на поддержку ниже минимум на 25% в год
Банки и финансы
источник: platforms.su
Читать кейсАрхитектура
Михаил Мозг2 минуты чтения
ИИ на своих серверах, или локальное развертывание (по-английски on-premise), означает, что модель работает на вашем железе, а сеть при этом может быть открытой: обновления и внешние источники доступны. Ниже три уровня по числу пользователей с ценами и кто на каком уровне работает.
От закрытого контура: есть интернет, значит проще обновлять и можно гибридно ходить в облако для обезличенных задач; требования безопасности мягче. От аренды GPU: железо ваше, против аренды окупается только при высокой постоянной загрузке, срок покажет калькулятор окупаемости; требует инженера и места. От российского облака: контур ваш, третьих лиц нет, договор поручения не нужен.
Mac Studio M4 Max со 128 ГБ за 886 757 ₽ или рабочая станция с RTX 5090 около 1,1 млн ₽. Модели до 70 млрд на Mac и до 32 млрд на RTX 5090, LM Studio или Ollama, около 32 400–66 200 ₽ в месяц полной стоимости по нашему расчету. ИТ-руководитель банка гоняет персонального агента на Mac при скорости около 70 токенов в секунду.
Сервер с двумя RTX PRO 6000 по 96 ГБ около 2,5 млн ₽, vLLM, около 176 000 ₽ в месяц с размещением и инженером по нашему расчету. Модели 70 млрд в 16 битах или 235 млрд в 4 битах, очередь агентов. Юридический департамент ИТ-холдинга на своей модели сократил согласование договоров с двух недель до трех дней.
Сервер с четырьмя H100 от 10 млн ₽, около 507 000 ₽ в месяц по нашему расчету, или несколько таких серверов. Банк на собственных моделях решает около 45% обращений без оператора и оценивает снижение затрат на поддержку минимум на 25%. По оценке из отраслевой публикации, сервер на 1 000 одновременных пользователей стоит порядка 55 млн ₽ и окупается при загрузке 80–90%.
Интеграторы продают локальный ИИ как платформу с интерфейсом, конвейерами и правами доступа; так группа ЛАНИТ представила платформу для развертывания моделей на инфраструктуре заказчика. Сборка из открытых компонентов дешевле в лицензиях и требует инженера. Мы собираем из открытых компонентов и передаем вашему инженеру с документацией.

Банки и финансы
источник: platforms.su
Читать кейсБанки и финансы
2 сентября 2026 · источник: platforms.su
Читать кейсБанки и финансы
2 сентября 2026 · источник: platforms.su
Читать кейсИТ-компании
источник: platforms.su
Читать кейсИТ-компании
2 сентября 2026 · источник: platforms.su
Читать кейсИТ-компании
2 сентября 2026 · источник: platforms.su
Читать кейсИТ-компании
2 сентября 2026 · источник: platforms.su
Читать кейсИТ-компании
источник: platforms.su
Читать кейсЦены и замеры в разделе проверены 29.09.2026 по источникам внизу страниц. Мы собираем ИИ-агентов на облачных и локальных моделях и не продаем железо. Расчеты оценочные, юридические выводы по 152-ФЗ и 243-ФЗ дает ваш юрист.
Контакты
Посчитаем железо, токены и людей на ваших цифрах и скажем честно, что дешевле. Бесплатно, 30 минут.