согласование договоров за 3 дня вместо двух недель, затраты на сравнение документов ниже на 40%
ИТ-компании
источник: platforms.su
Читать кейсКалькулятор
Михаил Мозг3 минуты чтения
Модель, которая не поместилась в память, не работает вообще. Калькулятор памяти для LLM, больших языковых моделей, считает три слагаемых: веса, кэш контекста и запас, и сравнивает итог с памятью ноутбука, Mac Studio, видеокарт и серверных карт. Формула и примеры под калькулятором, чтобы вы могли пересчитать вручную.
Калькулятор
Сколько памяти нужно
Модели с малым числом активных параметров считайте по полному числу параметров. Точная память на токен смотрится в карточке модели.
На каком железе запустится
Для Mac учтена единая память минус 8 ГБ на систему. «Впритык» значит запас меньше 10%.
Значения по умолчанию из источников на 29.09.2026; курс ЦБ 84,41 ₽ за доллар. Расчет оценочный, любое поле можно изменить.
Веса: число параметров в миллиардах, умноженное на байты на параметр: 2 в FP16, 1 в 8-битной квантизации, 0,55 в 4-битной с учетом служебных данных формата. KV-кэш: длина контекста в токенах, умноженная на память на токен, которая зависит от архитектуры: около 0,13 МБ для моделей на 8 млрд параметров, 0,25 МБ для 30 млрд, 0,33 МБ для 70 млрд и выше. Запас: 15% на рабочие буферы и систему, поле можно изменить. Для нескольких одновременных пользователей кэш умножается на их число.
Модель 8 млрд, 4 бита, контекст 8 192 токена: веса 4,4 ГБ, кэш 1,0 ГБ, с запасом 6,3 ГБ: ноутбук с 16 ГБ. Та же модель с контекстом 32 768: 9,8 ГБ. Модель 32 млрд, 4 бита, 8 192 токена: 22,5 ГБ: видеокарта на 24 ГБ впритык, на 32 ГБ с запасом, Mac с 36 ГБ. Модель 70 млрд, 4 бита: 47,3 ГБ, с контекстом 32 768 уже 56,4 ГБ: Mac с 64 ГБ подходит для контекста 8 192 и не вмещает 32 768, Mac со 128 ГБ с запасом, две карты по 32 ГБ или одна на 96 ГБ. Модель 70 млрд в FP16: 164 ГБ, две серверные карты по 80 ГБ с выгрузкой части слоев, две карты по 96 ГБ или Mac Studio с 512 ГБ. Модель 671 млрд, 4 бита: 427 ГБ: только Mac Studio с 512 ГБ, где она реально работает на 6,21 токена в секунду, или сервер с шестью картами по 80 ГБ.
Список железа в калькуляторе: MacBook Pro с 36, 64 и 128 ГБ; Mac Studio с 96, 128 и 512 ГБ; RTX 4090 с 24 ГБ; RTX 5090 с 32 ГБ и пара таких карт; RTX PRO 6000 с 96 ГБ и пара таких карт; A100 с 40 и 80 ГБ; H100 с 80 ГБ и сервер с четырьмя H100. Для Mac считается единая память за вычетом 8 ГБ на систему, для видеокарт полный объем видеопамяти. Цены железа на 29.09.2026 подставляются из нашей базы, у MacBook Pro на 36 и 64 ГБ цены нет; источники цен указаны на страницах о железе.
Команда облачного провайдера уместила на карте с 24 ГБ текстовую модель и модель зрения при контексте 65 536 токенов: веса 13,0 и 6,1 ГБ, кэш 0,9 и 2,4 ГБ, итого 22,4 ГБ. Если внести те же слагаемые и убрать запас, калькулятор покажет 22,4 ГБ и отметит карту на 24 ГБ как «впритык», то есть с запасом меньше 10%; со стандартным запасом 15% итог 25,8 ГБ, и карта на 24 ГБ не проходит.
Модели с малым числом активных параметров, например 30 млрд всего и 3 млрд активных, занимают память по полному числу параметров, а по скорости ведут себя как маленькие: считайте по полному размеру. Память на токен сильно зависит от архитектуры, точное значение смотрите в карточке модели. Калькулятор не учитывает модели зрения и речи, которые загружаются рядом: добавьте их веса отдельной строкой.

ИТ-компании
источник: platforms.su
Читать кейсИТ-компании
2 сентября 2026 · источник: platforms.su
Читать кейсИТ-компании
2 сентября 2026 · источник: platforms.su
Читать кейсИТ-компании
2 сентября 2026 · источник: platforms.su
Читать кейсИТ-компании
источник: platforms.su
Читать кейсЦены и замеры в разделе проверены 29.09.2026 по источникам внизу страниц. Мы собираем ИИ-агентов на облачных и локальных моделях и не продаем железо. Расчеты оценочные, юридические выводы по 152-ФЗ и 243-ФЗ дает ваш юрист.
Контакты
Посчитаем железо, токены и людей на ваших цифрах и скажем честно, что дешевле. Бесплатно, 30 минут.