нейросетевой поиск по каталогу на локальной модели Qwen и арендованных GPU
Ритейл и производство
2 сентября 2026 · источник: platforms.su
Читать кейсСравнение
Михаил Мозг3 минуты чтения
Облачный ИИ выгоднее локального в семи случаях, и раздел о суверенном ИИ обязан честно их перечислить. Мы собираем агентов и на облачных, и на локальных моделях, поэтому нам все равно, что вы выберете, лишь бы это было посчитано. Ниже семь случаев с расчетами и примерами.
При 60 млн токенов в месяц дешевые облачные модели стоят 1 013–10 129 ₽, средние 20 258 ₽. Mac Studio за 886 757 ₽ при этом объеме окупается против Sonnet 5.5 за 71 месяц, против GPT-6 Luna никогда. По нашему расчету, свое железо начинает окупаться при сотнях миллионов токенов в месяц или при облачном счете от 70 000–100 000 ₽ в месяц.
На цепочках из 15 шагов в тесте сети магазинов полностью проверяемого результата не дала ни одна модель, а крупная облачная модель на 235 млрд справлялась частично вдвое чаще локальной на 9 млрд. Чем длиннее цепочка, тем важнее размер модели, а модель на 235 млрд, как в этом тесте, по нашему расчету требует у себя двух карт по 96 ГБ, это сервер от 2,5 млн ₽. Пока длинные цепочки надежно не решает ни одна модель, дешевле платить облаку по счету, даже 4 220 ₽ за миллион выходных токенов у флагманов, чем покупать сервер под такую задачу.
Сервер отдела, по нашей оценке, требует 10–20% ставки DevOps при медиане 220 000–250 000 ₽, в Москве до 315 000 ₽ для инженера среднего уровня. Без человека сервер деградирует: обновление ломает совместимость, карта греется, никто не смотрит логи. Если нанимать некого, облако или аренда с поддержкой провайдера.
Железо стоит одинаково в сезон и вне сезона, облако берет только за токены. Аренда H100 на два месяца в сезон стоит от 290 000 ₽ по помесячному тарифу, покупка 2,29 млн ₽ плюс сервер: при пике два месяца в году покупка проигрывает 5 лет.
Локально это, как правило, отдельные модели для зрения, речи и текста, память под каждую и свои движки. В облаке одна модель принимает картинку, документ и текст. Пока задача не сформулирована, облако дешевле на этапе поиска решения.
Если в запросах нет персональных данных, кода, финансов и медицины, или есть договор поручения с российским провайдером по 152-ФЗ, главный аргумент за свое железо исчезает. Российские облака дают договор с российским юрлицом и данные в России.
Пилот на облаке за 14 дней покажет объем токенов, длину цепочек и качество на ваших данных; только после этого цифры для калькуляторов становятся вашими, а не средними. Покупка железа до пилота это покупка вслепую.
Прогоните 50 своих запросов на облачной средней модели и на открытой модели 8–32 млрд на арендованной карте за 43–565 ₽ в час, сравните качество и посчитайте токены. Подставьте объем в калькуляторы. Если локальный итог выше облачного и данные могут выходить наружу, ответ облако, и это хороший ответ.

Ритейл и производство
2 сентября 2026 · источник: platforms.su
Читать кейсРитейл и производство
2 сентября 2026 · источник: platforms.su
Читать кейсЦены и замеры в разделе проверены 29.09.2026 по источникам внизу страниц. Мы собираем ИИ-агентов на облачных и локальных моделях и не продаем железо. Расчеты оценочные, юридические выводы по 152-ФЗ и 243-ФЗ дает ваш юрист.
Контакты
Посчитаем железо, токены и людей на ваших цифрах и скажем честно, что дешевле. Бесплатно, 30 минут.