Новости

DeepSeek V4 и открытые модели: цена токена больше не барьер, барьер в процессе и данных

Михаил МозгСобытие: Разбор опубликован: 3 минуты чтения

24 апреля 2026 года китайская DeepSeek выпустила V4: две модели с открытыми весами под свободной лицензией MIT, контекст в миллион токенов и цена от 0,15 $ за миллион входных токенов для младшей модели (с 10 сентября это V4.1-Flash). Любая компания с сервером и инженером может запустить ее у себя, не отправляя данные никому. Ниже что DeepSeek V4 значит для бизнеса, почему это важнее для России, чем для Европы, что открытые модели не решают и как мы выбираем модель под процесс.

Что вышло

V4-Pro: 1,6 трлн параметров, из них 49 млрд активных на каждый токен. V4-Flash: 284 млрд параметров, 13 млрд активных. Обе с контекстом 1 млн токенов, обе под лицензией MIT: весами можно пользоваться в коммерческих продуктах и дорабатывать. Финальные версии вышли 31 июля и 13 августа 2026 года. Цена API у разработчика в непиковые часы на 28 сентября 2026 года: V4-Pro 0,66 $ за миллион входных и 1,98 $ за миллион выходных токенов. 10 сентября DeepSeek заменила V4-Flash на V4.1-Flash с открытыми весами под MIT: 0,15 $ и 0,60 $. Для сравнения масштаба: месяц переписки небольшой компании с клиентами это единицы миллионов токенов.

Что это значит для бизнеса в России

Открытые веса означают, что модель можно развернуть на сервере в России, и тогда персональные данные клиентов никуда не уходят: требование 152-ФЗ выполняется по архитектуре, а не по обещанию подрядчика. Закон 243-ФЗ ведет к российским и национальным моделям, а национальная модель по нему как раз может использовать открытые зарубежные компоненты. Стоимость токена перестала быть аргументом против агента: при таких ценах месяц работы агента на одном процессе стоит меньше, чем час работы менеджера. Барьер сместился в процесс, правила и данные, то есть в то, что нельзя скачать.

Чего открытая модель не дает

Она не знает ваших цен, условий и остатков: это база знаний и подключения к CRM и 1С. Она не решает, когда передать диалог человеку: это правила. Она не гарантирует одинаковое качество на русском языке в вашей теме: это проверяется на ваших диалогах, а не по таблицам тестов. Самостоятельный запуск требует сервера с видеокартами и инженера на поддержку, и для малого бизнеса это часто дороже, чем российская модель по API. Поэтому выбор модели это расчет, а не идеология.

Какую нейросеть выбрать для ИИ-агента в 2026 году

Под каждый процесс отдельно, по трем критериям: качество ответов на ваших реальных диалогах, место, где модель развернута, и цена за месяц вашего объема. Российские модели, открытые модели на серверах в России и другие варианты сравниваем по одним и тем же диалогам на разборе и на пилоте. Правила агента, подключения и база знаний живут отдельно от модели, поэтому ее можно заменить без переделки: вышла модель дешевле или точнее, меняем двигатель, а не машину. После внедрения система, данные и доступы у вас.

Коротко

Открытые модели уровня DeepSeek V4 сделали цену токена несущественной и позволили держать данные в России на своем сервере. Барьер сместился в процесс, правила и данные, а модель мы выбираем под процесс и меняем без переделки агента.

Вопросы и ответы

Можно ли использовать DeepSeek V4 в бизнесе в России?

Веса под лицензией MIT можно развернуть на своем сервере, тогда данные не покидают страну. Решение принимайте по качеству на ваших диалогах и по цене, а юридические вопросы проверяйте с юристом.

Что дешевле для бизнеса: открытые нейросети на своем сервере или российская модель по API?

Зависит от объема. Свой сервер с видеокартами и инженер окупаются на больших объемах, для малого бизнеса часто дешевле API. Считаем на разборе по вашему числу диалогов.

Что будет с агентом, если выйдет модель лучше?

Правила, подключения и база знаний живут отдельно от модели, поэтому меняется только модель, а не агент.

Источники и даты

DeepSeek V4 представлена 24 апреля 2026 года: V4-Pro (1,6 трлн параметров, 49 млрд активных) и V4-Flash (284 млрд, 13 млрд активных), открытые веса под лицензией MIT, контекст 1 млн токенов; финальные версии Flash 31 июля и Pro 13 августа 2026 года; с 10 сентября V4-Flash заменена на V4.1-Flash; цена API в непиковые часы от 0,15 $ за миллион входных токенов для Flash и от 0,66 $ для Pro.

Что дальше

Разбор за 30 минут: посчитаем ваш объем диалогов в токенах и скажем, какая модель и где даст нужное качество за меньшие деньги.

Интеграции: как агент подключается к вашим системам и где работает модель
Михаил Мозг

Михаил Мозг

Основатель MMOOZZGG, ИИ-директор

Подробнее о Михаиле@mmoozzggru

Контакты

Разберем ваш бизнес за 30 минут

Посчитаем, какой отдел может окупиться первым и сколько он стоит. Бесплатно.

Telegram

@mmoozzggru

Ответим в течение рабочего дня. Все контакты

Написать в Telegram