К содержимому
Обзоры

DeepSeek V4: обзор Pro и Flash, цены в рублях и отличия от V3

DeepSeek V4 Pro и V4 Flash через API без VPN: контекст 1 млн токенов, архитектура MoE, цена в рублях и честное сравнение с DeepSeek V3 — какую версию брать под какую задачу.

3 минуты чтенияDeepSeekобзорV4MoE

DeepSeek V4 — четвёртое поколение моделей DeepSeek, доступное в каталоге в двух вариантах: старшая V4 Pro и экономичная V4 Flash. Обе вышли 24 апреля 2026 года и обе работают с контекстом в 1 млн токенов. Главное, что стоит знать заранее: младшая V4 Flash стоит дешевле, чем прошлое поколение V3, а контекста держит в восемь раз больше.

Характеристики

ПараметрV4 ProV4 Flash
АрхитектураMoE, 1,6 трлн параметров, 49 млрд активныхMoE, 284 млрд параметров, 13 млрд активных
Контекст1 048 576 токенов1 048 576 токенов
МодальностьТекстТекст
ВозможностиВызов инструментов, JSON-режимВызов инструментов, JSON-режим
Дата выхода24 апреля 202624 апреля 2026
ДоступС тарифа Go и по балансуС тарифа Go и по балансу

Обе модели — Mixture-of-Experts: на каждый токен работает лишь часть параметров (49 млрд из 1,6 трлн у Pro, 13 млрд из 284 млрд у Flash). Отсюда и разница в цене: Flash активирует почти вчетверо меньше параметров и обходится соответственно дешевле.

Актуальные цены

Цены в рублях за 1 млн токенов, обновляются вместе с каталогом. Рядом — прошлое поколение для сравнения: обратите внимание, что V4 Flash дешевле обеих версий V3.

МодельВвод, ₽/1МВывод, ₽/1МКонтекст
DeepSeek: DeepSeek V4 Pro2094181.0M
DeepSeek: DeepSeek V4 Flash18371.0M
DeepSeek: DeepSeek V3.23958128K
DeepSeek: DeepSeek V331125128K
Актуальные цены каталога AI Gateway за 1 млн токенов. Все модели →

Какую версию брать

  • V4 Flash — вариант по умолчанию. Дешевле прошлого поколения при контексте 1 млн токенов; для чат-ботов, извлечения данных, классификации и большинства продуктовых задач этого достаточно.
  • V4 Pro — когда задача упирается в качество рассуждения: длинные агентные цепочки, разбор больших кодовых баз, многошаговый анализ. Стоит заметно дороже, поэтому переходить на неё разумно по результатам замера на своих запросах, а не заранее.
  • V3.2 — предыдущее поколение с разреженным вниманием (DSA) и контекстом 128k. Остаётся в каталоге для тех, у кого код уже завязан на её поведение.
  • V3 (deepseek-chat) — модель декабря 2024 года. Для новых интеграций брать её сегодня незачем: V4 Flash дешевле и современнее.
Смена модели — это одна строка: в параметре model меняется код, остальной код остаётся прежним. Сравнить варианты на своих запросах можно в песочнице, не трогая продакшен.

Что значит контекст в 1 млн токенов

Миллион токенов — это порядка 1500 страниц русского текста. На практике ограничением становится не окно, а счёт: весь поданный ввод оплачивается, поэтому для больших корпусов дешевле сначала отобрать релевантные фрагменты поиском, а модели передать только их. Большое окно выручает там, где резать нечего — длинный диалог с историей, документ, который нужно видеть целиком, агент с накопленным состоянием.

Частые вопросы

Чем V4 Flash отличается от V4 Pro, кроме цены?

Размером: Flash активирует 13 млрд параметров из 284 млрд, Pro — 49 млрд из 1,6 трлн. Контекст, модальность и набор возможностей (вызов инструментов, JSON-режим) у них одинаковые, поэтому переключение между ними не требует правок кода, кроме кода модели.

Стоит ли переходить с V3 на V4?

Для новых интеграций — да, V4 Flash дешевле V3 и держит контекст в восемь раз больше. Для работающего продакшена решение стоит принимать по замеру: поведение моделей разное, и промпты, настроенные под V3, могут потребовать правки.

Нужен ли VPN?

Нет. Запросы идут на российский домен ai-gatewey.ru/v1, оплата — в рублях с карты или по счёту для юрлиц. Условия — на странице тарифов.

Модели поддерживают вызов функций?

Да, обе поддерживают вызов инструментов и JSON-режим — формат запроса стандартный для OpenAI-совместимого API. Примеры — в документации.

DeepSeek V4 по единому API в рублях

Получить ключ