DeepSeek V4: обзор Pro и Flash, цены в рублях и отличия от V3
DeepSeek V4 Pro и V4 Flash через API без VPN: контекст 1 млн токенов, архитектура MoE, цена в рублях и честное сравнение с DeepSeek V3 — какую версию брать под какую задачу.
DeepSeek V4 — четвёртое поколение моделей DeepSeek, доступное в каталоге в двух вариантах: старшая V4 Pro и экономичная V4 Flash. Обе вышли 24 апреля 2026 года и обе работают с контекстом в 1 млн токенов. Главное, что стоит знать заранее: младшая V4 Flash стоит дешевле, чем прошлое поколение V3, а контекста держит в восемь раз больше.
Характеристики
| Параметр | V4 Pro | V4 Flash |
|---|---|---|
| Архитектура | MoE, 1,6 трлн параметров, 49 млрд активных | MoE, 284 млрд параметров, 13 млрд активных |
| Контекст | 1 048 576 токенов | 1 048 576 токенов |
| Модальность | Текст | Текст |
| Возможности | Вызов инструментов, JSON-режим | Вызов инструментов, JSON-режим |
| Дата выхода | 24 апреля 2026 | 24 апреля 2026 |
| Доступ | С тарифа Go и по балансу | С тарифа Go и по балансу |
Обе модели — Mixture-of-Experts: на каждый токен работает лишь часть параметров (49 млрд из 1,6 трлн у Pro, 13 млрд из 284 млрд у Flash). Отсюда и разница в цене: Flash активирует почти вчетверо меньше параметров и обходится соответственно дешевле.
Актуальные цены
Цены в рублях за 1 млн токенов, обновляются вместе с каталогом. Рядом — прошлое поколение для сравнения: обратите внимание, что V4 Flash дешевле обеих версий V3.
| Модель | Ввод, ₽/1М | Вывод, ₽/1М | Контекст |
|---|---|---|---|
| DeepSeek: DeepSeek V4 Pro | 209 | 418 | 1.0M |
| DeepSeek: DeepSeek V4 Flash | 18 | 37 | 1.0M |
| DeepSeek: DeepSeek V3.2 | 39 | 58 | 128K |
| DeepSeek: DeepSeek V3 | 31 | 125 | 128K |
Какую версию брать
- V4 Flash — вариант по умолчанию. Дешевле прошлого поколения при контексте 1 млн токенов; для чат-ботов, извлечения данных, классификации и большинства продуктовых задач этого достаточно.
- V4 Pro — когда задача упирается в качество рассуждения: длинные агентные цепочки, разбор больших кодовых баз, многошаговый анализ. Стоит заметно дороже, поэтому переходить на неё разумно по результатам замера на своих запросах, а не заранее.
- V3.2 — предыдущее поколение с разреженным вниманием (DSA) и контекстом 128k. Остаётся в каталоге для тех, у кого код уже завязан на её поведение.
- V3 (
deepseek-chat) — модель декабря 2024 года. Для новых интеграций брать её сегодня незачем: V4 Flash дешевле и современнее.
model меняется код, остальной код остаётся прежним. Сравнить варианты на своих запросах можно в песочнице, не трогая продакшен.Что значит контекст в 1 млн токенов
Миллион токенов — это порядка 1500 страниц русского текста. На практике ограничением становится не окно, а счёт: весь поданный ввод оплачивается, поэтому для больших корпусов дешевле сначала отобрать релевантные фрагменты поиском, а модели передать только их. Большое окно выручает там, где резать нечего — длинный диалог с историей, документ, который нужно видеть целиком, агент с накопленным состоянием.
Частые вопросы
Чем V4 Flash отличается от V4 Pro, кроме цены?
Размером: Flash активирует 13 млрд параметров из 284 млрд, Pro — 49 млрд из 1,6 трлн. Контекст, модальность и набор возможностей (вызов инструментов, JSON-режим) у них одинаковые, поэтому переключение между ними не требует правок кода, кроме кода модели.
Стоит ли переходить с V3 на V4?
Для новых интеграций — да, V4 Flash дешевле V3 и держит контекст в восемь раз больше. Для работающего продакшена решение стоит принимать по замеру: поведение моделей разное, и промпты, настроенные под V3, могут потребовать правки.
Нужен ли VPN?
Нет. Запросы идут на российский домен ai-gatewey.ru/v1, оплата — в рублях с карты или по счёту для юрлиц. Условия — на странице тарифов.
Модели поддерживают вызов функций?
Да, обе поддерживают вызов инструментов и JSON-режим — формат запроса стандартный для OpenAI-совместимого API. Примеры — в документации.
DeepSeek V4 по единому API в рублях
Получить ключ