DeepSeek V4 Pro 0813: флагман вышел из беты

12 августа 2026 года DeepSeek тихо, без громкого анонса, перевёл свою флагманскую модель в статус GA (general availability — общедоступный релиз). Компания завершила период превью, который длился почти четыре месяца, и теперь сборка под именем V4 Pro 0813 официально доступна на OpenRouter и через собственный API DeepSeek. Это крупнейший открытый MoE-релиз (Mixture-of-Experts — смесь экспертов) с момента выхода предварительной версии весной.


Хронология выхода

Компания анонсировала серию V4 ещё 24 апреля 2026 года, выпустив открытые веса обеих моделей — Pro и Flash — под лицензией MIT. 31 июля Flash перешёл в официальный статус, а в changelog был обещан скорый выход Pro. Обещание выполнено: V4 Pro 0813 стал финальным звеном в этой цепочке.

ℹ Лицензия
DeepSeek V4 Pro распространяется под лицензией MIT — коммерческое использование разрешено, веса открыты.

Архитектура: что внутри

V4 Pro построен по архитектуре Mixture-of-Experts с 1,6 триллиона суммарных параметров и 49 миллиардами активных на каждый токен.

Архитектура объединяет два варианта механизма внимания — Compressed Sparse Attention (сжатое разреженное внимание) и Heavily Compressed Attention (сильно сжатое внимание), которые позволяют снизить вычислительную нагрузку на единственный токен до 27% и KV-кэш до 10% от того, что требовалось в поколении V3.2 при контексте в миллион токенов.

Модель предобучена на более чем 32 триллионах токенов с оптимизатором Muon и двухэтапным пайплайном постобучения. Результаты говорят сами за себя: 93,5% на LiveCodeBench (кодирование), 90,1% на GPQA Diamond (научные рассуждения) и 80,6% на SWE-Bench Verified (инженерные задачи).


graph TD
    A[DeepSeek V4 Pro 0813] --> B[1,6T параметров / 49B активных]
    A --> C[Контекст 1M токенов]
    A --> D[Три режима рассуждений]
    D --> D1[Non-think — быстрые ответы]
    D --> D2[Think High — логический анализ]
    D --> D3[Think Max — максимум рассуждений]
    A --> E[Hybrid Attention: CSA + HCA]
    A --> F[Предобучение: 32T+ токенов]


Для каких задач подходит

V4 Pro 0813 ориентирован на кодирование, использование инструментов (tool use), кибербезопасность, автоматизацию и долгосрочные агентные рабочие процессы.

Модель поддерживает уровни усилия рассуждений вплоть до xhigh и подходит для сложных нагрузок: анализа полных кодовых баз, многошаговой автоматизации и обработки больших объёмов информации.

💡 Совет для разработчиков
Для агентных задач и анализа больших репозиториев используйте режим Think Max — он задействует максимальную глубину рассуждений. Для быстрых ответов в реальном времени выбирайте Non-think.

Цены и параметры

ПараметрЗначение
Входные токены$0,435 / млн
Выходные токены$0,87 / млн
Кэш (cache hit)$0,003625 / млн входных
Контекстное окно1 048 576 токенов (1M)
Макс. выходных токенов384 000
Параметры (всего / активных)1,6T / 49B
ЛицензияMIT
Concurrency limit500 запросов

Благодаря кэшированию и скидкам реальная средневзвешенная цена на входные токены опускается примерно до $0,05 за миллион.

«Лучшее соотношение цены и качества на рынке прямо сейчас» — такую оценку дала команда Cline после первых тестов модели 12 августа.


Бенчмарки vs конкуренты

По сравнению с апрельской preview-версией V4 Pro 0813 показал прирост на 15,8% на Terminal Bench. Предварительные результаты из WeChat показывают превосходство над Claude Opus 4.8 на Terminal Bench 2.1, Cybergym, DeepSWE и AutomationBench.

БенчмаркDeepSeek V4 Pro 0813Claude Opus 4.8
Terminal Bench 2.1✅ ЛучшеBaseline
Cybergym✅ ЛучшеBaseline
DeepSWE✅ ЛучшеBaseline
AutomationBench✅ ЛучшеBaseline
LiveCodeBench93,5%
GPQA Diamond90,1%
SWE-Bench Verified80,6%

На бенчмарке Artificial Analysis Intelligence Index модель сгенерировала около 190 млн выходных токенов — значительно больше медианы, — при этом общая стоимость прогона составила $1 071, что более чем в 4 раза дешевле аналогичного теста на Claude Opus 4.7 ($4 811).


Как подключиться

Интеграция доступна через OpenAI-совместимый API OpenRouter, формат Anthropic Messages или Responses API — с поддержкой reasoning tokens и стриминга.

from openai import OpenAI

client = OpenAI(
    base_url="https://openrouter.ai/api/v1",
    api_key="<YOUR_OPENROUTER_KEY>",
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-pro-0813",
    messages=[
        {"role": "user", "content": "Напиши юнит-тест для функции сортировки на Python"}
    ]
)
print(response.choices[0].message.content)
⚠ Важно
Модель имеет высокий показатель галлюцинаций (~94%) на бенчмарке AA-Omniscience: если модель не знает ответа, она почти всегда всё равно отвечает. Учитывайте это в продакшн-системах, где важна калиброванная уверенность.

Значение для отрасли

В июле DeepSeek занял второе место по объёму потреблённых токенов среди всех AI-провайдеров — сразу после Anthropic. Теперь, с выходом V4 Pro 0813, компания напрямую атакует позиции OpenAI и Anthropic.

Флагманский GA-релиз подтверждает тренд: открытые модели больше не уступают закрытым по качеству — зато выигрывают в цене в разы. DeepSeek V4 Pro 0813 устанавливает новую планку для open-source MoE-моделей и будет давить на ценообразование у конкурентов.