DeepSeek V4 Pro 0813: флагман вышел из беты
DeepSeek выпустил GA-версию флагманской модели V4 Pro 0813: 1,6 трлн параметров, контекст 1M токенов и цена $0,87 за млн выходных токенов.
DeepSeek V4 Pro 0813: флагман вышел из беты
12 августа 2026 года DeepSeek тихо, без громкого анонса, перевёл свою флагманскую модель в статус GA (general availability — общедоступный релиз). Компания завершила период превью, который длился почти четыре месяца, и теперь сборка под именем V4 Pro 0813 официально доступна на OpenRouter и через собственный API DeepSeek. Это крупнейший открытый MoE-релиз (Mixture-of-Experts — смесь экспертов) с момента выхода предварительной версии весной.
Хронология выхода
Компания анонсировала серию V4 ещё 24 апреля 2026 года, выпустив открытые веса обеих моделей — Pro и Flash — под лицензией MIT. 31 июля Flash перешёл в официальный статус, а в changelog был обещан скорый выход Pro. Обещание выполнено: V4 Pro 0813 стал финальным звеном в этой цепочке.
Архитектура: что внутри
V4 Pro построен по архитектуре Mixture-of-Experts с 1,6 триллиона суммарных параметров и 49 миллиардами активных на каждый токен.
Архитектура объединяет два варианта механизма внимания — Compressed Sparse Attention (сжатое разреженное внимание) и Heavily Compressed Attention (сильно сжатое внимание), которые позволяют снизить вычислительную нагрузку на единственный токен до 27% и KV-кэш до 10% от того, что требовалось в поколении V3.2 при контексте в миллион токенов.
Модель предобучена на более чем 32 триллионах токенов с оптимизатором Muon и двухэтапным пайплайном постобучения. Результаты говорят сами за себя: 93,5% на LiveCodeBench (кодирование), 90,1% на GPQA Diamond (научные рассуждения) и 80,6% на SWE-Bench Verified (инженерные задачи).
graph TD
A[DeepSeek V4 Pro 0813] --> B[1,6T параметров / 49B активных]
A --> C[Контекст 1M токенов]
A --> D[Три режима рассуждений]
D --> D1[Non-think — быстрые ответы]
D --> D2[Think High — логический анализ]
D --> D3[Think Max — максимум рассуждений]
A --> E[Hybrid Attention: CSA + HCA]
A --> F[Предобучение: 32T+ токенов]
Для каких задач подходит
V4 Pro 0813 ориентирован на кодирование, использование инструментов (tool use), кибербезопасность, автоматизацию и долгосрочные агентные рабочие процессы.
Модель поддерживает уровни усилия рассуждений вплоть до xhigh и подходит для сложных нагрузок: анализа полных кодовых баз, многошаговой автоматизации и обработки больших объёмов информации.
Цены и параметры
| Параметр | Значение |
|---|---|
| Входные токены | $0,435 / млн |
| Выходные токены | $0,87 / млн |
| Кэш (cache hit) | $0,003625 / млн входных |
| Контекстное окно | 1 048 576 токенов (1M) |
| Макс. выходных токенов | 384 000 |
| Параметры (всего / активных) | 1,6T / 49B |
| Лицензия | MIT |
| Concurrency limit | 500 запросов |
Благодаря кэшированию и скидкам реальная средневзвешенная цена на входные токены опускается примерно до $0,05 за миллион.
«Лучшее соотношение цены и качества на рынке прямо сейчас» — такую оценку дала команда Cline после первых тестов модели 12 августа.
Бенчмарки vs конкуренты
По сравнению с апрельской preview-версией V4 Pro 0813 показал прирост на 15,8% на Terminal Bench. Предварительные результаты из WeChat показывают превосходство над Claude Opus 4.8 на Terminal Bench 2.1, Cybergym, DeepSWE и AutomationBench.
| Бенчмарк | DeepSeek V4 Pro 0813 | Claude Opus 4.8 |
|---|---|---|
| Terminal Bench 2.1 | ✅ Лучше | Baseline |
| Cybergym | ✅ Лучше | Baseline |
| DeepSWE | ✅ Лучше | Baseline |
| AutomationBench | ✅ Лучше | Baseline |
| LiveCodeBench | 93,5% | — |
| GPQA Diamond | 90,1% | — |
| SWE-Bench Verified | 80,6% | — |
На бенчмарке Artificial Analysis Intelligence Index модель сгенерировала около 190 млн выходных токенов — значительно больше медианы, — при этом общая стоимость прогона составила $1 071, что более чем в 4 раза дешевле аналогичного теста на Claude Opus 4.7 ($4 811).
Как подключиться
Интеграция доступна через OpenAI-совместимый API OpenRouter, формат Anthropic Messages или Responses API — с поддержкой reasoning tokens и стриминга.
from openai import OpenAI
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key="<YOUR_OPENROUTER_KEY>",
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4-pro-0813",
messages=[
{"role": "user", "content": "Напиши юнит-тест для функции сортировки на Python"}
]
)
print(response.choices[0].message.content)
Значение для отрасли
В июле DeepSeek занял второе место по объёму потреблённых токенов среди всех AI-провайдеров — сразу после Anthropic. Теперь, с выходом V4 Pro 0813, компания напрямую атакует позиции OpenAI и Anthropic.
Флагманский GA-релиз подтверждает тренд: открытые модели больше не уступают закрытым по качеству — зато выигрывают в цене в разы. DeepSeek V4 Pro 0813 устанавливает новую планку для open-source MoE-моделей и будет давить на ценообразование у конкурентов.