Что такое DeepSeek V4 и почему о нём говорят в 2026 году?
Новое поколение DeepSeek вышло 24 апреля 2026 года — и это не очередной апдейт, а смена эпохи. Семейство V4 состоит из флагмана V4-Pro (1,6 трлн параметров, 49 млрд активных) и лёгкой V4-Flash (284 млрд, 13 млрд активных): контекст вырос со 128 тысяч токенов до 1 миллиона, появились агентные способности, открытые веса и цены от $0.14 за миллион входных токенов (официальная документация DeepSeek, август 2026).
Для российских пользователей главное — V4 уже работает без VPN и зарубежных карт: в AgentHere флагман V4-Pro стоит моделью по умолчанию и доступен в веб-чате, десктоп-приложении и через API. Что именно изменилось в V4 по сравнению с V3.2, где она сильна, где слаба и сколько это стоит, — по пунктам ниже.
Что из себя представляет DeepSeek V4?
DeepSeek V4 — продолжение линейки, в которую ранее входили V3, V3.2 и рассуждающая R1. Главная ставка новой версии — сочетание низкой цены, огромного контекста и агентных способностей. По официальному анонсу, V4-Pro «соперничает с лучшими закрытыми моделями» в рассуждениях, математике, программировании и знаниях о мире, а V4-Flash почти догоняет Pro в рассуждениях и не уступает ей в простых агентных задачах (официальная новость DeepSeek, 24.04.2026).
Ключевые особенности архитектуры:
- Контекст 1 млн токенов — теперь это стандарт для всех официальных сервисов DeepSeek, а не опция
- Новое внимание (attention): послойное сжатие токенов + DeepSeek Sparse Attention (DSA) — механизм, который сильно снижает расход памяти и вычислений на длинных контекстах
- Два режима работы: «размышление» (thinking) и обычный, без размышлений — включаются параметром запроса
- Открытые веса: V4-Pro и V4-Flash опубликованы на HuggingFace, техотчёт доступен в открытом доступе
- Агентная интеграция: по заявлению разработчиков, V4 хорошо работает в связке с агентными инструментами вроде Claude Code, OpenClaw и OpenCode — и сама лаборатория использует её для внутренней разработки кода
Издание Коммерсантъ отметило релиз как «новую языковую модель V4 с открытым кодом» с контекстом 1 млн токенов. По данным Al Jazeera (24.04.2026), в публичных тестах V4-Pro обходит все открытые модели в математике и программировании и уступает в знаниях о мире только закрытой Gemini 3 от Google.
Какие модели входят в семейство DeepSeek V4?
| Модель | Параметры (всего / активных) | Контекст | Цена за 1М входа / выхода | Сильная сторона |
|---|---|---|---|---|
| DeepSeek-V4-Pro | 1,6 трлн / 49 млрд | 1 млн токенов | $0.435 / $0.87 | Рассуждения, код, знания о мире |
| DeepSeek-V4-Flash | 284 млрд / 13 млрд | 1 млн токенов | $0.14 / $0.28 | Скорость, цена, агентные задачи |
Данные по параметрам — из официального анонса, цены — из документации по API (актуальны на август 2026). Для сравнения: у прошлого поколения V3.2 контекст составлял 128 тыс. токенов, то есть рост в восемь раз. При этом Flash-версия стоит втрое дешевле Pro и работает заметно быстрее, что делает её массовым вариантом для рутинных задач.
Важно: как и любые бенчмарки, цифры производительности зависят от методики теста и «обвязки» (harness). Официальные результаты DeepSeek публикует для своих собственных конфигураций, поэтому при выборе модели между V4-Pro и V4-Flash стоит прогнать свои типовые задачи — как проверить это быстро, описано в гайде по выбору нейросети.
Что нового в DeepSeek V4 по сравнению с V3.2?
Переход с V3.2 на V4 — не точечный апдейт, а смена поколения. Вот главные отличия:
- Контекст 128 тыс. → 1 млн токенов. В V4 можно загрузить целую кодовую базу, большую книгу или пакет документов в один запрос. Это меняет практику работы: не нужно дробить материалы и терять контекст между запросами.
- Агентные способности. В V4 заявлена поддержка agentic-сценариев «из коробки»: работа с инструментами, автономное выполнение задач в терминале, мультишаговые операции. По данным официального changelog от 31 июля 2026, именно агентные бенчмарки стали для V4-Flash главным полем усиления.
- Двойной режим — thinking / non-thinking. Одна модель может либо «рассуждать» перед ответом (дороже по времени и токенам), либо отвечать сразу. Раньше для этого требовались разные модели (
deepseek-reasonerиdeepseek-chat). - Новые именования API. Старые имена
deepseek-chatиdeepseek-reasonerполностью отключены с 24 июля 2026; теперь используютсяdeepseek-v4-proиdeepseek-v4-flash. До отключения старые имена временно указывали на V4-Flash в режимах «без размышлений» и «размышление» соответственно. - Открытость. Веса обеих моделей опубликованы, что позволяет разворачивать V4 на собственной инфраструктуре — актуально для бизнеса с требованиями к хранению данных в России.
Насколько сильны агентные способности DeepSeek V4?
Агентность — главная тема 2026 года в LLM: модели должны не просто отвечать на вопросы, а самостоятельно выполнять задачи с инструментами. Здесь DeepSeek делает серьёзную заявку. 31 июля 2026 лаборатория выпустила в публичную бета-версию обновлённый V4-Flash (версия 0731) с официальными результатами на агентных бенчмарках (changelog DeepSeek, 31.07.2026):
| Бенчмарк | Результат V4-Flash |
|---|---|
| Terminal Bench 2.1 (работа в терминале) | 82.7 |
| Cybergym (киберзадачи) | 76.7 |
| Toolathlon verified (работа с инструментами) | 70.3 |
| DSBench-FullStack (внутренний, full-stack) | 68.7 |
| NL2Repo (генерация репозиториев) | 54.2 |
| DeepSWE (решение задач в репозиториях) | 54.4 |
| Agent Last Exam | 25.2 |
| Automation Bench (Public) | 25.1 |
По заявлению разработчиков, V4-Flash-0731 «значительно превосходит V4-Pro-Preview» на агентных бенчмарках, при этом архитектура и размер модели не менялись — апдейт затронул только дообучение. Флагманская V4-Pro при этом продолжает усиливать агентные сценарии, а официальный релиз V4-Pro должен последовать вскоре после бета-версии Flash. Также V4-Flash теперь нативно поддерживает Responses API и адаптирован для Codex.
Сколько стоит DeepSeek V4?
Цены на API DeepSeek V4 — одни из самых низких среди флагманских моделей. По данным официального прайса (август 2026):
| Модель | Вход, $ за 1М | Кэшированный вход, $ за 1М | Выход, $ за 1М |
|---|---|---|---|
| DeepSeek-V4-Pro | 0.435 | 0.003625 | 0.87 |
| DeepSeek-V4-Flash | 0.14 | 0.0028 | 0.28 |
Для сравнения: флагманские закрытые модели в 2026 году стоят в диапазоне $1–4 за миллион входных токенов, то есть V4-Pro примерно в 3–9 раз дешевле при сопоставимых результатах в публичных тестах. Именно ценой объясняется интерес бизнеса: массовые операции — обработка обращений, генерация текстов, разбор документов — на V4-Flash обходятся копейками.
Совет: если у вас большой поток похожих запросов, используйте кэш входных токенов — цена кэшированного входа у DeepSeek на два порядка ниже обычного. На платформе AgentHere кэширование настроено автоматически, отдельно его включать не нужно.
Где попробовать DeepSeek V4?
Способов доступа к новой модели несколько — от официального чата до API и платформ:
- Официальный чат DeepSeek — chat.deepseek.com, режимы Expert (Pro) и Instant (Flash). Требует регистрации, работает напрямую.
- Официальный API — api.deepseek.com, модели
deepseek-v4-proиdeepseek-v4-flash, поддержка OpenAI ChatCompletions и Anthropic-формата. Оплата в юанях или долларах, для жителей РФ нужна зарубежная карта или посредник. - Платформы-агрегаторы — например, AgentHere: DeepSeek V4-Pro работает внутри веб-чата и десктоп-приложения, доступ из России без VPN, оплата в рублях, первые 1 000 000 токенов — бесплатно при регистрации (без привязки карты). Подробнее — в обзоре доступа к DeepSeek онлайн.
- Собственная инфраструктура — веса моделей открыты (HuggingFace), V4 можно развернуть у себя для полного контроля над данными.
Для большинства частных пользователей и малого бизнеса в России вариант 3 — самый практичный: не нужно решать вопросы с оплатой зарубежных сервисов и VPN, а саму модель можно переключать между V4-Pro, V4-Flash и другими в настройках.
Что дальше с DeepSeek V4?
По состоянию на начало августа 2026 года: V4-Flash официально вышел в публичную бета-версию (31.07.2026), V4-Pro работает в превью-режиме, а его официальный релиз анонсирован «вскоре» (changelog DeepSeek, 31.07.2026). Старые имена моделей deepseek-chat и deepseek-reasoner уже отключены. Следить за обновлениями стоит в официальном changelog DeepSeek — именно там появляются первыми новости о релизах, а не в пересказах и слухах.
Для практических задач уже сейчас понятно распределение: V4-Pro — для сложных рассуждений, кода и аналитики; V4-Flash — для скоростных массовых операций и агентных рутин. Обе модели доступны в одном месте, если использовать AI-ассистента на AgentHere, который подбирает модель под задачу автоматически.
Проверить DeepSeek V4 на своих задачах можно за один вечер: создайте своего AI-агента на AgentHere — V4-Pro работает по умолчанию, а миллиона токенов в подарок хватит на реальные тесты.
Узнайте больше:
- DeepSeek онлайн без VPN в России — где и как попробовать V4
- DeepSeek V4 Pro или V4-Flash: какую модель выбрать — сравнение двух моделей
- DeepSeek V4-Flash: лёгкая модель с агентными способностями — про бета-релиз от 31 июля
- Лучшие нейросети 2026 года — как сравнивать модели между собой
Источники
- DeepSeek V4 Preview Release — официальный анонс, DeepSeek API Docs
- Change Log — DeepSeek API Docs (бета V4-Flash, 31.07.2026)
- DeepSeek API Pricing — DeepSeek API Docs
- DeepSeek представила новую языковую модель V4 с открытым кодом — Коммерсантъ
- China's DeepSeek unveils latest models — Al Jazeera, 24.04.2026
- DeepSeek-V4 open weights — HuggingFace