Skip to content
Назад к блогу
Обучение

DeepSeek V4: что нового в новой модели DeepSeek

DeepSeek V4 — открытое семейство моделей с контекстом 1 млн токенов: V4-Pro (1.6 трлн параметров) и V4-Flash, цены, бенчмарки, где попробовать в России.

AgentHere Team
AgentHere TeamАвтор
Обновлено: 4 августа 2026 г.10 мин чтения
Содержание

Что такое DeepSeek V4 и почему о нём говорят в 2026 году?

Новое поколение DeepSeek вышло 24 апреля 2026 года — и это не очередной апдейт, а смена эпохи. Семейство V4 состоит из флагмана V4-Pro (1,6 трлн параметров, 49 млрд активных) и лёгкой V4-Flash (284 млрд, 13 млрд активных): контекст вырос со 128 тысяч токенов до 1 миллиона, появились агентные способности, открытые веса и цены от $0.14 за миллион входных токенов (официальная документация DeepSeek, август 2026).

Для российских пользователей главное — V4 уже работает без VPN и зарубежных карт: в AgentHere флагман V4-Pro стоит моделью по умолчанию и доступен в веб-чате, десктоп-приложении и через API. Что именно изменилось в V4 по сравнению с V3.2, где она сильна, где слаба и сколько это стоит, — по пунктам ниже.

Что из себя представляет DeepSeek V4?

DeepSeek V4 — продолжение линейки, в которую ранее входили V3, V3.2 и рассуждающая R1. Главная ставка новой версии — сочетание низкой цены, огромного контекста и агентных способностей. По официальному анонсу, V4-Pro «соперничает с лучшими закрытыми моделями» в рассуждениях, математике, программировании и знаниях о мире, а V4-Flash почти догоняет Pro в рассуждениях и не уступает ей в простых агентных задачах (официальная новость DeepSeek, 24.04.2026).

DeepSeek V4: характеристики моделей V4-Pro и V4-Flash — параметры и цены за миллион токенов

Ключевые особенности архитектуры:

  • Контекст 1 млн токенов — теперь это стандарт для всех официальных сервисов DeepSeek, а не опция
  • Новое внимание (attention): послойное сжатие токенов + DeepSeek Sparse Attention (DSA) — механизм, который сильно снижает расход памяти и вычислений на длинных контекстах
  • Два режима работы: «размышление» (thinking) и обычный, без размышлений — включаются параметром запроса
  • Открытые веса: V4-Pro и V4-Flash опубликованы на HuggingFace, техотчёт доступен в открытом доступе
  • Агентная интеграция: по заявлению разработчиков, V4 хорошо работает в связке с агентными инструментами вроде Claude Code, OpenClaw и OpenCode — и сама лаборатория использует её для внутренней разработки кода

Издание Коммерсантъ отметило релиз как «новую языковую модель V4 с открытым кодом» с контекстом 1 млн токенов. По данным Al Jazeera (24.04.2026), в публичных тестах V4-Pro обходит все открытые модели в математике и программировании и уступает в знаниях о мире только закрытой Gemini 3 от Google.

Какие модели входят в семейство DeepSeek V4?

МодельПараметры (всего / активных)КонтекстЦена за 1М входа / выходаСильная сторона
DeepSeek-V4-Pro1,6 трлн / 49 млрд1 млн токенов$0.435 / $0.87Рассуждения, код, знания о мире
DeepSeek-V4-Flash284 млрд / 13 млрд1 млн токенов$0.14 / $0.28Скорость, цена, агентные задачи

Данные по параметрам — из официального анонса, цены — из документации по API (актуальны на август 2026). Для сравнения: у прошлого поколения V3.2 контекст составлял 128 тыс. токенов, то есть рост в восемь раз. При этом Flash-версия стоит втрое дешевле Pro и работает заметно быстрее, что делает её массовым вариантом для рутинных задач.

Важно: как и любые бенчмарки, цифры производительности зависят от методики теста и «обвязки» (harness). Официальные результаты DeepSeek публикует для своих собственных конфигураций, поэтому при выборе модели между V4-Pro и V4-Flash стоит прогнать свои типовые задачи — как проверить это быстро, описано в гайде по выбору нейросети.

Что нового в DeepSeek V4 по сравнению с V3.2?

Переход с V3.2 на V4 — не точечный апдейт, а смена поколения. Вот главные отличия:

  1. Контекст 128 тыс. → 1 млн токенов. В V4 можно загрузить целую кодовую базу, большую книгу или пакет документов в один запрос. Это меняет практику работы: не нужно дробить материалы и терять контекст между запросами.
  2. Агентные способности. В V4 заявлена поддержка agentic-сценариев «из коробки»: работа с инструментами, автономное выполнение задач в терминале, мультишаговые операции. По данным официального changelog от 31 июля 2026, именно агентные бенчмарки стали для V4-Flash главным полем усиления.
  3. Двойной режим — thinking / non-thinking. Одна модель может либо «рассуждать» перед ответом (дороже по времени и токенам), либо отвечать сразу. Раньше для этого требовались разные модели (deepseek-reasoner и deepseek-chat).
  4. Новые именования API. Старые имена deepseek-chat и deepseek-reasoner полностью отключены с 24 июля 2026; теперь используются deepseek-v4-pro и deepseek-v4-flash. До отключения старые имена временно указывали на V4-Flash в режимах «без размышлений» и «размышление» соответственно.
  5. Открытость. Веса обеих моделей опубликованы, что позволяет разворачивать V4 на собственной инфраструктуре — актуально для бизнеса с требованиями к хранению данных в России.

Насколько сильны агентные способности DeepSeek V4?

Агентность — главная тема 2026 года в LLM: модели должны не просто отвечать на вопросы, а самостоятельно выполнять задачи с инструментами. Здесь DeepSeek делает серьёзную заявку. 31 июля 2026 лаборатория выпустила в публичную бета-версию обновлённый V4-Flash (версия 0731) с официальными результатами на агентных бенчмарках (changelog DeepSeek, 31.07.2026):

БенчмаркРезультат V4-Flash
Terminal Bench 2.1 (работа в терминале)82.7
Cybergym (киберзадачи)76.7
Toolathlon verified (работа с инструментами)70.3
DSBench-FullStack (внутренний, full-stack)68.7
NL2Repo (генерация репозиториев)54.2
DeepSWE (решение задач в репозиториях)54.4
Agent Last Exam25.2
Automation Bench (Public)25.1

По заявлению разработчиков, V4-Flash-0731 «значительно превосходит V4-Pro-Preview» на агентных бенчмарках, при этом архитектура и размер модели не менялись — апдейт затронул только дообучение. Флагманская V4-Pro при этом продолжает усиливать агентные сценарии, а официальный релиз V4-Pro должен последовать вскоре после бета-версии Flash. Также V4-Flash теперь нативно поддерживает Responses API и адаптирован для Codex.

Сколько стоит DeepSeek V4?

Цены на API DeepSeek V4 — одни из самых низких среди флагманских моделей. По данным официального прайса (август 2026):

МодельВход, $ за 1МКэшированный вход, $ за 1МВыход, $ за 1М
DeepSeek-V4-Pro0.4350.0036250.87
DeepSeek-V4-Flash0.140.00280.28

Для сравнения: флагманские закрытые модели в 2026 году стоят в диапазоне $1–4 за миллион входных токенов, то есть V4-Pro примерно в 3–9 раз дешевле при сопоставимых результатах в публичных тестах. Именно ценой объясняется интерес бизнеса: массовые операции — обработка обращений, генерация текстов, разбор документов — на V4-Flash обходятся копейками.

Совет: если у вас большой поток похожих запросов, используйте кэш входных токенов — цена кэшированного входа у DeepSeek на два порядка ниже обычного. На платформе AgentHere кэширование настроено автоматически, отдельно его включать не нужно.

Где попробовать DeepSeek V4?

Способов доступа к новой модели несколько — от официального чата до API и платформ:

  1. Официальный чат DeepSeek — chat.deepseek.com, режимы Expert (Pro) и Instant (Flash). Требует регистрации, работает напрямую.
  2. Официальный API — api.deepseek.com, модели deepseek-v4-pro и deepseek-v4-flash, поддержка OpenAI ChatCompletions и Anthropic-формата. Оплата в юанях или долларах, для жителей РФ нужна зарубежная карта или посредник.
  3. Платформы-агрегаторы — например, AgentHere: DeepSeek V4-Pro работает внутри веб-чата и десктоп-приложения, доступ из России без VPN, оплата в рублях, первые 1 000 000 токенов — бесплатно при регистрации (без привязки карты). Подробнее — в обзоре доступа к DeepSeek онлайн.
  4. Собственная инфраструктура — веса моделей открыты (HuggingFace), V4 можно развернуть у себя для полного контроля над данными.

Для большинства частных пользователей и малого бизнеса в России вариант 3 — самый практичный: не нужно решать вопросы с оплатой зарубежных сервисов и VPN, а саму модель можно переключать между V4-Pro, V4-Flash и другими в настройках.

Что дальше с DeepSeek V4?

По состоянию на начало августа 2026 года: V4-Flash официально вышел в публичную бета-версию (31.07.2026), V4-Pro работает в превью-режиме, а его официальный релиз анонсирован «вскоре» (changelog DeepSeek, 31.07.2026). Старые имена моделей deepseek-chat и deepseek-reasoner уже отключены. Следить за обновлениями стоит в официальном changelog DeepSeek — именно там появляются первыми новости о релизах, а не в пересказах и слухах.

Для практических задач уже сейчас понятно распределение: V4-Pro — для сложных рассуждений, кода и аналитики; V4-Flash — для скоростных массовых операций и агентных рутин. Обе модели доступны в одном месте, если использовать AI-ассистента на AgentHere, который подбирает модель под задачу автоматически.

Проверить DeepSeek V4 на своих задачах можно за один вечер: создайте своего AI-агента на AgentHere — V4-Pro работает по умолчанию, а миллиона токенов в подарок хватит на реальные тесты.

Узнайте больше:

Источники

  1. DeepSeek V4 Preview Release — официальный анонс, DeepSeek API Docs
  2. Change Log — DeepSeek API Docs (бета V4-Flash, 31.07.2026)
  3. DeepSeek API Pricing — DeepSeek API Docs
  4. DeepSeek представила новую языковую модель V4 с открытым кодом — Коммерсантъ
  5. China's DeepSeek unveils latest models — Al Jazeera, 24.04.2026
  6. DeepSeek-V4 open weights — HuggingFace
#DeepSeek V4 #deepseek нейросеть #новые нейросети 2026 #нейросети с открытым кодом #1 млн токенов

Похожие статьи

DeepSeek V4: что нового в новой модели DeepSeek | AgentHere