Перейти к содержимому
Назад к блогу
Продукт

Flash вместо Pro: с 5 октября Pro тратит втрое больше токенов

С 5 октября 2026 DeepSeek V4-Pro будет потреблять в 3 раза больше токенов, чем Flash. Почему AgentHere рекомендует Flash и как переключить модель за минуту.

AgentHere Team
AgentHere TeamАвтор
Обновлено: 28 сентября 2026 г.8 мин чтения
Содержание

С 5 октября 2026 года модель DeepSeek V4-Pro в AgentHere будет потреблять в 3 раза больше токенов, чем DeepSeek V4-Flash. На практике это значит: одна и та же задача на Pro обойдётся втрое дороже по балансу, чем на Flash, — при том что на большинстве повседневных задач Flash не уступает Pro в качестве ответа. Разница заложена и в официальном прайсе DeepSeek: входной токен V4-Pro стоит $0,435 за миллион против $0,14 у Flash — прайс DeepSeek API. В этой статье разбираем, что именно меняется, почему мы рекомендуем Flash, как переключить модель за пару минут и в каких случаях Pro по-прежнему оправдан.

Что меняется 5 октября 2026 года?

До 5 октября обе модели списывают токены с баланса одинаково — вы платите только за фактически потраченные токены. С 5 октября за каждый запрос к модели deepseek-v4-pro будет списываться втрое больше токенов, чем за такой же запрос к deepseek-v4-flash. Цель изменения — сделать честным соотношение «цена → возможности»: Pro остаётся флагманской моделью для сложных рассуждений, а Flash становится экономичным основным выбором для повседневной работы.

Важно понимать, что это не повышение цен на пакеты: пакеты токенов не меняются, и никакой подписки не появляется. Меняется только расход токенов конкретной моделью Pro — так расход баланса отражает реальную стоимость модели.

С 05.10.2026 deepseek-v4-pro потребляет в 3 раза больше токенов, чем deepseek-v4-flash. Flash остаётся моделью по умолчанию в десктоп-приложении.

Если вы сейчас работаете на Pro — ничего ломаться не будет: модель продолжит отвечать, просто расход токенов станет выше. Переключение на Flash занимает меньше минуты (инструкция ниже).

Почему Flash не уступает Pro в большинстве задач?

DeepSeek V4-Flash — «лёгкая» модель семейства V4, выпущенная вместе с V4-Pro в апреле 2026 года: анонс семейства V4 в Коммерсанте. Модели делят общую архитектуру, но Flash оптимизирована под скорость и стоимость ответа. По результатам беты от 31.07.2026 Flash показала сопоставимое с Pro качество на агентных задачах, а по времени ответа — заметно быстрее. Подробный разбор сравнения — в нашем посте «DeepSeek V4-Pro против V4-Flash: что выбрать».

Что это значит на практике:

  • Письма, рерайт, саммари, ответы поддержки, типовой код — Flash отвечает не хуже Pro, быстрее и дешевле;
  • Сложные многошаговые рассуждения, длинные архитектурные решения — здесь Pro всё ещё впереди;
  • Агентные сценарии — по результатам беты Flash справляется на уровне Pro.

Отсюда и рекомендация: начинайте с Flash, а Pro включайте осознанно — под задачу, где качество Flash вас не устраивает. Это тот же принцип, что и в гайде по выбору нейросети: модель выбирается под задачу, а не «на всякий случай».

Сколько токенов экономит Flash на реальных задачах?

Ориентир для типовой работы: одна задача «написать письмо / разобрать фрагмент кода / ответить на вопрос по документации» — это примерно 100 000 токенов суммарного расхода (вход + выход). Сравним расход после 5 октября:

СценарийРасход на Pro (после 05.10)Расход на FlashЭкономия
1 задача (~100 000 токенов)300 000100 0003 раза
10 задач в день3 000 0001 000 0002 000 000 токенов
30 задач в день (месяц)90 000 00030 000 00060 000 000 токенов

Расчёт сделан от множителя 3× — по официальным ценам провайдера разница ещё чуть выше: выходной токен V4-Pro стоит $0,87 за миллион против $0,28 у Flash, то есть более чем втрое (прайс DeepSeek). Для активного пользователя это разница между пакетом Plus и пакетом Pro в тарифах — при прежнем качестве ответов на типовых задачах.

Как переключить модель?

Модель выбирается в том месте, где вы работаете:

  1. Десктоп-приложение. Откройте диалог → иконка модели рядом с полем ввода → в списке выберите deepseek-v4-flash. Flash в списке первая — это модель по умолчанию в приложении;
  2. Веб-чат и агенты. В кабинете агента модель выбирается в настройках агента — укажите deepseek-v4-flash;
  3. API. В запросе укажите "model": "deepseek-v4-flash" — формат запроса описан в документации.

Проверка простая: отправьте пару типовых задач на Flash и сравните ответы с тем, что вы привыкли видеть на Pro. В большинстве случаев разница будет незаметной — кроме скорости и расхода токенов.

Когда Pro всё ещё стоит выбирать?

Pro остаётся правильным выбором, когда задача действительно сложная:

  • многошаговые рассуждения с перебором вариантов;
  • большие архитектурные решения, где ошибка дорогая;
  • задачи, где вы уже тестировали Flash и ответ вас не устроил.

Практичный приём: держите Flash моделью по умолчанию, а на «тяжёлых» диалогах переключайтесь на Pro на время одной задачи — приложение позволяет менять модель в любом диалоге на лету.

Что сделать до 5 октября

  1. Переключите модель по умолчанию на Flash — в десктопе и в настройках агентов;
  2. Прогоните 2–3 своих типовых задачи на Flash и убедитесь, что качество устраивает;
  3. Оставьте Pro только там, где он реально нужен — сложные рассуждения и длинные сессии;
  4. Проверьте расход после переключения: в интерфейсе видно, сколько токенов уходит на диалог.

Новым пользователям ничего делать не нужно — Flash уже модель по умолчанию. Попробуйте AgentHere: 1 000 000 токенов в подарок при регистрации, пакеты пополнения — от 300 ₽.

Источники

  1. DeepSeek API Pricing — официальный прайс моделей
  2. DeepSeek представила модель V4 — Коммерсантъ, 26.04.2026
  3. DeepSeek V4-Pro против V4-Flash: что выбрать — блог AgentHere
  4. DeepSeek V4-Flash: лёгкая модель с агентными способностями — блог AgentHere
#deepseek v4 flash #deepseek v4 pro #переключить модель #расход токенов #agenthere новости

Похожие статьи

Flash вместо Pro: с 5 октября Pro тратит втрое больше токенов | AgentHere