С 5 октября 2026 года модель DeepSeek V4-Pro в AgentHere будет потреблять в 3 раза больше токенов, чем DeepSeek V4-Flash. На практике это значит: одна и та же задача на Pro обойдётся втрое дороже по балансу, чем на Flash, — при том что на большинстве повседневных задач Flash не уступает Pro в качестве ответа. Разница заложена и в официальном прайсе DeepSeek: входной токен V4-Pro стоит $0,435 за миллион против $0,14 у Flash — прайс DeepSeek API. В этой статье разбираем, что именно меняется, почему мы рекомендуем Flash, как переключить модель за пару минут и в каких случаях Pro по-прежнему оправдан.
Что меняется 5 октября 2026 года?
До 5 октября обе модели списывают токены с баланса одинаково — вы платите только за фактически потраченные токены. С 5 октября за каждый запрос к модели deepseek-v4-pro будет списываться втрое больше токенов, чем за такой же запрос к deepseek-v4-flash. Цель изменения — сделать честным соотношение «цена → возможности»: Pro остаётся флагманской моделью для сложных рассуждений, а Flash становится экономичным основным выбором для повседневной работы.
Важно понимать, что это не повышение цен на пакеты: пакеты токенов не меняются, и никакой подписки не появляется. Меняется только расход токенов конкретной моделью Pro — так расход баланса отражает реальную стоимость модели.
С 05.10.2026
deepseek-v4-proпотребляет в 3 раза больше токенов, чемdeepseek-v4-flash. Flash остаётся моделью по умолчанию в десктоп-приложении.
Если вы сейчас работаете на Pro — ничего ломаться не будет: модель продолжит отвечать, просто расход токенов станет выше. Переключение на Flash занимает меньше минуты (инструкция ниже).
Почему Flash не уступает Pro в большинстве задач?
DeepSeek V4-Flash — «лёгкая» модель семейства V4, выпущенная вместе с V4-Pro в апреле 2026 года: анонс семейства V4 в Коммерсанте. Модели делят общую архитектуру, но Flash оптимизирована под скорость и стоимость ответа. По результатам беты от 31.07.2026 Flash показала сопоставимое с Pro качество на агентных задачах, а по времени ответа — заметно быстрее. Подробный разбор сравнения — в нашем посте «DeepSeek V4-Pro против V4-Flash: что выбрать».
Что это значит на практике:
- Письма, рерайт, саммари, ответы поддержки, типовой код — Flash отвечает не хуже Pro, быстрее и дешевле;
- Сложные многошаговые рассуждения, длинные архитектурные решения — здесь Pro всё ещё впереди;
- Агентные сценарии — по результатам беты Flash справляется на уровне Pro.
Отсюда и рекомендация: начинайте с Flash, а Pro включайте осознанно — под задачу, где качество Flash вас не устраивает. Это тот же принцип, что и в гайде по выбору нейросети: модель выбирается под задачу, а не «на всякий случай».
Сколько токенов экономит Flash на реальных задачах?
Ориентир для типовой работы: одна задача «написать письмо / разобрать фрагмент кода / ответить на вопрос по документации» — это примерно 100 000 токенов суммарного расхода (вход + выход). Сравним расход после 5 октября:
| Сценарий | Расход на Pro (после 05.10) | Расход на Flash | Экономия |
|---|---|---|---|
| 1 задача (~100 000 токенов) | 300 000 | 100 000 | 3 раза |
| 10 задач в день | 3 000 000 | 1 000 000 | 2 000 000 токенов |
| 30 задач в день (месяц) | 90 000 000 | 30 000 000 | 60 000 000 токенов |
Расчёт сделан от множителя 3× — по официальным ценам провайдера разница ещё чуть выше: выходной токен V4-Pro стоит $0,87 за миллион против $0,28 у Flash, то есть более чем втрое (прайс DeepSeek). Для активного пользователя это разница между пакетом Plus и пакетом Pro в тарифах — при прежнем качестве ответов на типовых задачах.
Как переключить модель?
Модель выбирается в том месте, где вы работаете:
- Десктоп-приложение. Откройте диалог → иконка модели рядом с полем ввода → в списке выберите
deepseek-v4-flash. Flash в списке первая — это модель по умолчанию в приложении; - Веб-чат и агенты. В кабинете агента модель выбирается в настройках агента — укажите
deepseek-v4-flash; - API. В запросе укажите
"model": "deepseek-v4-flash"— формат запроса описан в документации.
Проверка простая: отправьте пару типовых задач на Flash и сравните ответы с тем, что вы привыкли видеть на Pro. В большинстве случаев разница будет незаметной — кроме скорости и расхода токенов.
Когда Pro всё ещё стоит выбирать?
Pro остаётся правильным выбором, когда задача действительно сложная:
- многошаговые рассуждения с перебором вариантов;
- большие архитектурные решения, где ошибка дорогая;
- задачи, где вы уже тестировали Flash и ответ вас не устроил.
Практичный приём: держите Flash моделью по умолчанию, а на «тяжёлых» диалогах переключайтесь на Pro на время одной задачи — приложение позволяет менять модель в любом диалоге на лету.
Что сделать до 5 октября
- Переключите модель по умолчанию на Flash — в десктопе и в настройках агентов;
- Прогоните 2–3 своих типовых задачи на Flash и убедитесь, что качество устраивает;
- Оставьте Pro только там, где он реально нужен — сложные рассуждения и длинные сессии;
- Проверьте расход после переключения: в интерфейсе видно, сколько токенов уходит на диалог.
Новым пользователям ничего делать не нужно — Flash уже модель по умолчанию. Попробуйте AgentHere: 1 000 000 токенов в подарок при регистрации, пакеты пополнения — от 300 ₽.