Для большинства задач с кодом начни с deepseek-flash. За этим именем стоит V4.1-Flash, вышедшая 10 сентября 2026. deepseek-v4-pro оставь для сравнения на своих задачах. В названиях легко запутаться: в прежних рекомендациях встречается ещё и deepseek-v4-flash, но это имя уже снято и лишь временно ведёт на новую модель.
В статье - различия моделей по цене и задачам и общая схема подключения DeepSeek к своему инструменту. Имена, цены и правила приведены по официальным страницам DeepSeek на 16 сентября 2026. Они меняются, поэтому перед оплатой проверь актуальные условия на сайте.
Подпишись на Telegram-канал, чтобы следить за новым в вайб-кодинге: инструментами, находками и ошибками.
Какие модели DeepSeek есть сейчас: короткий ответ
В таблице - действующие и снятые имена для поля model.
Имя для поля model | Какая модель за ним стоит | Брать для кода? |
|---|---|---|
deepseek-flash | DeepSeek-V4.1-Flash, новая модель от 10.09.2026 | Да, вариант по умолчанию |
deepseek-v4-pro | DeepSeek-V4-Pro-0813, прежняя старшая модель | Только как запасной, если Flash не устроил |
deepseek-v4-flash | Снятое имя, временно ведёт на V4.1-Flash | Нет, используй deepseek-flash |
deepseek-v4-flash-vision-exp | Снятое имя, временно ведёт на V4.1-Flash | Нет, используй deepseek-flash |
Что изменилось в сентябре 2026
10 сентября 2026 DeepSeek выпустила DeepSeek-V4.1-Flash и обновила названия моделей. Изменения затронули и старые имена, и планы по обслуживанию Pro.
- Появилась новая модель V4.1-Flash. По описанию DeepSeek, она умнее и быстрее прежнего поколения и понимает картинки. Отдельно DeepSeek отмечает, что у V4.1-Flash меньше служебный кэш модели по сравнению с прежним поколением, поэтому обращения к кэшу обходятся дешевле. Как это влияет на счёт, объясняется ниже.
- Имя
deepseek-flashтеперь указывает именно на V4.1-Flash. - Прежние имена
deepseek-v4-flashиdeepseek-v4-flash-vision-expсняты. Для совместимости со старыми проектами эти имена пока ведут на V4.1-Flash, запросы оплачиваются по её цене. Но рассчитывать на них не стоит: переадресация временная, лучше сразу писатьdeepseek-flash. - Сначала DeepSeek объявила, что сворачивает V4 Pro: с 04:00 UTC 14 сентября 2026 все запросы к
deepseek-v4-proдолжны были уходить на V4.1-Flash. Потом планы изменились. По странице цен на дату проверки DeepSeek решила продолжить обслуживать V4 Pro и после 14 сентября, порядок оплаты прежний.
Для нового подключения используй deepseek-flash: на дату проверки это имя указывает на V4.1-Flash. deepseek-v4-pro пока работает, но планы по его обслуживанию уже менялись, поэтому основной рекомендацией остаётся Flash.
Чем deepseek-flash отличается от deepseek-v4-pro по цене?
deepseek-flash стоит дешевле Pro. DeepSeek считает стоимость за 1 миллион токенов отдельно для входа и выхода, а для входа ещё учитывает попадание в кэш. Токены - это фрагменты текста, которыми измеряется объём твоего запроса и ответа модели. В таблице цены на 16 сентября 2026, в долларах за 1M токенов.
| Что считаем | deepseek-flash | deepseek-v4-pro |
|---|---|---|
| Вход, без кэша (вне часов пик) | $0.15 | $0.66 |
| Вход, попадание в кэш (вне часов пик) | $0.003 | $0.022 |
| Выход (вне часов пик) | $0.60 | $1.98 |
В часы пик цены ровно вдвое выше. deepseek-flash дешевле старшей модели примерно в три-четыре раза по большинству строк. Для кода, где на длинных диалогах набегают миллионы токенов, разница в счёте получается ощутимая.
Чем длиннее переписка с агентом, тем больше токенов расходуется. Поэтому при выборе модели учитывай цену за миллион: от неё зависит месячный счёт.
Если хочешь собрать систему для работы с кодом, выбор движка - одна из её частей. На практикуме за три вечера собираешь всю связку: ИИ-клон + Второй мозг + Контекст-инжиниринг.
Как кэш контекста и часы пик влияют на счёт
В прайсе DeepSeek есть отдельные цены для входа с попаданием в кэш и для работы вне часов пик. Эти условия стоит учитывать при повторных запросах и планировании несрочных задач.
Кэш контекста. DeepSeek по умолчанию хранит на диске начало твоих запросов. Если следующий запрос начинается так же, как предыдущий, совпадающую часть модель берёт из кэша, и это стоит в разы дешевле. У deepseek-flash вне часов пик вход с попаданием в кэш стоит $0.003 против $0.15 без него за 1M токенов. При работе с кодом системная инструкция и контекст проекта в начале запроса часто повторяются, что позволяет использовать кэш. Включать ничего не надо - он работает для всех по умолчанию.
Часы пик. У DeepSeek две цены: в часы пик и вдвое дешевле вне их. Часы пик - это 01:00-04:00 и 06:00-10:00 по UTC, с понедельника по пятницу. В московском времени (UTC+3) это 04:00-07:00 и 09:00-13:00. Всё остальное время, включая выходные, считается вне пика и стоит вдвое дешевле. Если у тебя есть несрочные задачи - большие прогоны, обработка кода пачкой, - запускай их вечером или ночью по Москве по вдвое меньшему тарифу.
Контекст и максимальная длина ответа
Обе модели поддерживают контекст до 1 миллиона токенов. В него можно передавать много файлов и длинную переписку. Хватит ли этого для крупной задачи с кодом, зависит от объёма твоих файлов, поэтому проверяй на своём проекте.
Максимальная длина ответа - до 384 тысяч токенов. По умолчанию лимит ниже: 8 тысяч токенов без режима рассуждений, 64 тысячи в режиме рассуждений и 128 тысяч, если поднять усилие рассуждений до max. Если ждёшь длинный ответ - например, большой файл кода целиком, - явно задай большее значение параметра max_tokens, иначе ответ может оборваться на середине.
Нужен ли режим рассуждений для кода?
У DeepSeek есть режим рассуждений: перед ответом модель сначала продумывает решение. По описанию DeepSeek, это сделано, чтобы повышать точность ответа на сложных задачах. Режим включён по умолчанию, с усилием high.
Он управляется параметром reasoning_effort, который по документации DeepSeek принимает следующие значения:
none- выключить рассуждения. Подходит для простых и быстрых запросов, не требующих сложного решения.low- минимальный уровень рассуждений.high- значение по умолчанию.max- максимальный уровень рассуждений для самых сложных задач; ответ может быть длиннее.
Как это отражается на цене и качестве именно на твоих задачах, проверяй сам: больше рассуждений обычно означает более длинный ответ и больше токенов на выходе. Для повседневного кода разумно начать с high (значение по умолчанию) и посмотреть, устраивает ли результат. В режиме рассуждений параметры вроде temperature игнорируются, а top_p не опускается ниже 0.95.
Как подключить DeepSeek к своему инструменту?
API DeepSeek совместим с форматами OpenAI и Anthropic. Для подключения через совместимый инструмент понадобятся базовый адрес API, ключ доступа и имя модели. Базовые адреса такие:
# формат OpenAI
https://api.deepseek.com
# формат Anthropic
https://api.deepseek.com/anthropicПо данным DeepSeek, её модель можно подключить как движок в Claude Code, GitHub Copilot, OpenCode без написания кода. Точные названия полей в каждом инструменте свои, но общая схема такая:
- Получи ключ доступа в личном кабинете DeepSeek.
- В настройках инструмента укажи базовый адрес DeepSeek и свой ключ. Для инструментов, которые работают с форматом Anthropic (например, Claude Code), укажи адрес
https://api.deepseek.com/anthropic; для тех, что работают с форматом OpenAI, -https://api.deepseek.com. - В поле модели впиши
deepseek-flash. - Задай короткий вопрос и проверь служебные сведения инструмента о фактически использованной модели: запрос должен обслуживать
deepseek-flash, а не прежний движок. Одного имени в настройках недостаточно; самоназвание модели в сгенерированном ответе тоже не подтверждает переключение. Где посмотреть сведения об использованной модели, уточни в документации своего инструмента. Если он их не показывает, по одному ответу подтвердить переключение нельзя.
Пошаговой настройки конкретного инструмента здесь нет: у каждого свои экраны, и они меняются. Перед подключением проверь, поддерживает ли твой инструмент внешний адрес модели (не все дают его менять) и с каким форматом он работает - OpenAI или Anthropic. По OpenCode с подключением модели у нас есть отдельный разбор: OpenCode: что это и как подключить модель. Если пока присматриваешься к бесплатным вариантам, посмотри подборку бесплатных моделей для кода.
deepseek-flash он выше, у deepseek-v4-pro ниже. Пока ты работаешь один, достичь его трудно - лимит важен, когда через один аккаунт идёт много пользователей сразу. При превышении API вернёт ошибку 429: в этом случае нужно снизить число одновременных запросов, сама ошибка не означает поломку.Какую модель выбрать под свою задачу
| Твоя ситуация | Что ставить | Почему |
|---|---|---|
| Повседневный код, агент, вайб-кодинг | deepseek-flash | Новее, дешевле, по данным DeepSeek обгоняет старший Pro |
| Нужен максимум качества на сложной задаче | Сравни сам: deepseek-flash с reasoning_effort max против deepseek-v4-pro | Выбор зависит от результата на твоей задаче |
Старый проект на deepseek-v4-flash | Поменяй имя на deepseek-flash | Старое имя снято и ведёт на новую модель лишь временно |
| Большие несрочные прогоны | deepseek-flash вне часов пик | Вдвое дешевле вечером и ночью по Москве |
Начни с deepseek-flash, включённый по умолчанию режим рассуждений оставь на high, а deepseek-v4-pro пробуй, когда есть повод сравнить. При выборе оценивай, как модель справляется с твоими задачами и сколько стоит её работа.
Что дальше
Оплата API из России и дальнейшее снижение расходов на токены выходят за рамки выбора модели. Ниже - ссылка на разбор оплаты, официальная документация с тарифами и правилами кэширования и связанные статьи об инструментах.
Источники
- DeepSeek API - модели и цены
- DeepSeek - релиз V4.1-Flash, 10.09.2026
- DeepSeek API - быстрый старт и список моделей
- DeepSeek API - режим рассуждений
- DeepSeek API - кэш контекста
- DeepSeek API - лимиты запросов
- DeepSeek API - параметры чата
- Как оплатить DeepSeek API из России
- Бесплатные модели для кода в 2026
- OpenCode: что это и как подключить модель
- ChatGPT или DeepSeek: что выбрать в России
Полная схема вайб-кодинга за три вечера: ИИ-клон + Второй мозг + Контекст-инжиниринг. Записи эфиров в личном кабинете, доступ 30 дней.
Новые материалы - дайджестом, без спама
Гайды выходят регулярно. Подпишись, чтобы не пропускать: пришлю подборку в Telegram или на email. Раз в неделю или каждый день - выбираешь сам.

