Новые модели DeepSeek для кода в 2026: какую выбрать

Опубликовано 16.09.20269 мин чтенияБазовый
Футуристические весы сравнивают DeepSeek Flash (легче) и DeepSeek v4 Pro (массивнее), предпочитая Flash для кода.
Что узнаешь
  • Какие модели DeepSeek есть в API и под какими именами на 16 сентября 2026
  • Что изменилось в сентябре 2026 и куда делись старые названия
  • Чем deepseek-flash отличается от deepseek-v4-pro по цене и задачам
  • Что такое кэш контекста и как часы пик влияют на цену
  • По какой общей схеме DeepSeek подключается движком к инструментам для кода
Базовый
19просмотров

Для большинства задач с кодом начни с deepseek-flash. За этим именем стоит V4.1-Flash, вышедшая 10 сентября 2026. deepseek-v4-pro оставь для сравнения на своих задачах. В названиях легко запутаться: в прежних рекомендациях встречается ещё и deepseek-v4-flash, но это имя уже снято и лишь временно ведёт на новую модель.

В статье - различия моделей по цене и задачам и общая схема подключения DeepSeek к своему инструменту. Имена, цены и правила приведены по официальным страницам DeepSeek на 16 сентября 2026. Они меняются, поэтому перед оплатой проверь актуальные условия на сайте.

Заметка
Материал справочный, на основе публичных данных DeepSeek. Оплата API из России и способы снизить счёт - отдельные темы. Здесь только про сами модели и их выбор; ссылка на разбор оплаты есть в конце.

Подпишись на Telegram-канал, чтобы следить за новым в вайб-кодинге: инструментами, находками и ошибками.

Какие модели DeepSeek есть сейчас: короткий ответ

В таблице - действующие и снятые имена для поля model.

Имя для поля modelКакая модель за ним стоитБрать для кода?
deepseek-flashDeepSeek-V4.1-Flash, новая модель от 10.09.2026Да, вариант по умолчанию
deepseek-v4-proDeepSeek-V4-Pro-0813, прежняя старшая модельТолько как запасной, если Flash не устроил
deepseek-v4-flashСнятое имя, временно ведёт на V4.1-FlashНет, используй deepseek-flash
deepseek-v4-flash-vision-expСнятое имя, временно ведёт на V4.1-FlashНет, используй deepseek-flash

Что изменилось в сентябре 2026

10 сентября 2026 DeepSeek выпустила DeepSeek-V4.1-Flash и обновила названия моделей. Изменения затронули и старые имена, и планы по обслуживанию Pro.

  1. Появилась новая модель V4.1-Flash. По описанию DeepSeek, она умнее и быстрее прежнего поколения и понимает картинки. Отдельно DeepSeek отмечает, что у V4.1-Flash меньше служебный кэш модели по сравнению с прежним поколением, поэтому обращения к кэшу обходятся дешевле. Как это влияет на счёт, объясняется ниже.
  2. Имя deepseek-flash теперь указывает именно на V4.1-Flash.
  3. Прежние имена deepseek-v4-flash и deepseek-v4-flash-vision-exp сняты. Для совместимости со старыми проектами эти имена пока ведут на V4.1-Flash, запросы оплачиваются по её цене. Но рассчитывать на них не стоит: переадресация временная, лучше сразу писать deepseek-flash.
  4. Сначала DeepSeek объявила, что сворачивает V4 Pro: с 04:00 UTC 14 сентября 2026 все запросы к deepseek-v4-pro должны были уходить на V4.1-Flash. Потом планы изменились. По странице цен на дату проверки DeepSeek решила продолжить обслуживать V4 Pro и после 14 сентября, порядок оплаты прежний.

Для нового подключения используй deepseek-flash: на дату проверки это имя указывает на V4.1-Flash. deepseek-v4-pro пока работает, но планы по его обслуживанию уже менялись, поэтому основной рекомендацией остаётся Flash.

Чем deepseek-flash отличается от deepseek-v4-pro по цене?

deepseek-flash стоит дешевле Pro. DeepSeek считает стоимость за 1 миллион токенов отдельно для входа и выхода, а для входа ещё учитывает попадание в кэш. Токены - это фрагменты текста, которыми измеряется объём твоего запроса и ответа модели. В таблице цены на 16 сентября 2026, в долларах за 1M токенов.

Что считаемdeepseek-flashdeepseek-v4-pro
Вход, без кэша (вне часов пик)$0.15$0.66
Вход, попадание в кэш (вне часов пик)$0.003$0.022
Выход (вне часов пик)$0.60$1.98

В часы пик цены ровно вдвое выше. deepseek-flash дешевле старшей модели примерно в три-четыре раза по большинству строк. Для кода, где на длинных диалогах набегают миллионы токенов, разница в счёте получается ощутимая.

Чем длиннее переписка с агентом, тем больше токенов расходуется. Поэтому при выборе модели учитывай цену за миллион: от неё зависит месячный счёт.

Заметка
Цены в API - это не то же самое, что подписка на чат DeepSeek. Здесь речь про оплату по токенам за обращения к модели из твоего инструмента или кода. Как оформить оплату API из России, описано в отдельной статье - ссылка в конце.

Если хочешь собрать систему для работы с кодом, выбор движка - одна из её частей. На практикуме за три вечера собираешь всю связку: ИИ-клон + Второй мозг + Контекст-инжиниринг.

Практикум по вайб-кодингу
+Твой второй мозг
3 вечера - инструменты, метод, первый проект
Старт 22–24 сентября  ·  2 000 ₽
Записаться →

Как кэш контекста и часы пик влияют на счёт

В прайсе DeepSeek есть отдельные цены для входа с попаданием в кэш и для работы вне часов пик. Эти условия стоит учитывать при повторных запросах и планировании несрочных задач.

Кэш контекста. DeepSeek по умолчанию хранит на диске начало твоих запросов. Если следующий запрос начинается так же, как предыдущий, совпадающую часть модель берёт из кэша, и это стоит в разы дешевле. У deepseek-flash вне часов пик вход с попаданием в кэш стоит $0.003 против $0.15 без него за 1M токенов. При работе с кодом системная инструкция и контекст проекта в начале запроса часто повторяются, что позволяет использовать кэш. Включать ничего не надо - он работает для всех по умолчанию.

Часы пик. У DeepSeek две цены: в часы пик и вдвое дешевле вне их. Часы пик - это 01:00-04:00 и 06:00-10:00 по UTC, с понедельника по пятницу. В московском времени (UTC+3) это 04:00-07:00 и 09:00-13:00. Всё остальное время, включая выходные, считается вне пика и стоит вдвое дешевле. Если у тебя есть несрочные задачи - большие прогоны, обработка кода пачкой, - запускай их вечером или ночью по Москве по вдвое меньшему тарифу.

Контекст и максимальная длина ответа

Обе модели поддерживают контекст до 1 миллиона токенов. В него можно передавать много файлов и длинную переписку. Хватит ли этого для крупной задачи с кодом, зависит от объёма твоих файлов, поэтому проверяй на своём проекте.

Максимальная длина ответа - до 384 тысяч токенов. По умолчанию лимит ниже: 8 тысяч токенов без режима рассуждений, 64 тысячи в режиме рассуждений и 128 тысяч, если поднять усилие рассуждений до max. Если ждёшь длинный ответ - например, большой файл кода целиком, - явно задай большее значение параметра max_tokens, иначе ответ может оборваться на середине.

Нужен ли режим рассуждений для кода?

У DeepSeek есть режим рассуждений: перед ответом модель сначала продумывает решение. По описанию DeepSeek, это сделано, чтобы повышать точность ответа на сложных задачах. Режим включён по умолчанию, с усилием high.

Он управляется параметром reasoning_effort, который по документации DeepSeek принимает следующие значения:

  • none - выключить рассуждения. Подходит для простых и быстрых запросов, не требующих сложного решения.
  • low - минимальный уровень рассуждений.
  • high - значение по умолчанию.
  • max - максимальный уровень рассуждений для самых сложных задач; ответ может быть длиннее.

Как это отражается на цене и качестве именно на твоих задачах, проверяй сам: больше рассуждений обычно означает более длинный ответ и больше токенов на выходе. Для повседневного кода разумно начать с high (значение по умолчанию) и посмотреть, устраивает ли результат. В режиме рассуждений параметры вроде temperature игнорируются, а top_p не опускается ниже 0.95.

Как подключить DeepSeek к своему инструменту?

API DeepSeek совместим с форматами OpenAI и Anthropic. Для подключения через совместимый инструмент понадобятся базовый адрес API, ключ доступа и имя модели. Базовые адреса такие:

# формат OpenAI
https://api.deepseek.com

# формат Anthropic
https://api.deepseek.com/anthropic

По данным DeepSeek, её модель можно подключить как движок в Claude Code, GitHub Copilot, OpenCode без написания кода. Точные названия полей в каждом инструменте свои, но общая схема такая:

  1. Получи ключ доступа в личном кабинете DeepSeek.
  2. В настройках инструмента укажи базовый адрес DeepSeek и свой ключ. Для инструментов, которые работают с форматом Anthropic (например, Claude Code), укажи адрес https://api.deepseek.com/anthropic; для тех, что работают с форматом OpenAI, - https://api.deepseek.com.
  3. В поле модели впиши deepseek-flash.
  4. Задай короткий вопрос и проверь служебные сведения инструмента о фактически использованной модели: запрос должен обслуживать deepseek-flash, а не прежний движок. Одного имени в настройках недостаточно; самоназвание модели в сгенерированном ответе тоже не подтверждает переключение. Где посмотреть сведения об использованной модели, уточни в документации своего инструмента. Если он их не показывает, по одному ответу подтвердить переключение нельзя.

Пошаговой настройки конкретного инструмента здесь нет: у каждого свои экраны, и они меняются. Перед подключением проверь, поддерживает ли твой инструмент внешний адрес модели (не все дают его менять) и с каким форматом он работает - OpenAI или Anthropic. По OpenCode с подключением модели у нас есть отдельный разбор: OpenCode: что это и как подключить модель. Если пока присматриваешься к бесплатным вариантам, посмотри подборку бесплатных моделей для кода.

Заметка
У аккаунта есть лимит одновременных запросов: у deepseek-flash он выше, у deepseek-v4-pro ниже. Пока ты работаешь один, достичь его трудно - лимит важен, когда через один аккаунт идёт много пользователей сразу. При превышении API вернёт ошибку 429: в этом случае нужно снизить число одновременных запросов, сама ошибка не означает поломку.

Какую модель выбрать под свою задачу

Твоя ситуацияЧто ставитьПочему
Повседневный код, агент, вайб-кодингdeepseek-flashНовее, дешевле, по данным DeepSeek обгоняет старший Pro
Нужен максимум качества на сложной задачеСравни сам: deepseek-flash с reasoning_effort max против deepseek-v4-proВыбор зависит от результата на твоей задаче
Старый проект на deepseek-v4-flashПоменяй имя на deepseek-flashСтарое имя снято и ведёт на новую модель лишь временно
Большие несрочные прогоныdeepseek-flash вне часов пикВдвое дешевле вечером и ночью по Москве

Начни с deepseek-flash, включённый по умолчанию режим рассуждений оставь на high, а deepseek-v4-pro пробуй, когда есть повод сравнить. При выборе оценивай, как модель справляется с твоими задачами и сколько стоит её работа.

Что дальше

Оплата API из России и дальнейшее снижение расходов на токены выходят за рамки выбора модели. Ниже - ссылка на разбор оплаты, официальная документация с тарифами и правилами кэширования и связанные статьи об инструментах.

Источники

Полная схема вайб-кодинга за три вечера: ИИ-клон + Второй мозг + Контекст-инжиниринг. Записи эфиров в личном кабинете, доступ 30 дней.

Практикум по вайб-кодингу
+Твой второй мозг
3 вечера - инструменты, метод, первый проект
Старт 22–24 сентября  ·  2 000 ₽
Записаться →

Новые материалы - дайджестом, без спама

Гайды выходят регулярно. Подпишись, чтобы не пропускать: пришлю подборку в Telegram или на email. Раз в неделю или каждый день - выбираешь сам.

Была инструкция полезна?
Артемий Миллер
Автор
Артемий Миллер
Предприниматель и вайб-кодер

Артемий Миллер - предприниматель и вайб-кодер. Бывший программист, собирает продукты исключительно вместе с ИИ-агентами, без найма разработчиков.

Связанные инструкции

Аналоги Codex в 2026: чем заменить терминального агента OpenAI под свою задачу

Codex - терминальный агент OpenAI: читает проект, правит файлы, запускает команды. Сам клиент открыт, но рассчитан на модели OpenAI; удобнее всего входить через ChatGPT, есть и другие способы. Если это неудобно, есть пять аналогов того же класса: Claude Code, Gemini CLI, Qwen Code, OpenCode и Aider. В статье - чем они отличаются по модели, условиям оплаты, открытости кода и приватности, какие работают с бесплатными или локальными моделями и как выбрать под свою задачу по четырём вопросам. Факты сверены с официальными источниками на 17 сентября 2026, условия меняются - проверяй перед выбором.

7 мин

GLM-5.2 догнала Claude Opus 4.8: открытая модель дешевле в 5 раз

Открытая GLM-5.2 догнала Claude Opus на рутине и стоит в разы дешевле. Где она реально заменяет Claude, где нет, и как подключить её в Claude Code.

16 мин

Цены на инструменты вайб-кодинга в 2026: как платить из России

Собрал цены на инструменты вайб-кодинга по официальным страницам на 19 августа 2026 года: от 8 долларов за нижнюю ступень до 200 за верхнюю. Плюс три набора под разный бюджет и разбор, почему у двоих на одном тарифе счёт отличается почти в шесть раз.

26 мин

Как превратить PDF и Word в текст для ИИ: MarkItDown от Microsoft

Бесплатная утилита Microsoft превращает документы в текст, который понимает нейросеть. Разбираю на своих замерах, где она выручает, а где тихо подсовывает пустой файл.

26 мин

Связанные термины