Все посты

Модели DeepSeek: полный список — V4, V3.2, R1 и цены

«Какие бывают модели DeepSeek» — вопрос, на который официальный сайт отвечает двумя строками (сейчас в API два актуальных имени: deepseek-flash и deepseek-v4-pro (источник: api-docs.deepseek.com, 10/2026)), а под капотом у разных провайдеров живёт заметно больше версий: в каталоге шлюза Пуска их сейчас десять. Разбираем всё семейство: чем отличаются линейки, что взять под чат-бота, а что под код, и сколько это стоит в рублях.

TL;DR

  • Текущее поколение — V4: deepseek-flash (собственно V4.1-Flash) — недорогая рабочая модель с контекстом 1M токенов; deepseek-v4-pro — флагман.
  • V3.x — проверенное универсальное поколение, самая дешёвая точка входа (0,64 ₽ за 1М входных токенов).
  • R1 — рассуждающие модели: перед ответом «думают», это дороже и медленнее, но сильнее на сложных задачах.
  • Цены ниже — из каталога шлюза Пуска, оплата в рублях, без VPN и иностранных карт.

Полный список моделей DeepSeek

Все десять версий, которые доступны через шлюз Пуска — с контекстным окном и ценой за миллион токенов (источник: каталог /models/deepseek, 05.10.2026):

МодельКонтекстВход, ₽/1МВыход, ₽/1МЧто это
DeepSeek-V4.1-Flash1M1,113,32текущая лёгкая (API-имя deepseek-flash)
DeepSeek-V4-Pro1M3,1212,45флагман поколения V4
DeepSeek-V4-Flash1M0,741,48первая Flash-версия V4
DeepSeek-V3.2128K1,945,61универсальная V3
DeepSeek-V3.2-speciale160K1,945,61спец-сборка V3.2
DeepSeek-V3.1-Terminus160K1,273,79финальная ветка V3.1
DeepSeek-V3160K0,642,53базовая V3, самая дешёвая
deepseek-chat-v3-0324160K0,642,91чат-сборка V3 (0324)
DeepSeek-R1-0528160K1,275,05рассуждающая, релиз 05-28
deepseek-r1-distill-llama-70b128K2,342,68дистиллят R1 на Llama 70B

Note

Имена deepseek-v4-flash и deepseek-v4-flash-vision-exp в официальном API объявлены устаревшими: их запросы обслуживаются моделью V4.1-Flash по цене Flash (источник: api-docs.deepseek.com, 10/2026).

Линейки: чем отличаются

V4 — текущее поколение

Поколение с контекстным окном 1M токенов — это примерно несколько тысяч страниц текста за один запрос, достаточно для больших кодовых баз и длинных журналов сессий.

  • V4.1-Flash — рабочая лошадка: дёшево на входе, самый дешёвый выход среди актуальных моделей (3,32 ₽/1М), при этом контекст тот же миллион. Для чат-ботов, классификации, рутинной работы с кодом.
  • V4-Pro — флагман: вчетверо дороже на выходе, рассчитан на сложные задачи, где важна точность. Стоит брать точечно, а не по умолчанию.
  • V4-Flash — первая Flash-версия поколения: самая дешёвая в списке (0,74/1,48 ₽), ещё доступна у ряда провайдеров.

V3.x — проверенные универсальные

Поколение с контекстом 128–160K — для большинства бытовых задач этого хватает с запасом. V3 — самая дешёвая точка входа во всё семейство (0,64 ₽ за 1М входных токенов); V3.1-Terminus и V3.2 — доработанные ветки, V3.2-speciale — спец-сборка с тем же прайсом, что и обычная V3.2.

R1 — рассуждающие

R1 перед ответом строит цепочку рассуждений: задача решается дольше и дороже, но на многошаговой математике, логике и сложном коде это окупается. Записывается рассуждение в отдельное поле — клиент видит и «мысли», и ответ. Дистиллят r1-distill-llama-70b — способ получить R1-подобное поведение дешевле на открытом железе, но это уже Llama, обученная на выходах R1, а не сама R1.

Что выбрать под задачу

  • Чат-бот, поддержка, классификация — V4.1-Flash: дёшево, большой контекст, быстрая.
  • Работа с кодом, агенты — V3 или V3.1-Terminus: сильный профиль в коде при цене в разы ниже флагманов.
  • Сложные рассуждения, математика — R1-0528 или V4-Pro.
  • Максимальная экономия — V3 или V4-Flash: 0,64–0,74 ₽ за миллион входных токенов.

Как пользоваться из России

Прямая оплата API DeepSeek предполагает иностранную карту. Обходной путь — шлюз Пуска: модели DeepSeek доступны через OpenAI-совместимый API шлюза с оплатой в рублях с внутреннего кошелька — без VPN, иностранных карт и обмена валюты. Тем же ключом пользуются и AI-агенты на машинах хостинга Пуска (OpenClaw, Hermes, Claude Code, Codex): модель выбирается в кабинете, конфиги обновляются сами.

Частые вопросы

deepseek-flash и V4.1-Flash — это одно и то же?

Да. В официальном API текущее имя — deepseek-flash, и обслуживается оно моделью DeepSeek-V4.1-Flash. Прежние имена Flash-серий принимаются для совместимости, но слушает их та же V4.1-Flash.

Чем R1 отличается от V3 при одинаковой цене?

R1 — рассуждающая: тратит токены на цепочку рассуждений до ответа, поэтому фактическая стоимость запроса выше табличной, а латентность больше. На простых задачах это лишнее — берите V3/V4.1-Flash; R1 включайте для многошаговой логики.

1M контекста — это сколько?

Около 700–800 тысяч слов, то есть несколько тысяч страниц текста или крупная кодовая база целиком. У V3.x контекст 128–160K — тоже немало: примерно книга на запрос.

Есть ли бесплатная модель?

В каталоге Пуска есть бесплатная модель pusk-llm — она включена в тарифы хостинга. Модели DeepSeek платные: списание по фактическим токенам с рублёвого кошелька.

Дальше