Модели DeepSeek: полный список — V4, V3.2, R1 и цены
«Какие бывают модели DeepSeek» — вопрос, на который официальный сайт отвечает двумя строками (сейчас в API два актуальных имени: deepseek-flash и deepseek-v4-pro (источник: api-docs.deepseek.com, 10/2026)), а под капотом у разных провайдеров живёт заметно больше версий: в каталоге шлюза Пуска их сейчас десять. Разбираем всё семейство: чем отличаются линейки, что взять под чат-бота, а что под код, и сколько это стоит в рублях.
TL;DR
- Текущее поколение — V4:
deepseek-flash(собственно V4.1-Flash) — недорогая рабочая модель с контекстом 1M токенов;deepseek-v4-pro— флагман. - V3.x — проверенное универсальное поколение, самая дешёвая точка входа (0,64 ₽ за 1М входных токенов).
- R1 — рассуждающие модели: перед ответом «думают», это дороже и медленнее, но сильнее на сложных задачах.
- Цены ниже — из каталога шлюза Пуска, оплата в рублях, без VPN и иностранных карт.
Полный список моделей DeepSeek
Все десять версий, которые доступны через шлюз Пуска — с контекстным окном и ценой за миллион токенов (источник: каталог /models/deepseek, 05.10.2026):
| Модель | Контекст | Вход, ₽/1М | Выход, ₽/1М | Что это |
|---|---|---|---|---|
| DeepSeek-V4.1-Flash | 1M | 1,11 | 3,32 | текущая лёгкая (API-имя deepseek-flash) |
| DeepSeek-V4-Pro | 1M | 3,12 | 12,45 | флагман поколения V4 |
| DeepSeek-V4-Flash | 1M | 0,74 | 1,48 | первая Flash-версия V4 |
| DeepSeek-V3.2 | 128K | 1,94 | 5,61 | универсальная V3 |
| DeepSeek-V3.2-speciale | 160K | 1,94 | 5,61 | спец-сборка V3.2 |
| DeepSeek-V3.1-Terminus | 160K | 1,27 | 3,79 | финальная ветка V3.1 |
| DeepSeek-V3 | 160K | 0,64 | 2,53 | базовая V3, самая дешёвая |
| deepseek-chat-v3-0324 | 160K | 0,64 | 2,91 | чат-сборка V3 (0324) |
| DeepSeek-R1-0528 | 160K | 1,27 | 5,05 | рассуждающая, релиз 05-28 |
| deepseek-r1-distill-llama-70b | 128K | 2,34 | 2,68 | дистиллят R1 на Llama 70B |
Note
Имена deepseek-v4-flash и deepseek-v4-flash-vision-exp в официальном API объявлены устаревшими: их запросы обслуживаются моделью V4.1-Flash по цене Flash (источник: api-docs.deepseek.com, 10/2026).
Линейки: чем отличаются
V4 — текущее поколение
Поколение с контекстным окном 1M токенов — это примерно несколько тысяч страниц текста за один запрос, достаточно для больших кодовых баз и длинных журналов сессий.
- V4.1-Flash — рабочая лошадка: дёшево на входе, самый дешёвый выход среди актуальных моделей (3,32 ₽/1М), при этом контекст тот же миллион. Для чат-ботов, классификации, рутинной работы с кодом.
- V4-Pro — флагман: вчетверо дороже на выходе, рассчитан на сложные задачи, где важна точность. Стоит брать точечно, а не по умолчанию.
- V4-Flash — первая Flash-версия поколения: самая дешёвая в списке (0,74/1,48 ₽), ещё доступна у ряда провайдеров.
V3.x — проверенные универсальные
Поколение с контекстом 128–160K — для большинства бытовых задач этого хватает с запасом. V3 — самая дешёвая точка входа во всё семейство (0,64 ₽ за 1М входных токенов); V3.1-Terminus и V3.2 — доработанные ветки, V3.2-speciale — спец-сборка с тем же прайсом, что и обычная V3.2.
R1 — рассуждающие
R1 перед ответом строит цепочку рассуждений: задача решается дольше и дороже, но на многошаговой математике, логике и сложном коде это окупается. Записывается рассуждение в отдельное поле — клиент видит и «мысли», и ответ. Дистиллят r1-distill-llama-70b — способ получить R1-подобное поведение дешевле на открытом железе, но это уже Llama, обученная на выходах R1, а не сама R1.
Что выбрать под задачу
- Чат-бот, поддержка, классификация — V4.1-Flash: дёшево, большой контекст, быстрая.
- Работа с кодом, агенты — V3 или V3.1-Terminus: сильный профиль в коде при цене в разы ниже флагманов.
- Сложные рассуждения, математика — R1-0528 или V4-Pro.
- Максимальная экономия — V3 или V4-Flash: 0,64–0,74 ₽ за миллион входных токенов.
Как пользоваться из России
Прямая оплата API DeepSeek предполагает иностранную карту. Обходной путь — шлюз Пуска: модели DeepSeek доступны через OpenAI-совместимый API шлюза с оплатой в рублях с внутреннего кошелька — без VPN, иностранных карт и обмена валюты. Тем же ключом пользуются и AI-агенты на машинах хостинга Пуска (OpenClaw, Hermes, Claude Code, Codex): модель выбирается в кабинете, конфиги обновляются сами.
Частые вопросы
deepseek-flash и V4.1-Flash — это одно и то же?
Да. В официальном API текущее имя — deepseek-flash, и обслуживается оно моделью DeepSeek-V4.1-Flash. Прежние имена Flash-серий принимаются для совместимости, но слушает их та же V4.1-Flash.
Чем R1 отличается от V3 при одинаковой цене?
R1 — рассуждающая: тратит токены на цепочку рассуждений до ответа, поэтому фактическая стоимость запроса выше табличной, а латентность больше. На простых задачах это лишнее — берите V3/V4.1-Flash; R1 включайте для многошаговой логики.
1M контекста — это сколько?
Около 700–800 тысяч слов, то есть несколько тысяч страниц текста или крупная кодовая база целиком. У V3.x контекст 128–160K — тоже немало: примерно книга на запрос.
Есть ли бесплатная модель?
В каталоге Пуска есть бесплатная модель pusk-llm — она включена в тарифы хостинга. Модели DeepSeek платные: списание по фактическим токенам с рублёвого кошелька.
Дальше
- Все модели DeepSeek на витрине — живой каталог с актуальными ценами.
- Нейросети без VPN — как устроен доступ к моделям из России.
- Тарифы хостинга — машины для агентов в зарубежных дата-центрах.