Версии DeepSeek: что есть сейчас и что было раньше
Линейка дипсика выглядит запутанной: V4, V3, R1, дистилляты, суффиксы из четырёх цифр. На деле актуальных моделей всего две, остальное — история и специальные сборки. Разбираем, что есть что и какую версию имеет смысл выбирать.
Что актуально сейчас
Актуальных моделей две, и обе вышли 24 апреля 2026 года: тяжёлая DeepSeek-V4-Pro и лёгкая DeepSeek-V4-Flash1. Всё остальное, что встречается в каталогах и обсуждениях, — либо прошлые поколения, либо производные сборки.
| Модель | Параметры | Контекст | $/1M вход | $/1M выход | Лицензия |
|---|---|---|---|---|---|
| DeepSeek-V4-Pro | 1,6 трлн / 49 млрд активных | 1 000 000 | 0,435 | 0,87 | MIT |
| DeepSeek-V4-Flash | 284 млрд / 13 млрд активных | 1 000 000 | 0,14 | 0,28 | MIT |
Обе — разреженные MoE-модели: в генерации каждого токена участвует лишь малая часть весов, отсюда разрыв между «всего» и «активных». Поколение принесло гибридное внимание — сжатое разреженное (CSA) вместе с сильно сжатым (HCA); разработчик заявляет 27% вычислений на токен от предыдущего поколения при сохранении миллионного контекста. Обучение шло на оптимизаторе Muon. Проще говоря, главная ставка V4 — не «умнее любой ценой», а «столько же качества за втрое меньшие вычисления».
Статус Preview и история с «релизом 20 июля»
Тонкий момент, который стоит знать, если вы читаете о дипсике в других местах. Запись о четвёртом поколении в официальном списке обновлений датирована 24 апреля 2026 года и помечена как Preview — предварительный релиз. На момент нашей сверки документации эта запись оставалась последней: никакого отдельного объявления о переходе в стабильную версию в официальных источниках не появилось.
По обзорным сайтам разошлась дата «GA 20 июля 2026» — якобы день, когда V4 стала стабильной. Первоисточником она не подтверждается: в списке обновлений разработчика такой записи нет. Известно, что в июне рассылался анонс о стабильной версии «в середине июля», но анонс — это не факт выпуска. Мы не утверждаем ни что GA состоялся, ни что нет; мы говорим, что публичного подтверждения не нашли 2.
Практического значения для пользователя чата это почти не имеет — чат работает на актуальной модели независимо от буквы статуса. А вот для того, кто строит продукт на API, статус Preview — сигнал: поведение и параметры такой модели вендор может менять без длинного цикла уведомлений.
V4-Pro или V4-Flash
Различие не в «умнее — глупее», а в компромиссе цены, скорости и глубины.
- V4-Flash
- 13 миллиардов активных параметров, ответ дешевле в три с лишним раза и заметно быстрее. Логичный выбор для массовых операций: классификация, извлечение данных, короткие ответы, черновики, обработка потока обращений. По русскому бенчмарку MERA отстаёт от старшей модели всего на одну сотую (0,677 против 0,687) — то есть переплата за Pro в языковых задачах далеко не всегда оправдана.
- V4-Pro
- 49 миллиардов активных параметров. Берут там, где ошибка дорога: сложный код, многошаговые рассуждения, длинные исследовательские задачи, работа с большим документом целиком. Заявленные результаты — MMLU-Pro 87,5%, LiveCodeBench 93,5%, рейтинг Codeforces 3206, MRCR на миллионном контексте 83,5%.
Практическое правило: начинать с Flash и поднимать до Pro только там, где качество измеримо не устраивает. Разница в счёте при больших объёмах получается кратной, а разница в качестве — задачезависимой.
Режимы рассуждения
У четвёртого поколения три режима работы: без рассуждения и два уровня «думающего» режима — обычный и максимальный. Отличаются они тем, сколько модели позволено «размышлять» перед ответом: в думающих режимах она сначала строит внутреннюю цепочку рассуждений и только потом отвечает.
В чате пользователь видит упрощённую версию того же выбора — переключатель между быстрым ответом и режимом углублённого размышления. Практические следствия одинаковые: думающий режим сильнее в математике, логике и коде, но отвечает дольше, тратит кратно больше токенов и чаще упирается в перегрузку сервиса. Для «перепиши это письмо» он не нужен.
Что было до V4: R1 и линейка V3
Предыдущие поколения никуда не делись: они лежат в открытом доступе, крутятся в облачных каталогах и до сих пор используются в продуктах.
- DeepSeek-V3 — рабочая лошадка прошлого поколения, обычная (не рассуждающая) модель. В русском бенчмарке MERA набирает 0,677 — то есть отставание от V4-Pro меньше, чем можно было бы ожидать.
- Обновления V3 — версии, известные как V3-0324, V3.1, V3.1-Terminus, V3.2. Каждая — не новая модель, а уточнённая сборка того же поколения.
- DeepSeek-R1 — рассуждающая модель, та самая, с которой компания и стала широко известна. Именно она приучила рынок к тому, что открытые веса и цепочка рассуждений могут идти вместе. Позднее вышло обновление, известное как R1-0528.
В четвёртом поколении отдельной «R-ветки» уже нет: рассуждение встроено в основную модель как режим, а не вынесено в отдельный продукт.
Дистилляты и специальные модели
Кроме флагманов у семейства есть производные, которые часто принимают за «дипсик поменьше»:
- Дистилляты R1 — модели других семейств (Qwen, Llama) размером от 1,5 до 70 миллиардов параметров, дообученные на ответах рассуждающей модели. Их и запускают локально; подробнее — в разделе о скачивании. Важно: это не уменьшенный дипсик, а другая модель, перенявшая манеру рассуждать.
- DeepSeek-Coder — линейка, специализированная на программировании; была самостоятельным продуктом в предыдущих поколениях.
- DeepSeek-OCR — отдельная модель для распознавания текста на изображениях и в документах. Её существование объясняет, почему картинку в чат загрузить можно, хотя сама V4 описана как текстовая.
Что означают цифры в названиях
В обсуждениях мелькают обозначения вроде v4-flash-0731 или
v4-pro-0813. Четыре цифры — это обычно снапшот, то есть зафиксированная
на конкретную дату сборка модели (месяц и день); такая практика принята у многих
вендоров, чтобы продукт не «поехал» из-за незаметного обновления.
Проверить конкретный снапшот стоит в актуальной документации API: в официальном списке
обновлений на момент нашей сверки записей о снапшотах V4 с такими суффиксами не было.
Названия модели, которые точно существуют в API, — deepseek-v4-pro
и deepseek-v4-flash.
Чего в линейке нет
Чтобы не искать несуществующее: у DeepSeek нет моделей для генерации изображений, видео и музыки, нет синтеза и распознавания речи, нет модели для управления компьютером. Флагманы V4 описаны как текстовые — текст на входе, текст на выходе. Всё, что предлагается в интернете как «дипсик рисует картинки», сделано не разработчиком.
Короткие ответы
Чем отличается DeepSeek V4-Pro от V4-Flash?
Размером и ценой: у Pro 49 млрд активных параметров, у Flash — 13 млрд, вход и выход дешевле примерно втрое. Контекст у обеих один миллион токенов. По русскому бенчмарку MERA разрыв составляет одну сотую балла.
Вышла ли DeepSeek V4 в стабильном релизе?
Публичного подтверждения нет. Последняя запись в официальном списке обновлений — от 24 апреля 2026 года со статусом Preview; дата «GA 20 июля», которая ходит по обзорам, первоисточником не подтверждается.
Что такое DeepSeek R1 и нужна ли она сейчас?
Это рассуждающая модель прошлого поколения, с которой компания стала широко известна. В четвёртом поколении отдельной R-ветки нет: рассуждение встроено в основную модель как режим.
Какие режимы рассуждения есть у DeepSeek V4?
Три: обычный ответ без размышления и два уровня «думающего» режима. В думающих режимах модель сначала строит внутреннюю цепочку рассуждений и только потом отвечает — она сильнее в математике, логике и коде, но отвечает дольше, тратит кратно больше токенов и чаще упирается в перегрузку сервиса.
Что означают цифры вроде v4-flash-0731 в названии модели?
Четыре цифры — это обычно снапшот, зафиксированная на конкретную дату сборка: месяц и день. В официальном списке обновлений на момент сверки записей о снапшотах V4 с такими суффиксами не было. Имена, которые точно существуют в API, — deepseek-v4-pro и deepseek-v4-flash.
Актуальна ли ещё DeepSeek V3?
Она никуда не делась: лежит в открытом доступе и крутится в облачных каталогах. В русскоязычном бенчмарке MERA V3 набирает 0,677 — столько же, сколько V4-Flash, и всего на сотую меньше V4-Pro. У поколения есть уточнённые сборки: V3-0324, V3.1, V3.1-Terminus и V3.2.
Сноски и источники
- Дата выхода четвёртого поколения и статус Preview — по официальному списку обновлений разработчика: api-docs.deepseek.com/updates. ↩
- Дата «GA 20 июля 2026» встречается во вторичных источниках, но записи о переходе в стабильный релиз в официальном списке обновлений на момент сверки не было. Публиковать её как факт мы не считаем возможным. ↩
- Параметры, контекст и цены — из карточек моделей и официального прайса: api-docs.deepseek.com/quick_start/pricing.
- Результаты в русскоязычном бенчмарке MERA: V4-Pro 0,687, V4-Flash 0,677, V3 0,677.