deepseekv4.ru

Обзор дипсика/Версии и модели

Версии DeepSeek: что есть сейчас и что было раньше

Линейка дипсика выглядит запутанной: V4, V3, R1, дистилляты, суффиксы из четырёх цифр. На деле актуальных моделей всего две, остальное — история и специальные сборки. Разбираем, что есть что и какую версию имеет смысл выбирать.

Что актуально сейчас

Актуальных моделей две, и обе вышли 24 апреля 2026 года: тяжёлая DeepSeek-V4-Pro и лёгкая DeepSeek-V4-Flash1. Всё остальное, что встречается в каталогах и обсуждениях, — либо прошлые поколения, либо производные сборки.

МодельПараметрыКонтекст$/1M вход$/1M выходЛицензия
DeepSeek-V4-Pro1,6 трлн / 49 млрд активных1 000 0000,4350,87MIT
DeepSeek-V4-Flash284 млрд / 13 млрд активных1 000 0000,140,28MIT

Обе — разреженные MoE-модели: в генерации каждого токена участвует лишь малая часть весов, отсюда разрыв между «всего» и «активных». Поколение принесло гибридное внимание — сжатое разреженное (CSA) вместе с сильно сжатым (HCA); разработчик заявляет 27% вычислений на токен от предыдущего поколения при сохранении миллионного контекста. Обучение шло на оптимизаторе Muon. Проще говоря, главная ставка V4 — не «умнее любой ценой», а «столько же качества за втрое меньшие вычисления».

Статус Preview и история с «релизом 20 июля»

Тонкий момент, который стоит знать, если вы читаете о дипсике в других местах. Запись о четвёртом поколении в официальном списке обновлений датирована 24 апреля 2026 года и помечена как Preview — предварительный релиз. На момент нашей сверки документации эта запись оставалась последней: никакого отдельного объявления о переходе в стабильную версию в официальных источниках не появилось.

Неподтверждённое

По обзорным сайтам разошлась дата «GA 20 июля 2026» — якобы день, когда V4 стала стабильной. Первоисточником она не подтверждается: в списке обновлений разработчика такой записи нет. Известно, что в июне рассылался анонс о стабильной версии «в середине июля», но анонс — это не факт выпуска. Мы не утверждаем ни что GA состоялся, ни что нет; мы говорим, что публичного подтверждения не нашли 2.

Практического значения для пользователя чата это почти не имеет — чат работает на актуальной модели независимо от буквы статуса. А вот для того, кто строит продукт на API, статус Preview — сигнал: поведение и параметры такой модели вендор может менять без длинного цикла уведомлений.

V4-Pro или V4-Flash

Различие не в «умнее — глупее», а в компромиссе цены, скорости и глубины.

V4-Flash
13 миллиардов активных параметров, ответ дешевле в три с лишним раза и заметно быстрее. Логичный выбор для массовых операций: классификация, извлечение данных, короткие ответы, черновики, обработка потока обращений. По русскому бенчмарку MERA отстаёт от старшей модели всего на одну сотую (0,677 против 0,687) — то есть переплата за Pro в языковых задачах далеко не всегда оправдана.
V4-Pro
49 миллиардов активных параметров. Берут там, где ошибка дорога: сложный код, многошаговые рассуждения, длинные исследовательские задачи, работа с большим документом целиком. Заявленные результаты — MMLU-Pro 87,5%, LiveCodeBench 93,5%, рейтинг Codeforces 3206, MRCR на миллионном контексте 83,5%.

Практическое правило: начинать с Flash и поднимать до Pro только там, где качество измеримо не устраивает. Разница в счёте при больших объёмах получается кратной, а разница в качестве — задачезависимой.

Режимы рассуждения

У четвёртого поколения три режима работы: без рассуждения и два уровня «думающего» режима — обычный и максимальный. Отличаются они тем, сколько модели позволено «размышлять» перед ответом: в думающих режимах она сначала строит внутреннюю цепочку рассуждений и только потом отвечает.

В чате пользователь видит упрощённую версию того же выбора — переключатель между быстрым ответом и режимом углублённого размышления. Практические следствия одинаковые: думающий режим сильнее в математике, логике и коде, но отвечает дольше, тратит кратно больше токенов и чаще упирается в перегрузку сервиса. Для «перепиши это письмо» он не нужен.

Что было до V4: R1 и линейка V3

Предыдущие поколения никуда не делись: они лежат в открытом доступе, крутятся в облачных каталогах и до сих пор используются в продуктах.

В четвёртом поколении отдельной «R-ветки» уже нет: рассуждение встроено в основную модель как режим, а не вынесено в отдельный продукт.

Дистилляты и специальные модели

Кроме флагманов у семейства есть производные, которые часто принимают за «дипсик поменьше»:

Что означают цифры в названиях

В обсуждениях мелькают обозначения вроде v4-flash-0731 или v4-pro-0813. Четыре цифры — это обычно снапшот, то есть зафиксированная на конкретную дату сборка модели (месяц и день); такая практика принята у многих вендоров, чтобы продукт не «поехал» из-за незаметного обновления.

Проверить конкретный снапшот стоит в актуальной документации API: в официальном списке обновлений на момент нашей сверки записей о снапшотах V4 с такими суффиксами не было. Названия модели, которые точно существуют в API, — deepseek-v4-pro и deepseek-v4-flash.

Чего в линейке нет

Чтобы не искать несуществующее: у DeepSeek нет моделей для генерации изображений, видео и музыки, нет синтеза и распознавания речи, нет модели для управления компьютером. Флагманы V4 описаны как текстовые — текст на входе, текст на выходе. Всё, что предлагается в интернете как «дипсик рисует картинки», сделано не разработчиком.

Короткие ответы

Чем отличается DeepSeek V4-Pro от V4-Flash?

Размером и ценой: у Pro 49 млрд активных параметров, у Flash — 13 млрд, вход и выход дешевле примерно втрое. Контекст у обеих один миллион токенов. По русскому бенчмарку MERA разрыв составляет одну сотую балла.

Вышла ли DeepSeek V4 в стабильном релизе?

Публичного подтверждения нет. Последняя запись в официальном списке обновлений — от 24 апреля 2026 года со статусом Preview; дата «GA 20 июля», которая ходит по обзорам, первоисточником не подтверждается.

Что такое DeepSeek R1 и нужна ли она сейчас?

Это рассуждающая модель прошлого поколения, с которой компания стала широко известна. В четвёртом поколении отдельной R-ветки нет: рассуждение встроено в основную модель как режим.

Какие режимы рассуждения есть у DeepSeek V4?

Три: обычный ответ без размышления и два уровня «думающего» режима. В думающих режимах модель сначала строит внутреннюю цепочку рассуждений и только потом отвечает — она сильнее в математике, логике и коде, но отвечает дольше, тратит кратно больше токенов и чаще упирается в перегрузку сервиса.

Что означают цифры вроде v4-flash-0731 в названии модели?

Четыре цифры — это обычно снапшот, зафиксированная на конкретную дату сборка: месяц и день. В официальном списке обновлений на момент сверки записей о снапшотах V4 с такими суффиксами не было. Имена, которые точно существуют в API, — deepseek-v4-pro и deepseek-v4-flash.

Актуальна ли ещё DeepSeek V3?

Она никуда не делась: лежит в открытом доступе и крутится в облачных каталогах. В русскоязычном бенчмарке MERA V3 набирает 0,677 — столько же, сколько V4-Flash, и всего на сотую меньше V4-Pro. У поколения есть уточнённые сборки: V3-0324, V3.1, V3.1-Terminus и V3.2.

Сноски и источники

  1. Дата выхода четвёртого поколения и статус Preview — по официальному списку обновлений разработчика: api-docs.deepseek.com/updates.
  2. Дата «GA 20 июля 2026» встречается во вторичных источниках, но записи о переходе в стабильный релиз в официальном списке обновлений на момент сверки не было. Публиковать её как факт мы не считаем возможным.
  3. Параметры, контекст и цены — из карточек моделей и официального прайса: api-docs.deepseek.com/quick_start/pricing.
  4. Результаты в русскоязычном бенчмарке MERA: V4-Pro 0,687, V4-Flash 0,677, V3 0,677.

Дипсик — один из нескольких китайских флагманов, и по разным задачам они расходятся сильнее, чем по цене. Сравнение — в рейтинге.

Сравнить китайские модели