deepseekv4.ru

Обзор дипсика/API и цены

API DeepSeek: цены, лимиты и как это устроено

API — единственное, за что разработчик берёт деньги. Разбираем прайс, объясняем, почему цена входа отличается в сто с лишним раз, считаем стоимость реального запроса и перечисляем ограничения, о которых стоит знать заранее.

Кому нужен API и кому не нужен

API — это доступ к модели из чужой программы: ваш код отправляет запрос и получает ответ, без сайта и без интерфейса. Нужен он в трёх случаях: вы встраиваете модель в свой продукт, обрабатываете данные пачками или подключаете модель к редактору кода и другим инструментам.

Обычному пользователю чата API не нужен и ничего не даёт. Это стоит сказать прямо, потому что ожидания часто обратные: оплата API не расширяет возможности чата — не убирает «сервер занят», не увеличивает длину диалога, не открывает скрытых функций. Это два разных продукта с разными аккаунтами; подробности про два кабинета — в разделе об официальном сайте.

Эндпоинты и два формата запросов

Базовый адрес — https://api.deepseek.com. Интерфейс совместим с форматом OpenAI: в большинстве библиотек достаточно заменить базовый URL и ключ, а код запроса остаётся прежним. Дополнительно поддерживается формат Anthropic — по адресу https://api.deepseek.com/anthropic1. Идея простая: не заставлять переписывать интеграцию ради смены модели.

Имена моделей в запросах — deepseek-v4-pro и deepseek-v4-flash. Ключи и баланс живут в кабинете разработчика на platform.deepseek.com, документация — на api-docs.deepseek.com.

Из инструментов документированы вызовы функций (tool calls) — то, на чём строятся агентские сценарии. А вот встроенного поиска в интернете в API нет: поиск, который вы видите в чате, — функция чата, а не модели. В своём приложении поиск придётся подключать самостоятельно.

Цены и что такое попадание в кэш

Официальный прайс, доллары за 1 млн токенов2
МодельВход, кэш попалВход, кэш мимоВыход
deepseek-v4-flash0,00280,140,28
deepseek-v4-pro0,0036250,4350,87

Две колонки на вход — не опечатка. Разработчик кэширует контекст: если начало вашего запроса совпадает с началом предыдущего (тот же системный промпт, та же инструкция, тот же документ), повторно считать его не нужно, и такие токены стоят кратно дешевле: примерно в 50 раз у V4-Flash и в 120 раз у V4-Pro.

Отсюда главный приём экономии: держите неизменную часть запроса в начале, а переменную — в конце. Один и тот же чат-бот с длинной инструкцией может стоить как половина цента за запрос или как несколько центов — разница только в порядке склейки текста.

Сколько стоит реальный запрос

Абстрактные «доллары за миллион» плохо ложатся на интуицию, поэтому посчитаем. Возьмём типичный запрос: 8 000 токенов на входе (инструкция плюс кусок документа) и 1 500 токенов ответа.

МодельВход 8 000Выход 1 500Итого за запрос1 000 запросов
V4-Flash$0,0011$0,0004≈ $0,0015≈ $1,5
V4-Pro$0,0035$0,0013≈ $0,0048≈ $4,8

То есть тысяча полноценных обращений к младшей модели стоит около полутора долларов, к старшей — около пяти. Если при этом инструкция повторяется от запроса к запросу и попадает в кэш, входная часть счёта уменьшается ещё в разы.

Поправка на русский язык

Кириллица кодируется в токены хуже латиницы: один и тот же текст по-русски занимает заметно больше токенов, чем по-английски. На больших объёмах закладывайте надбавку к расчёту — она не отменяет того, что тарифы у дипсика одни из самых низких, но делает оценку честной.

Лимиты и отсутствие бесплатного тарифа

Бесплатного уровня у API нет: пробных токенов на новый аккаунт не начисляют, работа идёт с баланса. Это важное отличие от чата — чат бесплатен целиком, API платен целиком.

Ограничение, о котором стоит знать заранее, — конкурентность, то есть сколько запросов можно держать одновременно: 500 у V4-Pro и 2 500 у V4-Flash. Расширение лимита разработчик предоставляет по заявке и, судя по документации, бесплатно 3. Для большинства проектов эти цифры избыточны; упереться в них можно только при массовой пакетной обработке.

Миллион токенов контекста на практике

Контекст обеих моделей V4 — миллион токенов, максимальная длина ответа — 384 тысячи. Чтобы перевести это в понятные величины: миллион токенов русского текста — это грубо триста-четыреста тысяч слов, то есть несколько толстых книг разом. На таком объёме модель показывает 83,5% в тесте MRCR на поиск информации в длинном контексте — заявка серьёзная, но проверять на своей задаче всё равно стоит: качество работы с длинным контекстом падает неравномерно и зависит от того, где именно в тексте лежит нужный факт.

Практическая оговорка: это цифры API. В веб-чате диалог упирается в предел заметно раньше — что делать в этом случае, разобрано в разделе про ошибки.

Оплата и юридическая сторона

Официального перечня способов оплаты разработчик не публикует: платёжный раздел находится за авторизацией в кабинете. Что известно точно и что важнее способа оплаты: юридического лица в России у компании нет, пользовательское соглашение подчинено праву КНР, споры отнесены к судам Ханчжоу, а данные обрабатываются и хранятся в КНР 4. Для личного проекта это чаще всего не имеет значения, для корпоративного контура — имеет; подробный разбор в разделе о данных.

Альтернатива, которая снимает вопрос целиком: развернуть модель у себя. Веса открыты под MIT, и в этом случае никакого договора с разработчиком не требуется вовсе.

Короткие ответы

Сколько стоит API DeepSeek?

V4-Flash — 0,14 доллара за миллион входных токенов и 0,28 за миллион выходных. V4-Pro — 0,435 и 0,87 соответственно. Токены, попавшие в кэш контекста, на входе стоят примерно в 50 раз дешевле у Flash и в 120 раз у Pro.

Есть ли у DeepSeek бесплатный API?

Нет. Бесплатного тарифного уровня и пробных токенов у API не предусмотрено — работа идёт с пополненного баланса. Бесплатны только веб-чат и мобильное приложение.

Даёт ли оплата API преимущества в чате?

Нет, это разные продукты с разными аккаунтами. Баланс в кабинете разработчика не убирает сообщение «сервер занят» и не увеличивает длину диалога в чате.

Какой базовый адрес у API DeepSeek?

https://api.deepseek.com — интерфейс совместим с форматом OpenAI, поэтому в большинстве библиотек достаточно заменить базовый URL и ключ. Дополнительно поддерживается формат Anthropic по адресу https://api.deepseek.com/anthropic. Имена моделей в запросах — deepseek-v4-pro и deepseek-v4-flash.

Есть ли в API DeepSeek поиск в интернете?

Нет. Поиск, который вы видите в чате, — функция чата, а не модели: в документации API встроенного веб-поиска нет. В своём приложении его придётся подключать самостоятельно. Из инструментов документированы вызовы функций, на которых и строятся агентские сценарии.

Сколько запросов к API DeepSeek можно держать одновременно?

Лимит конкурентности — 500 у V4-Pro и 2 500 у V4-Flash. Расширение разработчик предоставляет по заявке и, судя по документации, бесплатно. Для большинства проектов эти цифры избыточны: упереться в них можно только при массовой пакетной обработке.

Сноски и источники

  1. Базовые адреса и совместимость форматов описаны в документации разработчика: api.deepseek.com — формат OpenAI, api.deepseek.com/anthropic — формат Anthropic.
  2. Официальный прайс: api-docs.deepseek.com/quick_start/pricing. Расчёты в таблице выше — арифметика по этим ставкам, а не отдельный источник.
  3. Лимиты конкурентности — 500 у V4-Pro и 2 500 у V4-Flash; бесплатного тарифного уровня у API нет.
  4. Хранение данных в КНР зафиксировано в политике конфиденциальности, подчинение праву КНР и подсудность Ханчжоу — в пользовательском соглашении.

У моделей с публичным API условия подключения и оплаты различаются заметно. Сводка по всем — в рейтинге.

Модели с доступным API