API DeepSeek: цены, лимиты и как это устроено
API — единственное, за что разработчик берёт деньги. Разбираем прайс, объясняем, почему цена входа отличается в сто с лишним раз, считаем стоимость реального запроса и перечисляем ограничения, о которых стоит знать заранее.
Кому нужен API и кому не нужен
API — это доступ к модели из чужой программы: ваш код отправляет запрос и получает ответ, без сайта и без интерфейса. Нужен он в трёх случаях: вы встраиваете модель в свой продукт, обрабатываете данные пачками или подключаете модель к редактору кода и другим инструментам.
Обычному пользователю чата API не нужен и ничего не даёт. Это стоит сказать прямо, потому что ожидания часто обратные: оплата API не расширяет возможности чата — не убирает «сервер занят», не увеличивает длину диалога, не открывает скрытых функций. Это два разных продукта с разными аккаунтами; подробности про два кабинета — в разделе об официальном сайте.
Эндпоинты и два формата запросов
Базовый адрес — https://api.deepseek.com. Интерфейс совместим с форматом
OpenAI: в большинстве библиотек достаточно заменить базовый URL и ключ, а код запроса
остаётся прежним. Дополнительно поддерживается формат Anthropic — по адресу
https://api.deepseek.com/anthropic1.
Идея простая: не заставлять переписывать интеграцию ради смены модели.
Имена моделей в запросах — deepseek-v4-pro и deepseek-v4-flash.
Ключи и баланс живут в кабинете разработчика на platform.deepseek.com,
документация — на api-docs.deepseek.com.
Из инструментов документированы вызовы функций (tool calls) — то, на чём строятся агентские сценарии. А вот встроенного поиска в интернете в API нет: поиск, который вы видите в чате, — функция чата, а не модели. В своём приложении поиск придётся подключать самостоятельно.
Цены и что такое попадание в кэш
| Модель | Вход, кэш попал | Вход, кэш мимо | Выход |
|---|---|---|---|
| deepseek-v4-flash | 0,0028 | 0,14 | 0,28 |
| deepseek-v4-pro | 0,003625 | 0,435 | 0,87 |
Две колонки на вход — не опечатка. Разработчик кэширует контекст: если начало вашего запроса совпадает с началом предыдущего (тот же системный промпт, та же инструкция, тот же документ), повторно считать его не нужно, и такие токены стоят кратно дешевле: примерно в 50 раз у V4-Flash и в 120 раз у V4-Pro.
Отсюда главный приём экономии: держите неизменную часть запроса в начале, а переменную — в конце. Один и тот же чат-бот с длинной инструкцией может стоить как половина цента за запрос или как несколько центов — разница только в порядке склейки текста.
Сколько стоит реальный запрос
Абстрактные «доллары за миллион» плохо ложатся на интуицию, поэтому посчитаем. Возьмём типичный запрос: 8 000 токенов на входе (инструкция плюс кусок документа) и 1 500 токенов ответа.
| Модель | Вход 8 000 | Выход 1 500 | Итого за запрос | 1 000 запросов |
|---|---|---|---|---|
| V4-Flash | $0,0011 | $0,0004 | ≈ $0,0015 | ≈ $1,5 |
| V4-Pro | $0,0035 | $0,0013 | ≈ $0,0048 | ≈ $4,8 |
То есть тысяча полноценных обращений к младшей модели стоит около полутора долларов, к старшей — около пяти. Если при этом инструкция повторяется от запроса к запросу и попадает в кэш, входная часть счёта уменьшается ещё в разы.
Кириллица кодируется в токены хуже латиницы: один и тот же текст по-русски занимает заметно больше токенов, чем по-английски. На больших объёмах закладывайте надбавку к расчёту — она не отменяет того, что тарифы у дипсика одни из самых низких, но делает оценку честной.
Лимиты и отсутствие бесплатного тарифа
Бесплатного уровня у API нет: пробных токенов на новый аккаунт не начисляют, работа идёт с баланса. Это важное отличие от чата — чат бесплатен целиком, API платен целиком.
Ограничение, о котором стоит знать заранее, — конкурентность, то есть сколько запросов можно держать одновременно: 500 у V4-Pro и 2 500 у V4-Flash. Расширение лимита разработчик предоставляет по заявке и, судя по документации, бесплатно 3. Для большинства проектов эти цифры избыточны; упереться в них можно только при массовой пакетной обработке.
Миллион токенов контекста на практике
Контекст обеих моделей V4 — миллион токенов, максимальная длина ответа — 384 тысячи. Чтобы перевести это в понятные величины: миллион токенов русского текста — это грубо триста-четыреста тысяч слов, то есть несколько толстых книг разом. На таком объёме модель показывает 83,5% в тесте MRCR на поиск информации в длинном контексте — заявка серьёзная, но проверять на своей задаче всё равно стоит: качество работы с длинным контекстом падает неравномерно и зависит от того, где именно в тексте лежит нужный факт.
Практическая оговорка: это цифры API. В веб-чате диалог упирается в предел заметно раньше — что делать в этом случае, разобрано в разделе про ошибки.
Оплата и юридическая сторона
Официального перечня способов оплаты разработчик не публикует: платёжный раздел находится за авторизацией в кабинете. Что известно точно и что важнее способа оплаты: юридического лица в России у компании нет, пользовательское соглашение подчинено праву КНР, споры отнесены к судам Ханчжоу, а данные обрабатываются и хранятся в КНР 4. Для личного проекта это чаще всего не имеет значения, для корпоративного контура — имеет; подробный разбор в разделе о данных.
Альтернатива, которая снимает вопрос целиком: развернуть модель у себя. Веса открыты под MIT, и в этом случае никакого договора с разработчиком не требуется вовсе.
Короткие ответы
Сколько стоит API DeepSeek?
V4-Flash — 0,14 доллара за миллион входных токенов и 0,28 за миллион выходных. V4-Pro — 0,435 и 0,87 соответственно. Токены, попавшие в кэш контекста, на входе стоят примерно в 50 раз дешевле у Flash и в 120 раз у Pro.
Есть ли у DeepSeek бесплатный API?
Нет. Бесплатного тарифного уровня и пробных токенов у API не предусмотрено — работа идёт с пополненного баланса. Бесплатны только веб-чат и мобильное приложение.
Даёт ли оплата API преимущества в чате?
Нет, это разные продукты с разными аккаунтами. Баланс в кабинете разработчика не убирает сообщение «сервер занят» и не увеличивает длину диалога в чате.
Какой базовый адрес у API DeepSeek?
https://api.deepseek.com — интерфейс совместим с форматом OpenAI, поэтому в большинстве библиотек достаточно заменить базовый URL и ключ. Дополнительно поддерживается формат Anthropic по адресу https://api.deepseek.com/anthropic. Имена моделей в запросах — deepseek-v4-pro и deepseek-v4-flash.
Есть ли в API DeepSeek поиск в интернете?
Нет. Поиск, который вы видите в чате, — функция чата, а не модели: в документации API встроенного веб-поиска нет. В своём приложении его придётся подключать самостоятельно. Из инструментов документированы вызовы функций, на которых и строятся агентские сценарии.
Сколько запросов к API DeepSeek можно держать одновременно?
Лимит конкурентности — 500 у V4-Pro и 2 500 у V4-Flash. Расширение разработчик предоставляет по заявке и, судя по документации, бесплатно. Для большинства проектов эти цифры избыточны: упереться в них можно только при массовой пакетной обработке.
Сноски и источники
- Базовые адреса и совместимость форматов описаны в документации разработчика: api.deepseek.com — формат OpenAI, api.deepseek.com/anthropic — формат Anthropic. ↩
- Официальный прайс: api-docs.deepseek.com/quick_start/pricing. Расчёты в таблице выше — арифметика по этим ставкам, а не отдельный источник. ↩
- Лимиты конкурентности — 500 у V4-Pro и 2 500 у V4-Flash; бесплатного тарифного уровня у API нет. ↩
- Хранение данных в КНР зафиксировано в политике конфиденциальности, подчинение праву КНР и подсудность Ханчжоу — в пользовательском соглашении. ↩