DeepSeek V4 Pro — это флагманская модель из семейства DeepSeek V4, выпущенная 24 апреля 2026 года под лицензией MIT с открытыми весами на Hugging Face. Это модель «микширования экспертов» (Mixture-of-Experts) с 1,6 трлн общих параметров и 49 млрд активных параметров на токен, предварительно обученная на 33 трлн токенов. Она поставляется вместе с более легкой версией DeepSeek V4 Flash (284B / 13B активных).
Модель принимает текст на вход и выдает текст на выход, предоставляя единый идентификатор — deepseek-v4-pro — с параметром интенсивности рассуждений (reasoning-effort) вместо раздельных эндпоинтов для чата и рассуждений. Оба эндпоинта совместимы с OpenAI ChatCompletions и Anthropic, поэтому вызов API DeepSeek V4 Pro из существующего клиента GPT или Claude требует лишь изменения базового URL (base-URL) и строки модели, а не полного переписывания кода. Поскольку веса распространяются под лицензией MIT, релиз с открытым исходным кодом deepseek v4 pro api также разрешает самостоятельный хостинг (self-hosting) и коммерческое использование без каких-либо ограничений по использованию или региональных ограничений.
Таблица характеристик
| Характеристика | DeepSeek V4 Pro |
|---|---|
| Провайдер | DeepSeek |
| Дата выпуска | 24 апреля 2026 г. |
| Архитектура | Mixture-of-Experts, гибридное внимание (CSA + HCA) |
| Всего / активных параметров | 1.6T / 49B на токен |
| Контекстное окно | 1 048 576 токенов (1M) |
| Макс. вывод | 384 000 токенов |
| Входная модальность | Текст |
| Режимы рассуждений | Без мышления · Мышление: высокий (по умолчанию) · Мышление: макс. |
| Лицензия | MIT (открытые веса) |
| Совместимость с API | OpenAI ChatCompletions + Anthropic |
| Строка модели GPTProto | deepseek-v4-pro |
| Цена GPTProto (вход / выход за 1M) | $1.3914 / $2.7838 |
DeepSeek V4 Pro против DeepSeek V4 Flash
Обе модели имеют одинаковое контекстное окно на 1M токенов, максимальный вывод 384K, лицензию MIT и те же элементы управления интенсивностью рассуждений. Разница заключается в размере и стоимости. V4 Pro (1.6T / 49B активных) — это выбор для самых сложных задач по программированию, математике и долгосрочной работе агентов; V4 Flash (284B / 13B активных) отстает от Pro примерно на 1–2 пункта по большинству бенчмарков в обмен на гораздо более низкую цену, что делает ее моделью по умолчанию для массового чата, извлечения данных и подзадач агентов. Распространенный паттерн — направлять рутинные вызовы в V4 Flash и эскалировать только сложные запросы на V4 Pro — обе модели работают в рамках одного ключа и баланса GPTProto, поэтому переключение между ними сводится к изменению строки модели в одну строку.
| DeepSeek V4 Pro | DeepSeek V4 Flash | |
| Всего / активных параметров | 1.6T / 49B | 284B / 13B |
| Контекст / макс. вывод | 1M / 384K | 1M / 384K |
| SWE-bench Verified | 80.6% | ~1–2 пт. ниже Pro |
| Цена GPTProto (вход / выход за 1M) | $1.3914 / $2.7838 | $0.1114 / $0.2238 |
| Лучше всего подходит для | Самого сложного программирования, рассуждений, долгосрочных агентов | Массового чата, извлечения данных, подзадач агентов |
| Строка модели GPTProto | deepseek-v4-pro | deepseek-v4-flash |
DeepSeek V4 Pro против Claude Opus 4.8
Claude Opus 4.8 лидирует в сложнейшем программировании: она показывает 88.6% в SWE-bench Verified против 80.6% у API DeepSeek V4 Pro, а также имеет преимущество в извлечении общих знаний и поиске в больших объемах данных (long-haystack). В чем V4 Pro составляет конкуренцию, так это в соревновательной математике — рейтинг Codeforces равен 3206 — открытые веса MIT и цена: на GPTProto она стоит $1.39 / $2.78 за 1M против $4 / $20 у Opus 4.8, что примерно в 3 раза дешевле по входу и в 7 раз по выходу. Обе модели имеют контекстное окно в 1M токенов и доступны по одному ключу GPTProto. Практический вывод: выбирайте Opus 4.8, когда цена ошибки высока, а надежность важнее стоимости; используйте API DeepSeek V4 Pro для высоконагруженного программирования, математики и длительных запусков агентов, где разница в цене имеет накопительный эффект.
| DeepSeek V4 Pro | Claude Opus 4.8 | |
| Веса | Открытые (MIT) | Закрытые |
| Контекст / макс. вывод | 1M / 384K | 1M / 128K |
| SWE-bench Verified | 80.6% | 88.6% |
| Codeforces | 3206 | — |
| Извлечение знаний / поиск в стоге сена | Уступает | Лидирует |
| Цена GPTProto (вход / выход за 1M) | $1.3914 / $2.7838 | $4 / $20 |
| Строка модели GPTProto | deepseek-v4-pro |
claude-opus-4-8 |
DeepSeek V4 Pro против GLM-5.2
GLM-5.2, от компании Z.ai (ранее Zhipu AI), является ближайшим конкурентом с открытыми весами для API DeepSeek V4 Pro: это MoE-модель с 753 млрд параметров, также лицензированная под MIT, с контекстным окном на 1M токенов и также оптимизированная под агентское программирование. По независимым сторонним оценкам (Artificial Analysis Intelligence Index) GLM-5.2 в настоящее время имеет чуть более высокий общий рейтинг, в то время как V4 Pro выделяется в соревновательной математике с рейтингом Codeforces 3206. Обе лаборатории сообщают результаты программирования на разных вариантах SWE-bench, поэтому единое прямое сравнение было бы вводящим в заблуждение — считайте их моделями примерно одного уровня и выбирайте на основе цены и рабочей нагрузки.
Цена — это то, где выбор становится очевиднее. На GPTProto API DeepSeek V4 Pro стоит $1.39 / $2.78 за 1M, а GLM-5.2 — $1.26 / $3.96: GLM-5.2 примерно на 10% дешевле по входу, в то время как V4 Pro примерно на 30% дешевле по выходу. Работа с большими объемами вывода — циклы агентов, длинные генерации — обходится дешевле на V4 Pro; работа с большими объемами ввода, обрабатывающая огромные контексты, склоняется в пользу GLM-5.2. Обе модели работают под одним ключом и балансом GPTProto, поэтому вы можете настраивать маршрутизацию для каждой задачи.
| DeepSeek V4 Pro | GLM-5.2 | |
|---|---|---|
| Провайдер | DeepSeek | Z.ai (Zhipu) |
| Веса / лицензия | Открытые / MIT | Открытые / MIT |
| Всего / активных параметров | 1.6T / 49B | 753B / ~40B |
| Контекстное окно | 1M | 1M |
| Режимы рассуждений | Без мышления · Высокий · Макс. | Высокий · Макс. |
| AA Intelligence Index | 44 | 51 |
| Codeforces | 3206 | — |
| Цена GPTProto (вход / выход за 1M) | $1.3914 / $2.7838 | $1.26 / $3.96 |
| Строка модели GPTProto | deepseek-v4-pro |
glm-5.2 |
Переход с официального API DeepSeek
Если вы уже используете DeepSeek напрямую, переход на GPTProto позволяет сохранить ваш код, заменив только учетные данные и хост. Укажите base_url эндпоинта GPTProto, используйте свой ключ API GPTProto и оставьте строку модели deepseek-v4-pro — формат запросов и ответов остается неизменным, так как эндпоинт сохраняет совместимость с OpenAI и Anthropic. Вы получаете единый баланс, который также расходуется на GPT, Claude, Gemini и более чем 200 других моделей, без необходимости заводить отдельный аккаунт DeepSeek, пополнять счет или проходить проверку региона. Команды из регионов, где недоступен прямой биллинг DeepSeek, используют этот способ для доступа к API DeepSeek V4 Pro без настройки платежных систем Китая.
В чем DeepSeek V4 Pro уступает
Честные ограничения важны не меньше, чем бенчмарки. DeepSeek V4 Pro уступает топовым закрытым моделям в извлечении мировых знаний — она набирает около 57.9% в SimpleQA-Verified против ~75.6% у Gemini 3.1 Pro — и, как и большинство моделей со сложными рассуждениями, склонна давать ответ вместо воздержания на вопросы, в которых она не уверена, поэтому калибровку уверенности стоит учитывать при выполнении задач фактологического поиска. Это текстовая модель без поддержки ввода изображений или аудио. И хотя она дешево предоставляет окно на 1M токенов, максимальная точность поиска в больших объемах данных все еще принадлежит таким моделям, как Claude Opus. Для кода, математики и долгих запусков агентов она конкурирует на передовой; для фактических вопросов и ответов (Q&A), где ошибка стоит дорого, комбинируйте ее с поиском (retrieval) или направляйте такие запросы в другое место.











