DeepSeek V4 Pro 0813 и Kimi K3: краткое сравнение
| Категория |
DeepSeek V4 Pro 0813 |
Kimi K3 |
Лучший выбор |
| Текущий независимый индекс интеллекта |
53 |
60 |
Kimi K3 |
| Скорость вывода |
83.2 токена/с |
40.8 токена/с |
DeepSeek V4 Pro |
| Время до первого токена |
1.63 секунды |
2.97 секунды |
DeepSeek V4 Pro |
| Контекстное окно |
Около 1 млн токенов |
Около 1 млн токенов |
Ничья |
| Цена входных данных GPT Proto |
$1.044 за 1 млн токенов |
$2.70 за 1 млн токенов |
DeepSeek V4 Pro |
| Цена выходных данных GPT Proto |
$2.088 за 1 млн токенов |
$13.50 за 1 млн токенов |
DeepSeek V4 Pro |
| Доступный на GPT Proto ввод |
Текст |
Текст, изображения, документы |
Kimi K3 |
| Управление рассуждениями |
Без рассуждений, высокий, максимальный |
Постоянные рассуждения с настройкой уровня усилий |
Зависит от рабочего процесса |
| Лицензия на открытые веса |
MIT |
Лицензия Kimi K3 |
DeepSeek — для более простого коммерческого самостоятельного развертывания |
| Оптимальный вариант |
Высокообъемное текстовое программирование и агенты |
Сложные мультимодальные задачи и визуальные агенты |
Зависит от задачи |
Приведенные выше показатели бенчмарков, скорости и задержки взяты из текущей независимой очной оценки Artificial Analysis. В ее индексе интеллекта используется единая система оценки для обеих моделей, что делает его полезнее, чем простое сопоставление презентационных графиков двух поставщиков.
Что изменилось в DeepSeek V4 Pro 0813?
DeepSeek V4 Pro 0813 — это текущая производственная версия V4 Pro, а не отдельный API-продукт. В документации DeepSeek указано, что алиас deepseek-v4-pro теперь указывает на DeepSeek-V4-Pro-0813, а способ вызова остается прежним. В той же документации перечислены контекстное окно размером в один миллион токенов, до 384 тыс. выходных токенов, режимы с рассуждениями и без них, вывод JSON и вызов инструментов.
Это решение с именованием важно, поскольку имена моделей с датами часто вынуждают разработчиков менять файлы конфигурации, правила маршрутизации и записи оценок. Здесь обновление происходит за стабильным алиасом. На GPT Proto действует тот же принцип: оставьте deepseek-v4-pro в своем запросе.
Текущий независимый результат также отличается от показателей, приведенных во многих сравнительных статьях за июль. Теперь Artificial Analysis дает модели 0813 индекс интеллекта 53 при максимальном уровне рассуждений. Kimi K3 получает 60 в рамках текущей оценки.
Я бы не называл это чистым улучшением на девять пунктов по сравнению с прежним результатом 44. Модель изменилась, но наборы бенчмарков и версии оценки тоже могут меняться. Обоснованный вывод более узок: сравнения, основанные на предварительной версии, больше не описывают модель, которая предоставляется сегодня, а свежие независимые тесты помещают 0813 ближе к Kimi K3, чем предполагали материалы эпохи предварительной версии.
DeepSeek не изменил базовую структуру продукта. Это по-прежнему модель Mixture-of-Experts с 1,6 трлн параметров, из которых 49 млрд активны для каждого токена, с текстовым вводом, большим допустимым объемом вывода и выбираемым уровнем усилий рассуждения. Поэтому выпуск 0813 лучше понимать как производственное обновление и улучшение постобучения, а не как новую мультимодальную ветвь.
Бенчмарки: Kimi K3 по-прежнему лидирует, но не во всем
Kimi K3 лидирует в широком независимом сравнении — 60 против 53. Разница в семь пунктов имеет значение, когда рабочий процесс сочетает рассуждения, знания, программирование и долгосрочное планирование. Но это не означает, что Kimi даст лучший результат для каждого репозитория или каждого запроса.
Две модели делают разные компромиссы. Moonshot описывает Kimi K3 как нативную мультимодальную агентскую модель с 2,8 трлн параметров, предназначенную для долгосрочного программирования и работы со знаниями. В ее официальной карточке модели документируется понимание текста, изображений и видео в исходной модели, а также контекстное окно размером в один миллион токенов. Текущий маршрут Kimi K3 на GPT Proto поддерживает текстовый ввод, изображения и документы.
DeepSeek V4 Pro 0813 работает только с текстом, но в тестах Artificial Analysis генерирует 83,2 токена в секунду. Kimi K3 достигает 40,8 токена в секунду. DeepSeek также начинает отвечать раньше: время до первого токена составляет 1,63 секунды против 2,97 секунды у Kimi.
Проще говоря: у Kimi выше общий показатель возможностей. DeepSeek возвращает текст примерно вдвое быстрее и при этом стоит значительно дешевле.
Здесь есть еще одна ловушка бенчмарков. Оценки программирования от поставщиков часто используют разные агентские настройки, параметры рассуждений, снимки репозиториев или критерии прохождения. Результат Kimi, полученный с помощью Kimi Code, нельзя автоматически сравнивать с результатом DeepSeek, полученным в другой системе оценки. При выборе модели используйте независимые сопоставимые оценки как общую базу, а затем тестируйте задачу, которая влияет на ваш продукт.
В этой статье не утверждается, что проводился закрытый тест программирования с одинаковым запросом. Без такого теста объявлять одну из моделей универсальным победителем в программировании было бы более сильным утверждением, чем позволяют имеющиеся доказательства.
Какая модель лучше для программирования и агентских рабочих процессов?
Для высокообъемного текстового программирования я бы начал с DeepSeek V4 Pro 0813.
Причина не в том, что он превосходит Kimi по всем показателям. Это не так. Дело в том, что производственные агенты программирования постоянно используют контекст и генерируют рассуждения, исправления, планы тестирования и инструкции для инструментов. Стоимость вывода накапливается в каждом цикле. Выбираемые режимы рассуждения DeepSeek также позволяют разработчикам оставлять максимальный уровень усилий для сложных задач, вместо того чтобы оплачивать одинаковый режим рассуждений для каждого запроса.
Это делает DeepSeek хорошим выбором по умолчанию для следующих задач:
Чтение репозиториев и вопросы по кодовой базе
Ревью пулл-реквестов
Локализация ошибок
Планы рефакторинга
Генерация тестов
Вызов текстовых инструментов
Высокообъемные фоновые агенты
Структурированные ответы JSON
Kimi K3 становится более привлекательным, когда цена неудачной попытки выше стоимости токенов. Его более высокий независимый показатель интеллекта делает его разумной моделью для эскалации при длительных и сложных задачах, которые DeepSeek не смог завершить. Это также очевидный выбор, когда запрос содержит визуальные данные.
Поэтому практический производственный шаблон — не «выбрать одну модель навсегда». Направляйте стандартные текстовые задачи в DeepSeek, а затем повторяйте отдельные неудачные запросы или мультимодальные задачи с помощью Kimi. Поскольку обе модели доступны через один API-ключ GPT Proto и общий баланс, изменение может ограничиться полем model в запросе.
DeepSeek V4 Pro против Kimi K3 для фронтенд-разработки
«Фронтенд-разработка» включает два разных типа задач, и их не следует объединять в один вывод.
Первый — преобразование текста в код: генерация React-компонентов, CSS, структуры страниц, исправлений доступности или логики TypeScript на основе письменной спецификации. Пока недостаточно сопоставимых общедоступных данных, чтобы утверждать, что Kimi K3 или DeepSeek V4 Pro 0813 безусловно лидирует в этой категории. Более низкая стоимость и высокая скорость вывода DeepSeek делают его более экономичным вариантом для первой попытки.
Второй — визуальная итерация фронтенда: показ модели скриншота, просьба выявить проблемы с отступами или компоновкой и изменение интерфейса на основе визуальной обратной связи. Kimi K3 лучше подходит для такого рабочего процесса, поскольку принимает изображения. DeepSeek V4 Pro работает только с текстом, поэтому разработчику придется сначала описать скриншот текстом или использовать отдельную модель компьютерного зрения.
Используйте DeepSeek для масштабной реализации интерфейсов по текстовому описанию. Используйте Kimi, когда модель должна видеть интерфейс.
Цены API: преимущество DeepSeek больше, чем кажется из заголовка
Сейчас GPT Proto предлагает DeepSeek V4 Pro по цене $1.044 за миллион входных токенов и $2.088 за миллион выходных токенов. Kimi K3 стоит $2.70 за входные и $13.50 за выходные токены.
| Цена GPT Proto за 1 млн токенов |
DeepSeek V4 Pro |
Kimi K3 |
Кратное превышение цены Kimi |
| Входные токены |
$1.044 |
$2.70 |
2.59× |
| Выходные токены |
$2.088 |
$13.50 |
6.47× |
Входные токены DeepSeek дешевле на 61,3%, а выходные — на 84,5%. Разница в стоимости вывода особенно важна для агентов с интенсивными рассуждениями, поскольку их внутренняя работа и итоговые ответы могут быть длинными.
Цены токенов остаются абстрактными, поэтому рассмотрим две гипотетические рабочие нагрузки.
| Рабочая нагрузка |
Предполагаемый объем токенов |
DeepSeek V4 Pro |
Kimi K3 |
| Большое ревью кода |
100 тыс. входных + 20 тыс. выходных токенов |
$0.146 |
$0.540 |
| Агентская задача масштаба репозитория |
1 млн входных + 250 тыс. выходных токенов |
$1.566 |
$6.075 |
В примере с репозиторием Kimi стоит примерно в 3,88 раза дороже. Это не означает, что Kimi по определению невыгоден. Если он завершает сложную задачу с первой попытки, тогда как более дешевой модели требуются повторные попытки и исправления вручную, дорогой вызов все равно может обойтись дешевле в общей сложности.
Правильный производственный показатель — стоимость принятого результата, а не только стоимость токенов. Для каждой категории задач записывайте модель, количество токенов, число попыток, задержку, результат тестов и принятие результата ревьюером. Низкая цена за токен становится реальной экономией только тогда, когда вывод проходит проверку.
Скорость и задержка
Сейчас Artificial Analysis измеряет скорость вывода DeepSeek V4 Pro 0813 на уровне 83,2 токена в секунду, а Kimi K3 — 40,8. Время до первого токена составляет 1,63 секунды для DeepSeek и 2,97 секунды для Kimi.
Эти показатели дают DeepSeek преимущество для интерактивных помощников программирования и параллельных агентских процессов. Модель, возвращающая токены вдвое быстрее, может сократить видимое время ожидания, даже если обе модели в итоге приходят к приемлемому ответу.
Однако скорость поставщика не является постоянным свойством весов модели. Она также зависит от нагрузки на сервер, квантования, пакетной обработки, длины запроса, уровня усилий рассуждения и места обработки запроса. Рассматривайте текущие измерения как сопоставимый снимок, а не как гарантию задержки для каждого вызова.
Различия в контексте, рассуждениях и развертывании
Обе модели поддерживают примерно один миллион токенов контекста, поэтому одного размера контекстного окна недостаточно для решения этого сравнения. Важнее то, как они используют этот контекст.
DeepSeek поддерживает режимы без рассуждений и с рассуждениями, а также управление уровнем усилий для сложных задач. Согласно текущей спецификации API DeepSeek, он также допускает до 384 тыс. выходных токенов. Такая гибкость подходит системам маршрутизации, которые используют быстрые ответы для простых задач, а глубокие рассуждения — только при необходимости.
Kimi K3 использует постоянно включенные рассуждения с настраиваемым уровнем усилий. Его более крупная архитектура на 2,8 трлн параметров и мультимодальный дизайн ориентированы на долгосрочную работу с документами, кодом, изображениями и инструментами. Компромисс заключается в более высокой стоимости вывода и меньшей измеренной скорости генерации.
Обе модели имеют доступные для скачивания веса, но «открытые веса» не означают одинаковые условия лицензирования. DeepSeek V4 Pro использует лицензию MIT. Kimi K3 использует собственную лицензию Kimi K3. Командам, планирующим коммерческое самостоятельное развертывание, следует изучить точные условия Kimi, а не предполагать их соответствие MIT.
Требования к оборудованию также значительно превосходят возможности обычной локальной рабочей станции. Для большинства команд разработчиков оценка через размещенный API — реалистичная отправная точка даже при доступности весов.
Как получить доступ к DeepSeek V4 Pro 0813 и Kimi K3 с одним API-ключом
GPT Proto предоставляет доступ к обеим моделям через совместимый с OpenAI эндпоинт chat completions. Начните с DeepSeek, установив MODEL_ID в значение deepseek-v4-pro:
export GPTPROTO_API_KEY="your_api_key"
export MODEL_ID="deepseek-v4-pro"
curl --request POST "https://gptproto.com/v1/chat/completions" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--data "{
\"model\": \"$MODEL_ID\",
\"messages\": [
{
\"role\": \"user\",
\"content\": \"Review this function for correctness and return the answer as concise Markdown.\"
}
]
}"
Чтобы отправить тот же текстовый запрос в Kimi K3, измените одну строку:
export MODEL_ID="kimi-k3"
Затем снова выполните тот же запрос curl. Отдельная учетная запись Moonshot, второй баланс или суффикс версии DeepSeek не нужны.
Для контролируемого сравнения используйте одинаковые запрос, контекст, настройки рассуждений и ограничение вывода. Записывайте возвращаемые поля использования вместе с задержкой, количеством попыток и информацией о прохождении тестов. Сравнения одного удачного ответа от каждой модели недостаточно для принятия решения о производственной маршрутизации.
Какую модель выбрать?
Выбирайте DeepSeek V4 Pro 0813, если:
Ваша рабочая нагрузка в основном связана с текстом и кодом
Объем вывода делает стоимость токенов важной
Низкая задержка улучшает пользовательский опыт
Вам нужны режимы без рассуждений и глубокие рассуждения в рамках одного идентификатора модели
Вам нужен путь к самостоятельному развертыванию с лицензией MIT
Вы выбираете модель по умолчанию для большого количества агентов
Выбирайте Kimi K3, если:
Модель должна анализировать скриншоты, изображения или документы
Текущий максимальный независимый показатель интеллекта важнее цены
Неудачная задача стоит дороже премиального API-вызова
Вы создаете мультимодальных агентов для долгосрочной работы
Вы хотите передавать самые сложные запросы после сбоя более дешевой модели
Для большинства разработчиков лучшая политика маршрутизации — сначала DeepSeek, а Kimi использовать при необходимости. Это позволяет получить большую часть преимуществ DeepSeek по стоимости и скорости, сохранив доступ к мультимодальности Kimi и его более высокому потолку возможностей.
Итоговый вердикт
DeepSeek V4 Pro 0813 — лучший выбор по умолчанию для большинства текстовых задач программирования и агентских рабочих процессов. В текущем индексе интеллекта Artificial Analysis он уступает Kimi K3 семь пунктов, но генерирует вывод примерно вдвое быстрее и стоит на GPT Proto значительно дешевле — особенно в агентских циклах с большим объемом вывода.
Kimi K3 — лучший специализированный вариант. Выбирайте его, когда задача включает визуальный ввод, когда максимально глубокие рассуждения важнее стоимости или когда DeepSeek уже потерпел неудачу и еще одна попытка дешевле ручного восстановления результата.
Обновление 0813 не делает Kimi устаревшим. Оно делает решение о маршрутизации более четким: DeepSeek — для объема, скорости и текста; Kimi — для мультимодальности и более высокого измеренного потолка возможностей.