DeepSeek выпускает DeepSeek Harness в качестве открытого конкурента Claude Code наряду с моделью V4-Pro в API по более высоким ценам
Источник: VentureBeat · Carl Franzen
DeepSeek выходит за рамки уровня моделей и глубже погружается в программное обеспечение, которое разработчики используют для запуска ИИ-агентов.
В четверг китайская ИИ-лаборатория выпустила официальную версию DeepSeek-V4-Pro — обновленную флагманскую модель, ориентированную главным образом на рабочие нагрузки агентов, а также DeepSeek Harness v0.1, новый инструмент с открытым исходным кодом для управления агентами, который предоставляет разработчикам альтернативу интегрированным средам для агентов-кодеров, таким как Claude Code от Anthropic.
В совокупности эти релизы означают более масштабное наступление DeepSeek на экосистему разработчиков. Модель V4-Pro теперь доступна через веб-интерфейс, мобильное приложение и API DeepSeek, обладая встроенной поддержкой OpenAI Responses API и интеграцией с Codex.
Тем временем DeepSeek Harness переходит в стадию предварительного просмотра для разработчиков (developer preview) по лицензии MIT, и его код уже доступен для скачивания и использования на GitHub. Он построен на базе необычно модульной концепции: практически любую часть среды выполнения агента можно заменить в виде плагина.
Однако разработчикам, обращающимся к V4 через API DeepSeek, вскоре придется платить за него значительно больше. Компания одновременно отказывается от существующей единой фиксированной тарификации API в пользу тарифов в часы пик и в непиковые часы, которые вступят в силу в воскресенье, 16 августа, в 16:00 по всемирному координированному времени (UTC) (в 2:00 ночи по восточному времени — ET).
Даже со скидками в непиковые часы цены на промахи кэша (cache-miss) и вывод будут существенно выше текущих расценок.
Это событие имеет большое значение, поскольку DeepSeek больше не конкурирует исключительно в области интеллекта моделей и стоимости токенов. С появлением Harness компания выходит на уровень, который определяет, как модели используют инструменты, манипулируют файлами, поддерживают сеансы и выполняют долгосрочные рабочие процессы агентов. Это территория, на которой Claude Code от Anthropic и другие агенты для программирования становятся все более важными продуктами для разработчиков.
DeepSeek создает собственный инструмент управления агентами (harness)
DeepSeek описывает Harness, или dsh, как агентный инструмент с открытым исходным кодом, созданный на базе Cordis — фреймворка, спроектированного вокруг компонуемых плагинов.
Его руководящий принцип прост: «Все является плагином».
По словам представителей DeepSeek, это распространяется на модели, инструменты, навыки, сеансы, песочницы, файловые системы, циклы, оркестрацию и пользовательские интерфейсы. Вместо того чтобы делать эти компоненты фиксированными элементами единого агента-кодера, Harness разработан так, чтобы позволить разработчикам комбинировать их, заменять и расширять.
Проект доступен по лицензии MIT и в настоящее время может быть запущен из npm с помощью npx @deepseek-ai/dsh web. DeepSeek также предоставляет инструкции по сборке непосредственно из исходного кода. В репозитории программное обеспечение прямо описывается как предварительная версия для разработчиков и содержится предупреждение о том, что «БУДУТ ИЗМЕНЕНИЯ, НАРУШАЮЩИЕ СОВМЕСТИМОСТЬ».
Это предостережение имеет значение для корпоративных разработчиков. Harness пока не позиционируется как стабильная готовая продакшн-платформа. Тем не менее, его архитектура указывает на потенциально важную стратегию: теперь DeepSeek может предложить разработчикам не только модели, но и открытый фреймворк для сборки окружающих их систем.
Это делает Claude Code от Anthropic и Codex от OpenAI полезными конкурентными ориентирами, хотя продукты не следует считать функционально идентичными.
DeepSeek Harness — это независимая от конкретной модели альтернатива с открытым исходным кодом для инфраструктуры агентов, лежащей в основе Claude Code и Codex, и пока не является полноценной заменой более широкого пользовательского опыта разработчиков ни для одного из этих продуктов.
Он уже способен проверять репозитории, редактировать файлы, выполнять команды оболочки, осуществлять поиск по файлам и в Интернете, вести планы, вызывать навыки, делегировать работу субагентам и применять политики утверждения. Это те самые базовые возможности, которые превращают Claude Code и Codex в инструменты для агентного программирования, а не в системы автодополнения.
DeepSeek прямо описывает стандартный режим (Standard mode) как полноценного агента для программирования с возможностью редактирования файлов, доступом к оболочке, поиском, планированием, субагентами и рабочими процессами. Его локальный веб-интерфейс позволяет пользователям выбирать рабочее пространство и подтверждать выполнение конфиденциальных операций.
Однако Claude Code и Codex сегодня выходят далеко за рамки этого агентного цикла. Вот краткое сравнение:
|
Параметр |
DeepSeek Harness |
Claude Code |
OpenAI Codex |
|
Чтение, редактирование и тестирование репозитория |
Да |
Да |
Да |
|
Оболочка и инструменты разработки |
Да |
Да |
Да |
|
Планирование и субагенты |
Да |
Да |
Да |
|
Контроль разрешений и песочницы |
Да, настраивается с помощью плагинов |
Да, развитая встроенная система разрешений и песочниц |
Да, детализированная песочница и элементы управления утверждением |
|
Основные интерфейсы |
Локальный веб-интерфейс; headless-команды; Python SDK |
Терминал, VS Code, JetBrains, десктоп, браузер, мобильные устройства и Slack |
CLI, расширение для IDE, десктопное приложение, веб/облако и интеграции |
|
Хостинговые фоновые агенты |
Не задокументировано как управляемый сервис DeepSeek |
Да |
Да |
|
GitHub-нативный рабочий процесс PR |
Не задокументировано как готовая интеграция |
GitHub Actions, автоматические ревью, рабочие процессы от issues к PR |
Облачные задачи, автоматические ревью, исправления PR и GitHub Action |
|
Выбор модели |
DeepSeek, Anthropic, OpenAI и пользовательские совместимые эндпоинты |
Преимущественно Claude, включая хостинг в Bedrock, Google Cloud и Microsoft |
Преимущественно модели OpenAI с настраиваемыми провайдерами в CLI с открытым исходным кодом |
Вместо этого DeepSeek Harness делает акцент на модульности и заменяемости: сама модель выступает лишь еще одним плагином, а не обязательно центром вертикально интегрированного стека.
Репозиторий DeepSeek уже привлекал значительное внимание разработчиков в день запуска: по состоянию на 13 августа он насчитывал около 27 500 звезд на GitHub и 2 000 форков, хотя эти быстро меняющиеся цифры лучше воспринимать как снимок момента, а не как показатель реального внедрения.
V4-Pro получает обновление с упором на агентов
Harness выходит одновременно с выпуском общедоступной версии DeepSeek-V4-Pro-0813.
Компания DeepSeek изначально представила семейство V4 в режиме предварительного просмотра в апреле. Линейка состоит из модели V4-Pro с 1,6 триллионами параметров (из них 49 миллиардов активируются на токен) и более компактной V4-Flash с 284 миллиардами параметров (13 миллиардов активных). Обе поддерживают контекстные окна объемом до одного миллиона токенов.
Таким образом, релиз компании от 13 августа — это не первое появление V4-Pro. Это переход от предыдущей версии предварительного просмотра к обновленной официальной версии, причем DeepSeek делает особый акцент на производительности агентов.
«Официальная версия DeepSeek-V4-Pro выпущена. Она отличается значительно расширенными возможностями агентов, а также поддержкой Responses API и интеграцией с Codex», — заявляет DeepSeek на своем сайте API. — «Теперь модель полностью доступна в веб-интерфейсе, мобильном приложении и через API; мы приветствуем ваше тестирование и отзывы».
В журнале изменений (changelog) DeepSeek аналогичным образом отмечается, что общедоступная модель обладает «значительно расширенными возможностями агентов», особенно в производственных средах. Разработчикам, использующим API, не нужно менять идентификаторы моделей: deepseek-v4-pro теперь указывает на самую последнюю версию V4-Pro.
Компания также добавила нативную поддержку OpenAI Responses API, сократив объем интеграционных работ, необходимых для приложений, которые уже построены вокруг этого интерфейса.
DeepSeek утверждает, что V4-Pro оптимизирована под собственный инструмент с открытым исходным кодом от OpenAI — Codex, и поддерживает настройку в один клик. В текущей документации по API в качестве поддерживаемых интерфейсов как для V4-Pro, так и для V4-Flash указаны Responses API, вызов инструментов, вывод в формате JSON и API в формате Anthropic.
Для разработчиков, использующих DeepSeek напрямую, а не через API, модель V4-Pro теперь доступна в режиме «Expert Mode» в приложении и на сайте компании.
Усилие рассуждения становится еще одним рычагом управления развертыванием
DeepSeek также делает глубину рассуждений (reasoning effort) явным параметром управления как в V4-Pro, так и в V4-Flash.
В документации к моделям V4 описаны три уровня: Non-think (без размышлений), предназначенный для быстрых рутинных задач; Think High (высокий уровень размышлений), ориентированный на более сложный поиск решений и планирование; и Think Max (максимальный уровень), который выделяет значительно больше ресурсов на рассуждения при решении сложных проблем.
Это различие может иметь важное операционное значение для агентских систем, поскольку максимальный объем рассуждений на каждом шаге может расходовать лишнее время и токены. Агент-кодер может использовать относительно небольшой объем рассуждений для проверки файла или вызова рутинного инструмента, а затем увеличивать этот показатель при диагностике сложного бага или планировании многоэтапного изменения кода.
Последняя таблица бенчмарков DeepSeek показывает, что модель 0813 демонстрирует существенные улучшения в тестах, ориентированных на агентов, хотя эти цифры предоставлены самой компанией, а некоторые результаты зависят от конфигурации инструментальной обвязки (harness).
DeepSeek сообщает о следующих баллах V4-Pro-0813: 87,9 в Terminal Bench 2.1, 74,1 в Toolathlon-Verified, 71,1 в DSBench-FullStack и 67,2 в DSBench-Hard. Модель лидирует не в каждом сравнении из собственной таблицы DeepSeek: например, Fable 5 набирает 77,9 в Toolathlon-Verified и 77,2 в DSBench-FullStack.
Под таблицей бенчмарков скрывается одна особенно важная оговорка. Для публичных задач Code Agent компания DeepSeek заявляет, что тестирование V4-Pro-0813 проводилось с использованием ее готовящегося к выходу инструмента DeepSeek Harness в «минимальном режиме».
Другими словами, некоторые результаты работы агентов, представленные вместе с Harness, не являются чистыми бенчмарками моделей. Они измеряют работу модели внутри среды выполнения агентов — именно того программного слоя, который DeepSeek теперь выпускает для разработчиков.
Резкий разворот в траектории цен на API DeepSeek
Более насущным изменением для команд, которые уже используют DeepSeek в продакшне, может стать ценовая политика.
В текущей документации по API DeepSeek указана стоимость V4-Flash: $0,14 за миллион входных токенов при промахах кэша и $0,28 за миллион выходных токенов, в то время как V4-Pro стоит $0,435 за входные токены при промахах кэша и $0,87 за вывод. Попадания в кэш обходятся значительно дешевле — $0,0028 для Flash и $0,003625 для Pro.
Сами по себе эти расценки представляли собой серьезное снижение по сравнению с экономикой апрельского запуска V4. Когда в апреле появилась V4, стоимость V4-Pro составляла $1,74 за миллион входных токенов при промахах кэша и $3,48 за миллион выходных токенов. К концу мая DeepSeek сделала снижение на 75% постоянным, укрепив свои позиции в качестве необычно дешевого варианта для высоконагруженных агентских рабочих процессов. Теперь маятник качнулся в противоположную сторону.
Начиная с 16 августа в 16:00 UTC, DeepSeek будет взимать плату в зависимости от времени выполнения вызовов API. Часы пик приходятся на 01:00–04:00 UTC и 06:00–10:00 UTC (соответственно, с 21:00 до 00:00 по восточному времени — ET и с 02:00 до 06:00 ET), а все остальные часы классифицируются как непиковые. Тарифы в непиковые часы составляют половину от соответствующих цен в часы пик.
Для V4-Flash стоимость входных токенов при промахах кэша в непиковые часы вырастет с $0,14 до $0,22 за миллион токенов, а стоимость вывода увеличится с $0,28 до $0,66. В часы пик эти тарифы достигают $0,44 за ввод и $1,32 за вывод.
V4-Pro дорожает с текущих $0,435 за миллион входных токенов при промахах кэша и $0,87 за вывод до $0,66 и $1,98 соответственно в непиковые часы. Цены в часы пик вырастают до $1,32 за ввод и $3,96 за вывод.
Повышение еще более заметно для кэшированного ввода. Стоимость попаданий в кэш для V4-Pro вырастет с текущих $0,003625 за миллион токенов до $0,022 в непиковые часы и до $0,044 в часы пик. Для Flash этот показатель изменится с $0,0028 до $0,007 в непиковые часы и $0,014 в часы пик.
|
Модель |
Старый ввод (за 1 млн токенов) |
Старый вывод (за 1 млн токенов) |
Старая общая стоимость (1 млн ввод / 1 млн вывод) |
|
deepseek-v4-flash |
$0,14 |
$0,28 |
$0,42 |
|
deepseek-v4-pro |
$0,435 |
$0,87 |
$1,305 |
Новые цены по-прежнему позиционируют DeepSeek как доступную альтернативу западным проприетарным лабораториям при использовании через API, однако, как сообщило в четверг агентство Reuters, в зависимости от модели, категории токенов и времени использования изменения представляют собой рост от 50% до более чем 1100% по сравнению с существующими расценками.
|
Модель |
Ввод ($ за 1 млн) |
Вывод ($ за 1 млн) |
Итого ($ за 1 млн) |
Источник |
|
Muse Spark 1.2 Contributor |
$0,10 |
$0,20 |
$0,30 |
|
|
MiMo-V2.5 Flash |
$0,10 |
$0,30 |
$0,40 |
|
|
DeepSeek-V4-Flash — непиковые часы |
$0,22 |
$0,66 |
$0,88 |
|
|
GPT-5.6 Luna |
$0,20 |
$1,20 |
$1,40 |
|
|
MiniMax-M3 |
$0,30 |
$1,20 |
$1,50 |
|
|
LongCat-2.0 — лимитированная промо-акция |
$0,30 |
$1,20 |
$1,50 |
|
|
DeepSeek-V4-Flash — часы пик |
$0,44 |
$1,32 |
$1,76 |
|
|
MiMo-V2.5 |
$0,40 |
$2,00 |
$2,40 |
|
|
DeepSeek-V4-Pro — непиковые часы |
$0,66 |
$1,98 |
$2,64 |
|
|
LongCat-2.0 — стандартный |
$0,75 |
$2,95 |
$3,70 |
|
|
MiMo-V2.5 Pro (≤256K) |
$1,00 |
$3,00 |
$4,00 |
|
|
DeepSeek-V4-Pro — часы пик |
$1,32 |
$3,96 |
$5,28 |
|
|
Muse Spark 1.1 / 1.2 |
$1,25 |
$4,25 |
$5,50 |
|
|
GLM-5.2 |
$1,40 |
$4,40 |
$5,80 |
|
|
Grok 4.6 — <200K токенов промпта |
$2,00 |
$6,00 |
$8,00 |
|
|
MiMo-V2.5 Pro (>256K) |
$2,00 |
$6,00 |
$8,00 |
|
|
Qwen3.8-Max |
$2,00 |
$6,00 |
$8,00 |
|
|
Gemini 3.6 Flash |
$1,50 |
$7,50 |
$9,00 |
|
|
GPT-5.6 Terra |
$2,00 |
$12,00 |
$14,00 |
|
|
Grok 4.6 — ≥200K токенов промпта |
$4,00 |
$12,00 |
$16,00 |
|
|
GPT-5.4 |
$2,50 |
$15,00 |
$17,50 |
|
|
Kimi K3 |
$3,00 |
$15,00 |
$18,00 |
|
|
Claude Opus 5 |
$5,00 |
$25,00 |
$30,00 |
|
|
Sakana Fugu Ultra (≤272K) |
$5,00 |
$30,00 |
$35,00 |
|
|
GPT-5.6 Sol — Стандартный режим |
$5,00 |
$30,00 |
$35,00 |
|
|
Claude Fable 5 / Claude Mythos 5 |
$10,00 |
$50,00 |
$60,00 |
|
|
GPT-5.6 Sol — Быстрый режим |
$10,00 |
$60,00 |
$70,00 |
Из-за этого формулировка о «на 50% более дешевых» непиковых часах может вводить в заблуждение вне контекста. Непиковые часы обходятся на 50% дешевле новой пиковой ставки DeepSeek, но это не скидка в 50% от тех цен на API, которые разработчики платят сегодня.
Для простой рабочей нагрузки, состоящей из одного миллиона входных токенов при промахе кэша и одного миллиона выходных токенов, модель V4-Pro в настоящее время стоит $1,305. Тот же набор токенов в непиковые часы обойдется в $2,64 (примерно в два раза дороже), а в часы пик — в $5,28 (более чем в четыре раза дороже текущей цены).
Стоимость V4-Flash по тому же простому расчету изменится с $0,42 до $0,88 в непиковые часы и $1,76 в часы пик.
Фактические затраты на приложения будут существенно варьироваться в зависимости от соотношения кэшированного ввода, невходящего в кэш ввода и сгенерированного вывода, поэтому эти комбинированные показатели носят иллюстративный, а не универсальный оценочный характер общих затрат.
DeepSeek поднимается выше по стеку агентов
Тайминг релиза делает стратегическое направление очевидным.
Когда 24 апреля DeepSeek выпустила предварительную версию V4, главной новостью стало то, насколько высокую производительность фронтирного уровня компания смогла обеспечить за счет необычайно эффективной архитектуры.
V4-Pro использует гибридный дизайн внимания, сочетающий разреженное внимание со сжатием (Compressed Sparse Attention) и сильно сжатое внимание (Heavily Compressed Attention); по заявлению DeepSeek, при контексте в один миллион токенов модель требует лишь 27% FLOPs для инференса одного токена и 10% кэша KV по сравнению с V3.2.
К концу мая дискуссия сместилась в сторону того, что эти показатели эффективности означают с экономической точки зрения для высоконагруженных агентов, чье многократное чтение контекста может сделать кэширование основным компонентом затрат на инференс. Резкое снижение цен на V4 от DeepSeek усилило это преимущество.
Релизы от 13 августа выводят конкуренцию на новый уровень.
Теперь у DeepSeek есть обновленная модель V4-Pro, настроенная на рабочие нагрузки агентов, стандартизированные интерфейсы, призванные упростить подключение к существующим инструментам разработки, настраиваемое усилие рассуждений, а также инструмент с лицензией MIT для управления моделями, инструментами, песочницами, файловыми системами и оркестрацией вокруг агента.
В то же время DeepSeek показывает разработчикам, что рассчитывать на сохранение ее агрессивно низких тарифов на API на постоянной основе не стоит. Для организаций, рассматривающих эту платформу, планирование рабочих нагрузок, поведение кэширования и возможность запуска открытых весов на собственной инфраструктуре теперь становятся более важными частями расчета общих затрат.
В результате DeepSeek преследует два потенциально конфликтующих преимущества одновременно: делает свой стек агентов более доступным и открытым, одновременно делая собственный хостинговый API значительно дороже.
Для корпоративных разработчиков Harness в конечном итоге может оказаться наиболее важной частью анонса четверга. Модели все чаще можно заменять за стандартизированными интерфейсами. А вот инструмент управления (harness), который определяет, как агент рассуждает, вызывает инструменты, редактирует программный код и сохраняет состояние в ходе рабочего процесса, заменить гораздо сложнее.
Теперь DeepSeek борется и за этот уровень.



