DeepSeek Harness запускается как конкурент Claude Code с открытым исходным кодом, наряду с V4-Pro на API, но по более высокой цене.
Карл Франзен
DeepSeek выходит за рамки уровня модели и проникает глубже в программное обеспечение, используемое разработчиками для внедрения агентов искусственного интеллекта.
В четверг китайская лаборатория искусственного интеллекта представила официальную версию DeepSeek-V4-Pro, обновленную флагманскую модель, ориентированную в основном на агентные задачи, а также DeepSeek Harness v0.1, новую среду разработки агентов с открытым исходным кодом, которая предоставляет разработчикам альтернативу интегрированным средам программирования и работы агентов, таким как Claude Code от Anthropic.
В совокупности эти релизы представляют собой более масштабную кампанию DeepSeek по продвижению продукта среди разработчиков. V4-Pro теперь доступен через веб-интерфейс DeepSeek, мобильное приложение и API, с нативной поддержкой API ответов OpenAI и интеграцией с Codex.
Тем временем DeepSeek Harness выходит на стадию предварительного тестирования для разработчиков под лицензией MIT, и код уже доступен для скачивания и использования на GitHub. Он построен на необычайно модульной основе: практически любую часть среды выполнения агента можно заменить в качестве плагина.
Однако разработчики, получающие доступ к V4 через API DeepSeek, вскоре будут платить за это значительно больше. DeepSeek одновременно отказывается от существующей фиксированной цены на API в пользу тарифов для пикового и непикового времени, начиная с 16:00 UTC в воскресенье, 16 августа (2:00 утра по восточному времени).
Даже цены на кэш-память и выходные данные со скидкой в непиковое время будут существенно выше, чем цены, доступные сегодня.
Это объединение имеет важное значение, поскольку DeepSeek больше не конкурирует исключительно по интеллектуальным возможностям моделей и ценам токенов. С помощью Harness компания выходит на уровень, определяющий, как модели используют инструменты, манипулируют файлами, поддерживают сессии и выполняют длительные рабочие процессы агентов — область, где Claude Code от Anthropic и другие агенты для программирования стали все более важными продуктами для разработчиков.
DeepSeek разрабатывает собственную систему для работы с агентами.
DeepSeek описывает Harness, или dsh, как агентскую платформу с открытым исходным кодом, построенную на основе Cordis, фреймворка, разработанного с учетом возможности компонования плагинов.
Основной принцип прост: «Всё можно подключить к другому устройству».
По данным DeepSeek, это распространяется на модели, инструменты, навыки, сессии, песочницы, файловые системы, циклы, оркестровку и пользовательские интерфейсы. Вместо того чтобы делать эти компоненты фиксированными частями единого агента программирования, Harness разработан таким образом, чтобы позволить разработчикам комбинировать, заменять и расширять их.
Проект распространяется под лицензией MIT и в настоящее время может быть запущен из npm с помощью команды npx @deepseek-ai/dsh web. DeepSeek также предоставляет инструкции по сборке непосредственно из исходного кода. В репозитории программное обеспечение явно описывается как предварительная версия для разработчиков и предупреждается, что «БУДУТ ИЗМЕНЕНИЯ, НАРУШАЮЩИЕ СОВМЕСТИМОСТЬ».
Это замечание важно для корпоративных разработчиков. Harness пока не позиционируется как стабильная готовая к использованию производственная платформа. Но его архитектура указывает на потенциально важную стратегию: DeepSeek теперь может предложить разработчикам не только модели, но и открытую структуру для сборки окружающих их систем.
В связи с этим Кодекс Клода от Anthropic и Кодекс от OpenAI являются полезными сравнительными ориентирами, хотя эти продукты не следует рассматривать как функционально идентичные.
DeepSeek Harness — это альтернатива с открытым исходным кодом, не зависящая от модели пользователя, которая дополняет инфраструктуру агентов, лежащую в основе Claude Code и Codex, и пока не является полной заменой более широкого функционала для разработчиков, предоставляемого этими продуктами.
Она уже умеет проверять репозитории, редактировать файлы, выполнять команды оболочки, искать файлы и информацию в интернете, поддерживать планы, вызывать навыки, делегировать работу субагентам и обеспечивать соблюдение политик утверждения. Именно эти основные возможности делают Claude Code и Codex инструментами агентного кодирования, а не системами автозаполнения.
В описании стандартного режима DeepSeek прямо указывается, что это полноценный агент для программирования, включающий редактирование файлов, доступ к командной оболочке, поиск, планирование, субагентов и рабочие процессы. Его локальный веб-интерфейс позволяет пользователям выбирать рабочее пространство и подтверждать конфиденциальные операции.
Но теперь Claude Code и Codex выходят далеко за рамки этого агентского цикла. Вот краткое сравнение:
|
Измерение |
Ремень безопасности DeepSeek |
Кодекс Клода |
Кодекс OpenAI |
|
Чтение, редактирование и тестирование репозитория. |
Да |
Да |
Да |
|
Оболочка и инструменты разработки |
Да |
Да |
Да |
|
Планирование и субагенты |
Да |
Да |
Да |
|
Контроль прав доступа и песочница |
Да, это можно настроить с помощью плагинов. |
Да, имеется развитая встроенная система разрешений и песочницы. |
Да, детальный контроль в тестовой среде и механизмы утверждения. |
|
Основные интерфейсы |
Локальный веб-интерфейс; безголовая команда; Python SDK |
Терминал, VS Code, JetBrains, настольная версия, браузер, мобильная версия и Slack |
Интерфейс командной строки, расширение для IDE, настольное приложение, веб/облачные сервисы и интеграции. |
|
Размещенные фоновые агенты |
Не указано в документации как услуга, управляемая DeepSeek. |
Да |
Да |
|
Рабочий процесс запросов на слияние, встроенный в GitHub |
Интеграция не задокументирована как завершенная. |
GitHub Actions, автоматическое рецензирование, рабочие процессы преобразования задач в запросы на слияние. |
Облачные задачи, автоматическая проверка, исправления запросов на слияние и GitHub Actions. |
|
Выбор модели |
Совместимые с DeepSeek, Anthropic, OpenAI и пользовательскими конечными точками |
В основном это Claude, включая хостинг Bedrock, Google Cloud и Microsoft. |
В основном это модели OpenAI с настраиваемыми поставщиками в интерфейсе командной строки с открытым исходным кодом. |
|
Расширяемость |
Исключительное преимущество: практически каждый компонент подлежит замене. |
Сильные стороны: навыки, хуки, MCP, плагины и команды агентов. |
Сильные стороны: навыки, MCP, пользовательские агенты, SDK и сервер приложений. |
|
зрелость продукта |
Предварительная версия для разработчиков; ожидаются изменения, нарушающие обратную совместимость. |
Устоявшийся коммерческий продукт |
Устоявшийся коммерческий продукт плюс интерфейс командной строки с открытым исходным кодом. |
|
Лицензия |
MIT |
Коммерческий продукт с интерфейсами расширения |
Codex CLI — это программное обеспечение с открытым исходным кодом; облачные и мобильные сервисы являются управляемыми продуктами. |
Вместо этого DeepSeek Harness делает акцент на модульности и замене: сама модель представляет собой еще один плагин, а не обязательно центральный элемент вертикально интегрированной системы.
Репозиторий DeepSeek уже в день запуска привлекал значительное внимание разработчиков, имея около 27 500 звезд на GitHub и 2000 форков по состоянию на 13 августа, хотя эти быстро меняющиеся цифры лучше рассматривать как моментальный снимок, а не как показатель уровня распространения.
V4-Pro получил обновление, ориентированное на агентов.
Ремень безопасности появляется в продаже одновременно с выпуском в широкую продажу модели DeepSeek-V4-Pro-0813.
Компания DeepSeek впервые представила семейство V4 в предварительной версии в апреле. В линейку входят V4-Pro с 1,6 триллионами параметров (49 миллиардов активированных параметров на токен) и более компактный V4-Flash с 284 миллиардами параметров (13 миллиардов активированных). Оба поддерживают контекстные окна до одного миллиона токенов.
Таким образом, релиз компании от 13 августа — это не первое появление V4-Pro. Это переход от более ранней предварительной версии к обновленной официальной версии, в которой DeepSeek делает акцент на производительности агентов.
«Выпущена официальная версия DeepSeek-V4-Pro, в которой значительно расширены возможности агента, а также добавлена поддержка API ответов и интеграции с Codex», — сообщает DeepSeek на своем веб-сайте API. «Теперь она полностью доступна в веб-версии, мобильном приложении и через API; мы будем рады вашим отзывам и предложениям по тестированию».
В списке изменений DeepSeek также говорится, что модель общего доступа «значительно расширила возможности агента», особенно в производственных средах. Разработчикам, использующим API, не нужно менять идентификаторы моделей: deepseek-v4-pro теперь соответствует последней версии V4-Pro.
Компания также добавила встроенную поддержку API OpenAI Responses, что снижает объем работ по интеграции для приложений, уже построенных на основе этого интерфейса.
Компания DeepSeek заявляет, что V4-Pro оптимизирован для собственного открытого программного обеспечения OpenAI, Codex, с настройкой в один клик. В текущей документации по API указаны поддерживаемые интерфейсы как для V4-Pro, так и для V4-Flash: API для обработки ответов, вызов инструментов, вывод в формате JSON и API в антропическом формате.
Для разработчиков, использующих DeepSeek напрямую, а не через API, V4-Pro теперь доступен в «Экспертном режиме» в приложении и на веб-сайте компании.
Усилия, затрачиваемые на рассуждение, становятся еще одним параметром развертывания.
DeepSeek также делает логический анализ явным инструментом управления в версиях V4-Pro и V4-Flash.
В документации к модели V4 описаны три уровня: «Бездумный», предназначенный для быстрого решения рутинных задач; «Высокодумный», предназначенный для решения более сложных задач и планирования; и «Максимальнодумный», который предполагает значительно большее количество рассуждений при решении сложных проблем.
Это различие может иметь важное оперативное значение для агентских систем, поскольку максимальное количество рассуждений на каждом шаге может потреблять лишнее время и токены. Агент-программист может использовать относительно мало рассуждений для проверки файла или выполнения стандартного вызова инструмента, а затем увеличить усилия при диагностике сложной ошибки или планировании многоэтапного изменения кода.
Согласно последним результатам тестирования DeepSeek, модель 0813 значительно превосходит конкурентов в тестах, ориентированных на агентов, хотя эти данные предоставлены компанией, и некоторые результаты зависят от конфигурации оборудования.
DeepSeek сообщает о результатах V4-Pro-0813: 87,9 в Terminal Bench 2.1, 74,1 в Toolathlon-Verified, 71,1 в DSBench-FullStack и 67,2 в DSBench-Hard . Однако он не лидирует во всех сравнениях в собственной таблице DeepSeek: например, Fable 5 набирает 77,9 в Toolathlon-Verified и 77,2 в DSBench-FullStack.
Под таблицей результатов тестирования скрывается особенно важное уточнение. По данным DeepSeek, для задач, выполняемых публичными агентами кода, версия V4-Pro-0813 тестировалась с использованием готовящегося к выпуску DeepSeek Harness в «минимальном режиме».
Другими словами, некоторые результаты работы агентов, полученные вместе с Harness, не являются чисто сравнительными показателями модели. Они измеряют работу модели в среде выполнения агентов — именно в том программном слое, который DeepSeek сейчас предоставляет разработчикам.
Резкий разворот в динамике цен на API DeepSeek.
Наиболее существенные непосредственные изменения для команд, уже использующих DeepSeek в производственной среде, могут касаться ценообразования.
В текущей документации API DeepSeek указано, что стоимость V4-Flash составляет 0,14 доллара за миллион токенов на входе при промахе кэша и 0,28 доллара за миллион токенов на выходе, в то время как V4-Pro стоит 0,435 доллара за вход при промахе кэша и 0,87 доллара за выход. Попадания в кэш значительно дешевле: 0,0028 доллара для Flash и 0,003625 доллара для Pro.
Сами по себе эти цены представляли собой значительное снижение по сравнению с первоначальной экономической стратегией запуска V4 в апреле. Когда V4 появился в апреле, цена V4-Pro составляла 1,74 доллара за миллион токенов на входе при промахе кэша и 3,48 доллара за миллион токенов на выходе. К концу мая DeepSeek закрепила снижение цен на 75%, укрепив свои позиции как необычайно недорогой вариант для обработки больших объемов агентских задач. Теперь маятник движется в противоположном направлении.
Начиная с 16 августа в 16:00 UTC, DeepSeek будет взимать плату по разным тарифам в зависимости от времени выполнения API-запросов. Пиковые часы — это 01:00–04:00 UTC и 06:00–10:00 UTC (21:00–00:00 ET и 02:00–06:00 ET соответственно), а все остальные часы считаются непиковыми. Тарифы в непиковые часы составляют половину соответствующих пиковых цен.
Для V4-Flash в непиковые часы затраты на ввод данных из-за промахов кэша возрастают с 0,14 до 0,22 доллара за миллион токенов, а затраты на вывод — с 0,28 до 0,66 доллара. В пиковые часы эти показатели достигают 0,44 доллара на ввод и 1,32 доллара на вывод.
Стоимость V4-Pro сегодня выросла с 0,435 доллара за миллион токенов, полученных в результате промаха кэша, и 0,87 доллара за единицу на выходе до 0,66 и 1,98 доллара вне пиковой нагрузки соответственно. В пиковые часы ставки вырастут до 1,32 доллара на входе и 3,96 доллара на выходе.
Рост еще более заметен для кэшированных данных. Количество попаданий в кэш V4-Pro увеличилось с 0,003625 доллара за миллион токенов сегодня до 0,022 доллара в непиковое время и 0,044 доллара в пиковое время. Для Flash рост составил 0,0028 доллара до 0,007 доллара в непиковое время и 0,014 доллара в пиковое время.
|
Модель |
Старый ввод (за 1 миллион токенов) |
Старый объем производства (на 1 млн токов) |
Предыдущая сумма (1 млн входящих/1 млн исходящих) |
|
deepseek-v4-flash |
0,14 доллара |
0,28 доллара |
0,42 доллара |
|
deepseek-v4-pro |
0,435 доллара |
0,87 доллара |
1,305 доллара |
Новые цены по-прежнему позиционируют DeepSeek как доступную альтернативу западным проприетарным лабораториям через API, но агентство Reuters сообщило в четверг, что в зависимости от модели, категории токенов и времени использования изменения представляют собой повышение цен от 50% до более чем 1100% по сравнению с существующими тарифами.
|
Модель |
Входные данные ($/1 млн) |
Объем производства ($/1 млн) |
Итого ($/1 млн) |
Источник |
|
Участник проекта Muse Spark 1.2 |
0,10 доллара |
0,20 доллара |
0,30 доллара |
Мета |
|
MiMo-V2.5 Flash |
0,10 доллара |
0,30 доллара |
0,40 доллара |
Xiaomi |
|
DeepSeek-V4-Flash — вне пиковой нагрузки |
0,22 доллара |
0,66 доллара |
0,88 доллара |
DeepSeek |
|
GPT-5.6 Луна |
0,20 доллара |
1,20 доллара |
1,40 доллара |
OpenAI |
|
МиниМакс-М3 |
0,30 доллара |
1,20 доллара |
1,50 доллара |
МиниМакс |
|
LongCat-2.0 — акция, действующая ограниченное время. |
0,30 доллара |
1,20 доллара |
1,50 доллара |
ЛонгКэт |
|
DeepSeek-V4-Flash — часы пик |
0,44 доллара |
1,32 доллара |
1,76 доллара |
DeepSeek |
|
MiMo-V2.5 |
0,40 доллара |
2,00 доллара |
2,40 доллара |
Xiaomi |
|
DeepSeek-V4-Pro — вне пиковой нагрузки |
0,66 доллара |
1,98 доллара |
2,64 доллара |
DeepSeek |
|
LongCat-2.0 — стандарт |
0,75 доллара |
2,95 доллара |
3,70 доллара |
ЛонгКэт |
|
MiMo-V2.5 Pro (≤256K) |
1,00 долл. |
3,00 доллара |
4,00 доллара |
Xiaomi |
|
DeepSeek-V4-Pro — часы пик |
1,32 доллара |
3,96 доллара |
5,28 долларов |
DeepSeek |
|
Muse Spark 1.1 / 1.2 |
1,25 доллара |
4,25 доллара |
5,50 долларов |
Мета |
|
GLM-5.2 |
1,40 доллара |
4,40 доллара |
5,80 долларов |
З.ай |
|
Grok 4.6 — <200K токенов подсказок |
2,00 доллара |
6,00 долларов |
8,00 долларов |
xAI |
|
MiMo-V2.5 Pro (>256K) |
2,00 доллара |
6,00 долларов |
8,00 долларов |
Xiaomi |
|
Qwen3.8-Max |
2,00 доллара |
6,00 долларов |
8,00 долларов |
QwenCloud |
|
Вспышка Gemini 3.6 |
1,50 доллара |
7,50 долларов |
9,00 долларов |
|
|
GPT-5.6 Terra |
2,00 доллара |
12,00 долларов |
14,00 долларов |
OpenAI |
|
Grok 4.6 — ≥200 тыс. токенов подсказок |
4,00 доллара |
12,00 долларов |
16,00 долларов |
xAI |
|
ГПТ-5.4 |
2,50 доллара |
15,00 долларов |
17,50 долларов |
OpenAI |
|
Кими К3 |
3,00 доллара |
15,00 долларов |
18,00 долларов |
Moonshot AI |
|
Клод Опус 5 |
5,00 долларов |
25,00 долларов |
30,00 долларов |
Антропический |
|
Sakana Fugu Ultra (≤272K) |
5,00 долларов |
30,00 долларов |
35,00 долларов |
Сакана ИИ |
|
GPT-5.6 Sol — Стандартный режим |
5,00 долларов |
30,00 долларов |
35,00 долларов |
OpenAI |
|
Клод Басня 5 / Клод Мифос 5 |
10,00 долларов |
50,00 долларов |
60,00 долларов |
Антропический |
|
GPT-5.6 Sol — Быстрый режим |
10,00 долларов |
60,00 долларов |
70,00 долларов США |
OpenAI |
Поэтому формулировка про «на 50% дешевле» в непиковое время может ввести в заблуждение без контекста. В непиковое время тарифы на 50% дешевле, чем новый тариф DeepSeek в пиковое время; это не 50% скидка от цен на API, которые разработчики платят сегодня.
Для простой рабочей нагрузки, состоящей из одного миллиона входных токенов, связанных с промахами кэша, и одного миллиона выходных токенов, стоимость V4-Pro в настоящее время составляет 1,305 доллара. Та же самая комбинация токенов обойдется в 2,64 доллара в непиковое время, что примерно вдвое больше, или в 5,28 доллара в пиковые часы, что более чем в четыре раза превышает текущую цену.
Цена на V4-Flash выросла с 0,42 доллара (по результатам тех же простых расчетов) до 0,88 доллара в непиковое время и 1,76 доллара в пиковое время.
Фактические затраты на приложение будут значительно варьироваться в зависимости от соотношения кэшированных входных данных, некэшированных входных данных и сгенерированных выходных данных, поэтому эти суммарные цифры являются скорее иллюстративными, чем универсальными оценками общей стоимости.
DeepSeek переходит на более высокий уровень в стеке агентов.
Благодаря своевременности, стратегическое направление трудно не заметить.
Когда DeepSeek выпустила предварительную версию V4 24 апреля, главной темой обсуждения стало то, насколько передовые возможности компания сможет обеспечить благодаря необычайно эффективной архитектуре.
V4-Pro использует гибридную архитектуру внимания, сочетающую в себе сжатое разреженное внимание и сильно сжатое внимание; по данным DeepSeek, в контексте с миллионом токенов требуется всего 27% операций с плавающей запятой (FLOPs) для вывода данных из одного токена и 10% кэша ключ-значение (KV-кэш), необходимого для версии V3.2.
К концу мая дискуссия сместилась в сторону того, что эти улучшения означают с экономической точки зрения для агентов, обрабатывающих большие объемы данных, поскольку многократное считывание контекста может сделать кэширование важной составляющей затрат на вывод. Значительное снижение цен на DeepSeek в версии V4 усилило это преимущество.
Релизы 13 августа поднимают конкуренцию на новый уровень.
В DeepSeek появилась обновленная версия V4-Pro, оптимизированная для рабочих нагрузок агентов, стандартизированные интерфейсы, упрощающие подключение к существующим инструментам разработчика, настраиваемая логическая инфраструктура и лицензированный MIT инструмент для управления моделями, инструментами, песочницами, файловыми системами и оркестрацией, связанными с агентом.
В то же время DeepSeek демонстрирует, что разработчики не могут считать, что его агрессивно низкие тарифы на API останутся неизменными. Для организаций, рассматривающих эту платформу, планирование рабочих нагрузок, поведение кэширования и возможность запуска тестов OpenWeights на собственной инфраструктуре теперь становятся более важными составляющими расчета общей стоимости.
В результате DeepSeek преследует одновременно две потенциально противоречащие друг другу цели: сделать свой стек агентов более доступным и открытым, одновременно значительно увеличив стоимость собственного размещенного API.
Для корпоративных разработчиков наиболее важной частью объявления, сделанного в четверг, может оказаться именно Harness. Модели все чаще можно заменять за стандартизированными интерфейсами. Заменить Harness, который управляет тем, как агент рассуждает, вызывает инструменты, редактирует программное обеспечение и сохраняется на протяжении всего рабочего процесса, может быть гораздо сложнее.
Теперь DeepSeek конкурирует и за этот слой.
Источник: venturebeat.com
Похожие записи
Оцените материал:
Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
