AIDive

DeepSeek атакует Claude Code: Harness + V4 Pro

AIDive · Опубликовано

Кодинг-агентыИИ-модели

DeepSeek бьёт дважды за один день

13 августа 2026 года DeepSeek выпустила два продукта разом. DeepSeek Harness — опенсорсный кодинг-агент под лицензией MIT, который целится прямо в Claude Code: Bloomberg прямо назвал это вызовом Anthropic. В тот же день DeepSeek V4 Pro (сборка 0813) вышла в общий доступ — с контекстным окном на миллион токенов и ценой меньше полудоллара за миллион входных токенов.

Рынок заметил мгновенно. Пост о модели на Hacker News взял 990 очков за один день, а у репозитория Harness уже больше 21 000 звёзд на GitHub. Инструмент плюс модель, выпущенные в один день, — это ровно та формула, которая сделала Claude Code тем, что он есть.

Мы поставили DeepSeek Harness одной командой npx, прочитали документацию и прошли по каждой цифре, которую опубликовала DeepSeek. Эта статья — про архитектуру «всё — плагин», про то, чего стоит V4 Pro против Claude в бенчмарках и по цене, и про то, кому переходить, а кому подождать.

Что такое агентский harness на самом деле

Harness — это вся машинерия вокруг модели, чтобы она реально работала на вашем компьютере: цикл, сцепляющий вызовы, инструменты, которые модели разрешено использовать, управление контекстом, права и интерфейс. Модель решает, harness исполняет — в этой короткой фразе всё разделение труда.

Когда вы вводите инструкцию в Claude Code, модель сама диск не трогает. Она просит harness прочитать файл, выполнить команду или запустить тест; harness проверяет, разрешено ли это, выполняет и отдаёт результат. Любой кодинг-агент устроен так.

Claude Code — это harness Anthropic на моделях Claude, а Codex — harness OpenAI на GPT. У DeepSeek официального не было: её модели крутились в чужих инструментах. Вот это 13 августа и меняет: DeepSeek перестала продавать только мотор и продаёт всю машину.

Всё — плагин: внутри dsh

DeepSeek Harness — в документации его сокращают до dsh — построен вокруг одной идеи: всё — плагин. Это не маркетинговый слоган, а настоящая архитектура. Модели — плагины. Инструменты — плагины. Скиллы, сессии, песочницы, хранилище, циклы, планировщик и даже интерфейс — всё плагины. Официальная документация говорит, что любую способность можно выбрать, заменить или расширить в конфиге, не трогая исходники harness.

Под капотом всё лежит на Cordis — ядре, которое DeepSeek описывает в исследовательской статье о композируемости. У проекта есть реальный вес: больше 12 000 коммитов, сервер Discord и отдельный тег dsh-plugin на GitHub, где уже появляются плагины сообщества. Практическое следствие: у harness нет замороженного ядра — хотите другую песочницу, другое хранилище сессий или другую модель, меняете конфиг, а не код.

Установка — одна команда: npx @deepseek-ai/dsh web открывает веб-интерфейс локально на порту 3080. Аккаунт для старта не нужен, установщик тоже — хватает пакета npm. Если хотите собрать из исходников, весь репозиторий клонируется и собирается pnpm за четыре команды.

У dsh четыре режима выполнения, и вот тут архитектурная ставка становится видна:

  • Режим Standard — полный кодинг-агент: правка файлов, шелл, поиск и планирование — прямой эквивалент Claude Code.
  • Режим Code заставляет модель генерировать TypeScript, который сам оркеструет многошаговые операции вместо цепочки вызовов инструментов, что срезает round trip'ы, задержку и токены на длинных задачах.
  • Режим Minimal ужимает агента до bash и файлового редактора, в основном чтобы мерить голую модель.
  • Режим Creator — чтобы собирать свои пресеты, с инспекцией рантайма и живыми экспериментами с плагинами.

Последняя деталь — прослеживаемость. Всё, что видит модель, идёт в append-only лог сессии: добавлять можно только в конец, историю не переписать. Этот лог — источник правды harness, и из него можно продолжить, форкнуть, найти или переиграть любую сессию. Когда агент сходит с рельсов на сорок втором вызове инструмента, вы не роетесь в транскрипте; вы переигрываете сессию до точки слома и видите ровно то, что видела модель. Это мышление операционной системы, а не ещё одна обёртка над API.

V4 Pro: мотор за harness

DeepSeek V4 Pro, сборка 0813, — модель, выходящая из превью в общий доступ, её уже можно запускать через API DeepSeek или OpenRouter. Это mixture-of-experts: на каждый токен включается лишь часть сети, и вы получаете возможности большой модели по цене вычислений малой. Спецификация: контекстное окно на миллион токенов, до 384 000 токенов на выходе, вызовы инструментов и JSON.

Одна деталь тут весит вдвойне: API DeepSeek заявляет совместимость с API Anthropic. Инструмент, написанный под Claude, заговорит с V4 Pro сменой базового URL и ключа.

По бенчмаркам DeepSeek заявляет результаты у самой вершины:

Бенчмарк DeepSeek V4 Pro Claude
SWE-bench Verified ~80,6% (вариант Max) 80,8% (Opus 4.6)
Terminal Bench 2.1 заявленная победа Opus 4.8
Индекс Artificial Analysis 53 63 (Opus 5)
Скорость (токенов/с) 83 52

Но вот деталь, меняющая чтение всех этих чисел: ни один результат ещё не воспроизведён третьей стороной. Всё, что ходит по сети, ведёт к DeepSeek или к статьям, копирующим DeepSeek. Simon Willison указывает, что бенчмарки сначала разошлись в официальной группе DeepSeek в WeChat, попали в пост на Reddit, который удалили модераторы, и осели ASCII-таблицей на Hacker News. Он также отмечает, что нет официальной страницы анонса, а открытые веса не подтверждены — хотя апрельский V4 Pro и июльский V4 Flash попали на Hugging Face, так что релиз выглядит вероятным. Его тест с пеликаном показал хотя бы кое-что необычное: три уровня рассуждения дали трёх совершенно разных пеликанов. Модель, вероятно, очень хороша; только пока это говорит одна DeepSeek.

Разрыв в цене с Claude

По цене DeepSeek бьёт сильнее всего. На старте V4 Pro стоит $0,435 за миллион входных токенов и $0,87 за миллион выходных через API DeepSeek.

Модель Вход ($/млн токенов) Выход ($/млн токенов)
DeepSeek V4 Pro (стартовый тариф) $0,435 $0,87
Claude Sonnet 5 $2 $10
Claude Opus 5 $5 $25
Claude Fable 5 $10 $50

По стартовому тарифу V4 Pro примерно в 11 раз дешевле Opus 5 на входе и в 28 раз на выходе. Даже Sonnet 5, бюджетный вариант Anthropic, остаётся в четыре-одиннадцать раз дороже.

Для типичной сессии кодинг-агента в 50 000 токенов на вход и 15 000 на выход Opus 5 стоит около $0,62, а V4 Pro по стартовому тарифу — около $0,035. Скрытая статья для агента — кэш, потому что harness шлёт тот же контекст на каждом витке цикла: попадание в кэш стоит $0,50 за миллион на Opus 5 и около $0,0036 за миллион у DeepSeek.

Только у этой нижней цены есть срок годности, и он близко. С 16 августа — через три дня после запуска — API переходит на тарифы пиковых и непиковых часов:

Тарифный период Вход ($/млн) Выход ($/млн)
Старт (до 16 августа) $0,435 $0,87
Непиковые часы $0,66 $1,98
Пиковые часы (1–4 и 6–10 UTC) $1,32 $3,96

Цена, которую все сравнивают на этой неделе, растёт минимум на половину, а на выходе — более чем вчетверо. Даже по худшему тарифу V4 Pro остаётся почти вчетверо дешевле Opus 5, так что аргумент выживает — но число, гуляющее по Hacker News, это промо, которое кончится через три дня. Расписание важно и для агентов: пик идёт по китайскому рабочему дню, так что ночные cron'ы ловят непик, а дневной кодинг съедает пиковые окна.

Может ли он заменить Claude Code?

По архитектуре у dsh есть аргументы, которых нет у Claude Code. Когда агент сходит с рельсов, Claude Code даёт рыться в транскрипте; dsh даёт переиграть сессию событие за событием. Система плагинов идёт дальше скиллов и MCP-серверов Anthropic, потому что покрывает песочницу, хранилище и сам цикл — в Claude Code вы расширяете агента, в dsh можете его пересобрать. Harness принимает и модели, которые не от DeepSeek, тогда как Claude Code заперт на Claude, если не идти через неофициальные прокси.

С другой стороны, у Claude Code есть зрелость, и она весит много: месяцы продакшена в десятках тысяч команд, огромная экосистема скиллов, хуков и интеграций, модели, чьи результаты проверяют независимые оценщики, и доступ по подписке, который бережёт от сюрпризов в счёте, тогда как dsh считает каждый токен.

dsh — developer preview версии 0.1, и README пишет капслоком, что будут ломающие совместимость изменения. Но совместимость с API Anthropic означает, что выбирать сторону вовсе не нужно: оставьте свой harness и направьте часть воркфлоу на V4 Pro, или попробуйте dsh с той моделью, которой уже пользуетесь. dsh — самый убедительный вызов, что видел Claude Code, и это вызов версии 0.1 действующему чемпиону.

Ловушки перед переездом

Прежде чем что-то удалять, стоит взвесить три ограничения.

Первое: dsh — developer preview, ломающий совместимость без предупреждения, так что плагин, написанный на этой неделе, может не загрузиться в следующем месяце. Строить на нём ежедневный воркфлоу сегодня — значит согласиться регулярно его чинить.

Второе: каждый бенчмарк V4 Pro — самоотчёт. Ни независимого воспроизведения, ни страницы анонса, цифры всплыли в группе WeChat. Возможно, они точны, но за пределами DeepSeek этого пока никто не знает.

Третье: цена, делающая шум, живёт взаймы. С 16 августа тарификация по слотам поднимает выход до $3,96 за миллион в пик — вчетверо с половиной выше цены дня запуска. dsh даёт полную свободу в архитектуре вашего агента и почти никаких гарантий, что останется правдой через месяц. Если ваш агентский стек кормит бизнес, эта неделя не для переезда.

Так переезжать или нет?

Наше прочтение после дня внутри сводится к трём профилям. Если вы строите harness'ы или агентский тулинг, ставьте dsh на этой неделе: полностью плагинная архитектура и переигрываемый лог — две самые интересные идеи прямо сейчас, и одной команды npx хватит, чтобы составить мнение. Если вы просто хотите счёт за API поменьше на агентских задачах, протестируйте V4 Pro на пет-проекте — но считайте по тарифам с 16 августа и дождитесь независимого подтверждения результатов, прежде чем менять прод.

Если Claude Code держит вашу ежедневную работу, оставьте его. Ничто в этом релизе не оправдывает переход с работающего инструмента на версию 0.1, которая обещает поломки. Хорошая новость в том, что эта атака заставит двигаться всех: какой бы агент у вас ни был, у его цены появился реальный шанс упасть.

Источники

Частые вопросы

Что такое DeepSeek Harness (dsh)?
DeepSeek Harness, сокращённо dsh, — опенсорсный кодинг-агент, выпущенный DeepSeek 13 августа 2026 года под лицензией MIT. Это ответ DeepSeek на Claude Code, построенный на архитектуре «всё плагин», где модели, инструменты, песочницы, хранилище и даже интерфейс меняются в конфиге.
Что такое агентский harness?
Harness — это машинерия вокруг ИИ-модели, чтобы та могла работать на вашем компьютере: цикл, сцепляющий вызовы, инструменты, которые модели разрешено использовать, управление контекстом, права и интерфейс. Модель решает, harness исполняет — Claude Code это harness Anthropic для Claude, а Codex — harness OpenAI для GPT.
Как установить DeepSeek Harness?
Запустите `npx @deepseek-ai/dsh web`, и локальный веб-интерфейс откроется на порту 3080. Для старта не нужны ни аккаунт, ни установщик, а репозиторий можно собрать из исходников через pnpm за четыре команды.
DeepSeek V4 Pro лучше Claude?
DeepSeek заявляет почти паритет: около 80,6% на SWE-bench Verified против 80,8% у Claude Opus 4.6 и 83 токена в секунду против 52 по скорости, хотя в индексе Artificial Analysis Opus 5 ведёт 63 к 53. Ни один из этих результатов ещё не воспроизведён независимо — все опубликованные числа ведут к самой DeepSeek.
Насколько DeepSeek V4 Pro дешевле Claude?
По стартовому тарифу ($0,435/млн на входе, $0,87/млн на выходе) V4 Pro примерно в 11 раз дешевле Claude Opus 5 на входе и в 28 раз на выходе. С 16 августа 2026 года тарифы пиковых и непиковых часов поднимают цены до $0,66–$1,32 на входе и $1,98–$3,96 на выходе, что оставляет его примерно вчетверо дешевле Opus 5 даже по худшему тарифу.
Стоит ли переходить с Claude Code на DeepSeek Harness?
Для ежедневной продакшен-работы пока нет. dsh — developer preview 0.1, чей README предупреждает о ломающих совместимость изменениях, а бенчмарки V4 Pro не проверены. Его стоит поставить, если вы строите агентский тулинг, а V4 Pro стоит протестировать на пет-проектах благодаря совместимости с API Anthropic.

Похожие видео