AIDive

DeepSeekがClaude Codeを狙う:Harness + V4 Pro

AIDive · 公開

コーディングエージェントAI モデル

DeepSeek、同じ日に二度打つ

2026年8月13日、DeepSeekは2つの製品を同時に出しました。DeepSeek Harness はMITライセンスのオープンソースのコーディングエージェントで、Claude Code を真正面から狙います。Bloomberg はこれを率直にAnthropicへの挑戦だと評しました。同じ日に DeepSeek V4 Pro(ビルド0813)が一般提供に入り、100万トークンのコンテキストウィンドウを、入力100万トークンあたり0.5ドル未満で提供します。

市場はすぐに反応しました。モデルの Hacker News 投稿は1日で990ポイントを超え、Harness のリポジトリはすでにGitHubスター2万1千超です。ツール1つとモデル1つを同じ日に出す——それこそ Claude Code を作った公式です。

私たちは npx コマンド1つで DeepSeek Harness を導入し、ドキュメントを読み、DeepSeek が出した数字を全部確かめました。この記事では「すべてがプラグイン」の構造、ベンチマークと価格で V4 Pro が Claude にどこまで通じるか、そして誰が移行し誰が待つべきかを扱います。

エージェント harness とは何か

harness とは、モデルが実際にあなたのマシンで働けるようにする仕組み全体のことです。呼び出しをつなぐループ、モデルが使えるツール、コンテキスト管理、権限、そしてインターフェース。モデルが決め、harness が実行する——この短い一文が役割分担のすべてです。

Claude Code に指示を打っても、モデル自身がディスクに触ることはありません。ファイルを読む、コマンドを実行する、テストを走らせる、と harness に頼み、harness が許可されているかを確認し、実行して、結果を返します。どのコーディングエージェントもこの仕組みです。

Claude Code は Anthropic の harness で Claude モデル用、Codex は OpenAI の harness で GPT 用です。DeepSeek に公式版はなく、モデルは他社ツールの中で動いていました。8月13日がそれを変えます。DeepSeek はエンジンだけでなく、車そのものを売り始めました。

すべてがプラグイン:dsh の中身

DeepSeek Harness——ドキュメントの略称は dsh——は1つの中心思想の上に立ちます。すべてがプラグインです。マーケティングの標語ではなく、実際のアーキテクチャです。モデルはプラグイン。ツールもプラグイン。スキル、セッション、サンドボックス、ストレージ、ループ、スケジューリング、UIまで、すべてプラグイン。公式ドキュメントは、あらゆる機能を設定だけで選び、差し替え、拡張でき、harness のソースコードに触れる必要はないと述べています。

土台にあるのは Cordis です。DeepSeek が合成可能性の研究論文で説明するカーネルで、プロジェクトの重みも本物です。1万2千超のコミット、Discord サーバー、そして GitHub 上の専用タグ dsh-plugin では、コミュニティ製プラグインが既に登場しています。実際的な帰結として、harness には凍った中核がありません。別のサンドボックス、別のセッションストレージ、別のモデルが欲しければ、設定を変えるだけで、コードは触りません。

インストールはコマンド1つ。npx @deepseek-ai/dsh web でローカルのポート3080に Web インターフェースが開きます。アカウントもインストーラーも不要で、npm パッケージだけで十分です。ソースからビルドしたい場合は、リポジトリ全体を clone して pnpm で4コマンドでビルドできます。

dsh には4つのランタイムモードがあり、ここでアーキテクチャの賭けが見えてきます。

  • Standard モードは完全なコーディングエージェントです。ファイル編集、シェル、検索、計画——Claude Code の直接の等価物です。
  • Code モードではモデルが TypeScript を生成し、ツール呼び出しを1つずつ繋ぐ代わりに多段の処理を自分で組み立てます。長いタスクでは往復、遅延、トークンを削減します。
  • Minimal モードはエージェントを bash とファイルエディタまで削ります。主に素のモデルのベンチマーク用です。
  • Creator モードは自分のプリセットを作るためのもので、ランタイム検査とライブのプラグイン実験ができます。

最後の要素はトレーサビリティです。モデルが見たものはすべて追記専用のセッションログへ入ります。末尾に足せるだけで、履歴は書き換えられません。そのログが harness の拠り所で、そこから再開、フォーク、検索、任意のセッションの再生ができます。エージェントが42回目のツール呼び出しで脱線しても、トランスクリプトを漁る必要はありません。分岐点までセッションを再生し、モデルが見たものを正確に見ます。これはOSの発想であって、もう1つのAPIラッパーではありません。

V4 Pro:harness の背後にあるエンジン

DeepSeek V4 Pro、ビルド0813は、プレビューを抜けて一般提供に入るモデルで、DeepSeek API か OpenRouter ですでに使えます。mixture-of-experts モデルで、トークンごとにネットワークの一部だけが動くため、大きいモデルの能力を小さいモデルの計算コストで得られます。仕様は100万トークンのコンテキストウィンドウ、最大38万4千の出力トークン、ツール呼び出し、JSON出力です。

この話で二重に効く一点があります。DeepSeek API は Anthropic API 互換を謳っています。Claude 向けに書かれたツールが、ベースURLとキーの差し替えだけで V4 Pro と話せます。

ベンチマークでは、DeepSeek はほぼ最上位を主張します。

ベンチマーク DeepSeek V4 Pro Claude
SWE-bench Verified 約80.6%(Maxバリアント) 80.8%(Opus 4.6)
Terminal Bench 2.1 勝利を主張 Opus 4.8
Artificial Analysis 指数 53 63(Opus 5)
速度(トークン/秒) 83 52

ただし、この一点が全数値の読み方を変えます。第三者による再現はまだ1件もありません。出回るものはすべて DeepSeek 発か、DeepSeek を写した記事です。Simon Willison によれば、ベンチマークはまず DeepSeek 公式の WeChat グループで回り、モデレーターが削除した Reddit の投稿に写され、Hacker News の ASCII 表に行き着きました。公式の発表ページはなく、オープンウェイトも未確認だと彼は指摘します——4月の V4 Pro と7月の V4 Flash は Hugging Face に出ているので、公開はありそうだとも。彼のペリカンのテストでは、少なくとも珍しい挙動が出ました。3つの推論レベルで3羽の全く違うペリカンです。モデルはおそらく非常に良い。ただ今それを言っているのは DeepSeek だけです。

Claude との価格差

DeepSeek が最も強く殴るのは価格です。発売時点で V4 Pro は DeepSeek API 経由で入力100万トークンあたり0.435ドル、出力100万トークンあたり0.87ドルです。

モデル 入力(ドル/100万トークン) 出力(ドル/100万トークン)
DeepSeek V4 Pro(発売時料金) 0.435 0.87
Claude Sonnet 5 2 10
Claude Opus 5 5 25
Claude Fable 5 10 50

発売時料金では、V4 Pro は入力で Opus 5 より約11倍安く、出力では28倍安くなります。Anthropic の廉価版である Sonnet 5 でさえ、4倍から11倍高いままです。

入力5万トークン、出力1万5千の典型的なコーディングエージェントのセッションでは、Opus 5 が約0.62ドル、V4 Pro は発売時料金で約0.035ドルです。エージェントの隠れた費目はキャッシュで、harness はループのたびに同じコンテキストを送り直します。キャッシュヒットは Opus 5 で100万あたり0.50ドル、DeepSeek では約0.0036ドルです。

ただしこの底値には期限があり、それは近い。8月16日から——発売の3日後——API はピークとオフピークの課金に移ります。

料金区分 入力(ドル/100万) 出力(ドル/100万)
発売時(8月16日まで) 0.435 0.87
オフピーク 0.66 1.98
ピーク(UTC 1〜4時、6〜10時) 1.32 3.96

今週みんなが比べている価格は少なくとも1.5倍になり、出力では4倍超になります。最悪の料金でも V4 Pro は Opus 5 より約4倍安いので議論は生き残りますが、Hacker News で回る数字は3日で終わる特価です。スケジュールもエージェントには効きます。ピークは中国の勤務時間に沿うので、夜間の cron はオフピークに当たり、午後のコーディングはピークの時間帯を食います。

Claude Code を置き換えられるか

アーキテクチャでは、dsh に Claude Code にない論拠があります。エージェントが脱線したとき、Claude Code はトランスクリプトを漁らせ、dsh はセッションをイベント単位で再生させます。プラグイン機構は Anthropic の skills や MCP サーバーより広く、サンドボックス、ストレージ、ループ自体も覆います。Claude Code では拡張し、dsh では組み替えられます。harness は DeepSeek 以外のモデルも受け入れますが、Claude Code は非公式プロキシを通さない限り Claude に固定です。

一方 Claude Code には成熟があり、それは重い。数万チームでの数か月の実運用、skills・hooks・統合の巨大なエコシステム、独立した評価者が検証したスコアを持つモデル、そして請求の驚きから守るサブスクリプション。dsh は全トークンを課金します。

dsh はバージョン0.1のデベロッパープレビューで、README は大文字で互換性を壊す変更が来ると書いています。ただ Anthropic API 互換のおかげで、実は陣営を選ぶ必要がありません。harness は残してワークフローを V4 Pro に向けてもいいし、今使うモデルで dsh を試してもいい。dsh は Claude Code が直面した最も信頼できる挑戦者であり、そして0.1の挑戦者が現役王者に挑む形です。

移行前の落とし穴

何かをアンインストールする前に、天秤にかけるべき限界が3つあります。

1つ目。dsh は予告なく互換性を壊すデベロッパープレビューです。今週書いたプラグインが来月読み込めないかもしれません。日々のワークフローを載せるなら、定期的な修理を受け入れることになります。

2つ目。V4 Pro のベンチマークはすべて自己申告です。独立した再現なし、発表ページなし、WeChat グループから出た数字。正確かもしれませんが、DeepSeek の外の誰もまだ知りません。

3つ目。話題の価格は借り物の時間です。8月16日から時間帯課金で出力はピーク時100万あたり3.96ドルまで上がり、発売日の4.5倍になります。dsh はエージェントの構成に完全な自由を与えますが、1か月後に何が正しいかの保証はほとんどありません。エージェント基盤が事業を回しているなら、今週動かす時ではありません。

それで、移行するか否か

1日中使った上での私たちの読みは3つのプロフィールに落ちます。harness やエージェント基盤を作るなら、今週 dsh を入れましょう。全プラグイン構造と再生できるログは今もっとも面白い2つの発想で、npx コマンド1つで意見が持てます。エージェント業務の API 請求を下げたいだけなら、サイドプロジェクトで V4 Pro を試す——ただし8月16日の料金で計算し、本番を切り替える前にスコアの独立検証を待ちましょう。

Claude Code が日々の仕事を回しているなら、そのままで。この発表に、動いているツールから破壊を予告する0.1へ移る理由はありません。良い知らせは、この攻撃が全員を動かすことです。どのエージェントを使っていても、価格が下がる現実的な芽が出ました。

出典

よくある質問

DeepSeek Harness(dsh)とは何ですか?
DeepSeek Harness、略して dsh は、DeepSeek が2026年8月13日にMITライセンスで公開したオープンソースのコーディングエージェントです。Claude Code に相当する DeepSeek 版で、モデル、ツール、サンドボックス、ストレージ、インターフェースまで設定で差し替えられる「すべてがプラグイン」の構造の上に作られています。
エージェント harness とは何ですか?
harness は、AIモデルがあなたのマシンで働けるようにする周辺の仕組みです。呼び出しをつなぐループ、モデルが使えるツール、コンテキスト管理、権限、インターフェースを含みます。モデルが決め、harness が実行します。Claude Code は Claude 向けの Anthropic の harness、Codex は GPT 向けの OpenAI の harness です。
DeepSeek Harness はどうインストールしますか?
`npx @deepseek-ai/dsh web` を実行すると、ローカルのポート3080に Web インターフェースが開きます。開始にアカウントもインストーラーも不要で、リポジトリを pnpm で4コマンドでソースからビルドすることもできます。
DeepSeek V4 Pro は Claude より優れていますか?
DeepSeek はほぼ同等だと主張しています。SWE-bench Verified で約80.6%(Claude Opus 4.6 は80.8%)、速度は毎秒83トークン対52ですが、Artificial Analysis 指数では Opus 5 が63対53でリードします。これらのスコアはまだ独立に再現されておらず、公表された数字はすべて DeepSeek 自身に由来します。
DeepSeek V4 Pro は Claude よりどれだけ安いですか?
発売時料金(入力100万あたり0.435ドル、出力0.87ドル)では、V4 Pro は入力で Claude Opus 5 の約11分の1、出力で約28分の1です。2026年8月16日からピーク/オフピーク課金で入力0.66〜1.32ドル、出力1.98〜3.96ドルに上がりますが、最悪の料金でも Opus 5 の約4分の1にとどまります。
Claude Code から DeepSeek Harness に乗り換えるべきですか?
日々の本番作業ではまだ早いでしょう。dsh は README が互換性を壊す変更を警告する0.1のデベロッパープレビューで、V4 Pro のベンチマークも未検証です。エージェント基盤を作るなら入れる価値があり、V4 Pro は Anthropic API 互換のおかげでサイドプロジェクトで試す価値があります。

関連動画