AIDive

DeepSeek का Claude Code पर वार: Harness + V4 Pro

AIDive द्वारा · प्रकाशित

कोडिंग एजेंटAI मॉडल

DeepSeek ने एक ही दिन दो वार किए

13 अगस्त 2026 को DeepSeek ने एक साथ दो प्रोडक्ट लॉन्च किए। DeepSeek Harness एक ओपन सोर्स कोडिंग एजेंट है, MIT लाइसेंस के तहत, जो सीधे Claude Code को निशाना बनाता है — Bloomberg ने इसे साफ़ शब्दों में Anthropic को चुनौती बताया। उसी दिन DeepSeek V4 Pro (बिल्ड 0813) जनरल अवेलेबिलिटी में आया, एक मिलियन token के context window के साथ, इनपुट पर आधे डॉलर प्रति मिलियन token से भी कम कीमत पर।

बाज़ार ने तुरंत नोटिस किया। मॉडल की Hacker News पोस्ट ने एक ही दिन में 990 पॉइंट पार किए, और Harness रिपॉज़िटरी पहले ही 21,000 से ज़्यादा GitHub स्टार पर है। एक टूल और एक मॉडल, एक ही दिन लॉन्च — यही वो फ़ॉर्मूला है जिसने Claude Code को वो बनाया जो वो है।

हमने एक npx कमांड से DeepSeek Harness इंस्टॉल किया, डॉक्यूमेंटेशन पढ़ी, और DeepSeek के छापे हर आँकड़े को देखा। यह लेख एवरीथिंग-इज़-अ-प्लगइन आर्किटेक्चर, बेंचमार्क और कीमत में V4 Pro की स्थिति, और किसे माइग्रेट करना चाहिए बनाम किसे रुकना चाहिए — इन सब पर है।

एजेंट harness असल में है क्या

harness मतलब मॉडल के चारों ओर की पूरी मशीनरी, ताकि वो सच में आपके कंप्यूटर पर काम कर सके: वो लूप जो कॉल्स को जोड़ता है, वो टूल्स जो मॉडल इस्तेमाल कर सकता है, कॉन्टेक्स्ट मैनेजमेंट, परमिशन, और इंटरफ़ेस। मॉडल तय करता है, harness चलाता है — इस छोटे वाक्य में पूरा काम का बँटवारा है।

जब आप Claude Code में कोई निर्देश टाइप करते हैं, मॉडल खुद आपकी डिस्क को कभी नहीं छूता। वो harness से कहता है कि फ़ाइल पढ़ो, कमांड चलाओ, या टेस्ट शुरू करो; harness जाँचता है कि क्या ये इजाज़त है, उसे चलाता है, और नतीजा लौटाता है। हर कोडिंग एजेंट ऐसे ही चलता है।

Claude Code, Anthropic का harness है जो Claude मॉडलों से जुड़ा है, और Codex, OpenAI का harness है जो GPT से जुड़ा है। DeepSeek के पास कभी ऑफ़िशियल harness नहीं था — उसके मॉडल दूसरों के टूल्स में चलते थे। 13 अगस्त यही बदलता है: DeepSeek अब सिर्फ़ इंजन नहीं, पूरी गाड़ी बेच रहा है।

हर चीज़ प्लगइन है: dsh के अंदर

DeepSeek Harness — डॉक्स में छोटा नाम dsh — एक मूल विचार पर बना है: हर चीज़ एक प्लगइन है। ये मार्केटिंग स्लोगन नहीं, ये असली आर्किटेक्चर है। मॉडल प्लगइन हैं। टूल्स प्लगइन हैं। स्किल्स, सेशन, सैंडबॉक्स, स्टोरेज, लूप, शेड्यूलिंग, और इंटरफ़ेस तक: सब प्लगइन। ऑफ़िशियल डॉक्स कहते हैं कि आप कोई भी क्षमता कॉन्फ़िगरेशन में चुन, बदल या बढ़ा सकते हैं, harness का सोर्स कोड छुए बिना।

अंदर से ये सब Cordis पर टिका है, एक कर्नेल जिसे DeepSeek कम्पोज़ेबिलिटी के रिसर्च पेपर में बताता है। प्रोजेक्ट में असली दम है: 12,000 से ज़्यादा कमिट, एक Discord सर्वर, और GitHub पर अलग dsh-plugin टैग जहाँ कम्युनिटी प्लगइन आने लगे हैं। व्यावहारिक नतीजा यह कि harness का कोर जमा हुआ नहीं है — अगर आपको दूसरा सैंडबॉक्स, दूसरा सेशन स्टोरेज या दूसरा मॉडल चाहिए, आप कॉन्फ़िग बदलते हैं, कोड नहीं।

इंस्टॉलेशन एक कमांड है: npx @deepseek-ai/dsh web लोकल पोर्ट 3080 पर एक वेब इंटरफ़ेस खोलता है। शुरू करने को न अकाउंट चाहिए, न इंस्टॉलर — npm पैकेज ही काफ़ी है। अगर आप सोर्स से बिल्ड करना चाहें, पूरा रेपो क्लोन होकर pnpm से चार कमांड में बनता है।

dsh चार रनटाइम मोड देता है, और यहीं आर्किटेक्चर का दाँव दिखता है:

  • Standard मोड पूरा कोडिंग एजेंट है: फ़ाइल एडिटिंग, शेल, सर्च, और प्लानिंग — Claude Code का सीधा समकक्ष।
  • Code मोड में मॉडल TypeScript जनरेट करता है जो मल्टी-स्टेप ऑपरेशन खुद चलाता है, एक-एक टूल कॉल जोड़ने की जगह, जिससे राउंड ट्रिप, लेटेंसी और token लंबे कामों में घटते हैं।
  • Minimal मोड एजेंट को bash और एक फ़ाइल एडिटर तक घटा देता है, ज़्यादातर कच्चे मॉडल की बेंचमार्किंग के लिए।
  • Creator मोड अपने प्रीसेट बनाने के लिए है, रनटाइम इंस्पेक्शन और लाइव प्लगइन प्रयोगों के साथ।

आख़िरी हिस्सा है ट्रेसेबिलिटी। मॉडल जो कुछ देखता है, सब एक अपेंड-ओनली सेशन लॉग में जाता है — आप सिर्फ़ आख़िर में जोड़ सकते हैं, इतिहास कभी दोबारा नहीं लिख सकते। वो लॉग harness का सच है, और उससे आप किसी भी सेशन को फिर से शुरू, फ़ोर्क, सर्च या रीप्ले कर सकते हैं। जब आपका एजेंट टूल कॉल बयालीस पर पटरी से उतरे, आप ट्रांसक्रिप्ट नहीं खंगालते; आप सेशन को उस मोड़ तक रीप्ले करते हैं और ठीक-ठीक देखते हैं कि मॉडल ने क्या देखा। ये ऑपरेटिंग सिस्टम की सोच है, एक और API रैपर नहीं।

V4 Pro: harness के पीछे का इंजन

DeepSeek V4 Pro, बिल्ड 0813, वो मॉडल है जो प्रिव्यू से निकलकर जनरल अवेलेबिलिटी में आ रहा है, और DeepSeek API या OpenRouter से अभी चलाया जा सकता है। ये एक mixture-of-experts मॉडल है: हर token पर नेटवर्क का सिर्फ़ एक हिस्सा जगता है, तो बड़े मॉडल की क्षमता छोटे मॉडल की कंप्यूट लागत पर मिलती है। स्पेक शीट: एक मिलियन token का context window, 384,000 तक आउटपुट token, टूल कॉल, और JSON आउटपुट।

एक बात इस कहानी में दोगुनी अहम है: DeepSeek API, Anthropic API कम्पैटिबिलिटी का दावा करता है। Claude से बात करने के लिए लिखा गया टूल बेस URL और की बदलकर V4 Pro से बात कर सकता है।

बेंचमार्क में DeepSeek लगभग शीर्ष स्कोर बताता है:

बेंचमार्क DeepSeek V4 Pro Claude
SWE-bench Verified ~80.6% (Max वैरिएंट) 80.8% (Opus 4.6)
Terminal Bench 2.1 दावा की गई जीत Opus 4.8
Artificial Analysis इंडेक्स 53 63 (Opus 5)
रफ़्तार (token/सेकंड) 83 52

पर एक बात इन सारे आँकड़ों को पढ़ने का तरीक़ा बदल देती है: एक भी स्कोर अब तक किसी तीसरे पक्ष ने दोहराया नहीं है। जो कुछ चल रहा है, सब DeepSeek से या DeepSeek की नक़ल करते लेखों से आता है। Simon Willison बताते हैं कि बेंचमार्क पहले DeepSeek के ऑफ़िशियल WeChat ग्रुप में घूमे, फिर एक Reddit पोस्ट में गए जिसे मॉडरेटरों ने हटा दिया, और Hacker News पर ASCII टेबल बनकर पहुँचे। वो ये भी बताते हैं कि कोई ऑफ़िशियल घोषणा पेज नहीं है, और ओपन वेट्स की पुष्टि नहीं है — हालाँकि अप्रैल का V4 Pro और जुलाई का V4 Flash दोनों Hugging Face पर पहुँचे, तो रिलीज़ की संभावना दिखती है। उनके पेलिकन टेस्ट ने कम से कम कुछ अनोखा दिखाया: तीन रीज़निंग लेवल ने तीन बिल्कुल अलग पेलिकन बनाए। मॉडल शायद बहुत अच्छा है; पर अभी ये सिर्फ़ DeepSeek कह रहा है।

Claude के मुक़ाबले कीमत का फ़ासला

कीमत वहीं है जहाँ DeepSeek सबसे ज़ोर से मारता है। लॉन्च पर V4 Pro की कीमत DeepSeek API पर $0.435 प्रति मिलियन इनपुट token और $0.87 प्रति मिलियन आउटपुट token है।

मॉडल इनपुट ($/M token) आउटपुट ($/M token)
DeepSeek V4 Pro (लॉन्च दर) $0.435 $0.87
Claude Sonnet 5 $2 $10
Claude Opus 5 $5 $25
Claude Fable 5 $10 $50

लॉन्च दर पर V4 Pro इनपुट पर Opus 5 से करीब 11 गुना और आउटपुट पर 28 गुना सस्ता है। Sonnet 5 भी, Anthropic का सस्ता विकल्प, चार से ग्यारह गुना महँगा रहता है।

50,000 token इन और 15,000 आउट वाले एक आम कोडिंग एजेंट सेशन पर Opus 5 करीब $0.62 का पड़ता है; V4 Pro लॉन्च दर पर करीब $0.035 का। एजेंट के लिए छिपा ख़र्च है कैश, क्योंकि harness हर लूप में वही कॉन्टेक्स्ट दोबारा भेजता है: एक कैश हिट Opus 5 पर $0.50 प्रति मिलियन और DeepSeek पर करीब $0.0036 प्रति मिलियन का है।

पर इस न्यूनतम कीमत की एक्सपायरी डेट है, और वो पास है। 16 अगस्त से — लॉन्च के तीन दिन बाद — API पीक और ऑफ़-पीक बिलिंग पर जाता है:

दर अवधि इनपुट ($/M) आउटपुट ($/M)
लॉन्च (16 अगस्त तक) $0.435 $0.87
ऑफ़-पीक $0.66 $1.98
पीक (1–4 और 6–10 UTC) $1.32 $3.96

इस हफ़्ते जिस कीमत की सब तुलना कर रहे हैं, वो कम से कम आधी बढ़ेगी, और आउटपुट पर चार गुना से ऊपर। सबसे ख़राब दर पर भी V4 Pro, Opus 5 से करीब चार गुना सस्ता रहता है, तो तर्क टिका रहता है — पर Hacker News पर जो नंबर घूम रहा है वो तीन दिन में ख़त्म होता प्रोमो है। एजेंट के लिए समय भी मायने रखता है: पीक घंटे चीनी वर्कडे के साथ चलते हैं, तो रात के cron ऑफ़-पीक पकड़ते हैं जबकि दोपहर की कोडिंग पीक विंडो खाती है।

क्या ये Claude Code की जगह ले सकता है?

आर्किटेक्चर पर dsh के पास वो तर्क हैं जो Claude Code के पास नहीं। जब आपका एजेंट बिगड़े, Claude Code आपको ट्रांसक्रिप्ट खंगालने देता है; dsh आपको सेशन को इवेंट दर इवेंट रीप्ले करने देता है। प्लगइन सिस्टम Anthropic की स्किल्स और MCP सर्वर से आगे जाता है, क्योंकि ये सैंडबॉक्स, स्टोरेज और लूप को भी कवर करता है — Claude Code में आप एजेंट बढ़ाते हैं, dsh में आप उसे दोबारा बना सकते हैं। harness, DeepSeek के अलावा दूसरे मॉडल भी लेता है, जबकि Claude Code, Claude पर बँधा रहता है, जब तक आप अनऑफ़िशियल प्रॉक्सी से न जाएँ।

दूसरी तरफ़, Claude Code के पास परिपक्वता है, और वो भारी पड़ती है: हज़ारों टीमों में महीनों का प्रोडक्शन, स्किल्स, हुक्स और इंटीग्रेशन का विशाल इकोसिस्टम, वो मॉडल जिनके स्कोर स्वतंत्र मूल्यांकनकर्ता जाँचते हैं, और सब्सक्रिप्शन एक्सेस जो बिलिंग के झटकों से बचाता है, जबकि dsh हर token का बिल भेजता है।

dsh वर्ज़न 0.1 का डेवलपर प्रिव्यू है, और README बड़े अक्षरों में कहता है कि कम्पैटिबिलिटी तोड़ने वाले बदलाव आएँगे। पर Anthropic API कम्पैटिबिलिटी का मतलब है कि आपको एक पक्ष चुनना ही नहीं है: अपना harness रखिए और वर्कफ़्लो V4 Pro पर मोड़िए, या जो मॉडल आप पहले से चलाते हैं उससे dsh आज़माइए। dsh अब तक का सबसे भरोसेमंद चैलेंजर है जिसका Claude Code ने सामना किया — और ये 0.1 चैलेंजर है एक बैठे चैंपियन के सामने।

माइग्रेट करने से पहले के जाल

कुछ भी अनइंस्टॉल करने से पहले तीन सीमाएँ तौलनी हैं।

पहली, dsh एक डेवलपर प्रिव्यू है जो बिना चेतावनी कम्पैटिबिलिटी तोड़ता है, तो इस हफ़्ते लिखा प्लगइन अगले महीने शायद लोड न हो। आज इस पर रोज़ का वर्कफ़्लो बनाना मतलब उसे नियमित सुधारना मान लेना।

दूसरी, V4 Pro का हर बेंचमार्क ख़ुद-घोषित है। कोई स्वतंत्र पुनरुत्पादन नहीं, कोई घोषणा पेज नहीं, आँकड़े जो एक WeChat ग्रुप से निकले। वो सही हो सकते हैं, पर DeepSeek के बाहर अभी कोई नहीं जानता।

तीसरी, जो कीमत चर्चा में है वो उधार के समय पर है। 16 अगस्त से टाइम-स्लॉट बिलिंग आउटपुट को पीक पर $3.96 प्रति मिलियन तक ले जाती है — लॉन्च दिन की कीमत का साढ़े चार गुना। dsh आपको एजेंट के आर्किटेक्चर पर पूरी आज़ादी देता है और लगभग कोई गारंटी नहीं कि एक महीने बाद क्या सच रहेगा। अगर आपका एजेंट स्टैक आपका कारोबार चलाता है, तो ये हफ़्ता उसे हिलाने का नहीं।

तो, माइग्रेट करें या नहीं?

एक दिन अंदर रहने के बाद हमारी राय तीन प्रोफ़ाइल में बँटती है। अगर आप harness या एजेंट टूलिंग बनाते हैं, इस हफ़्ते dsh इंस्टॉल कीजिए: ऑल-प्लगइन आर्किटेक्चर और रीप्ले होने वाला लॉग अभी की दो सबसे दिलचस्प सोच हैं, और एक npx कमांड से राय बन जाती है। अगर आप बस एजेंट कामों पर छोटा API बिल चाहते हैं, V4 Pro किसी साइड प्रोजेक्ट पर टेस्ट कीजिए — पर 16 अगस्त की दरों से हिसाब लगाइए, और प्रोडक्शन मोड़ने से पहले स्कोर की स्वतंत्र पुष्टि का इंतज़ार कीजिए।

अगर Claude Code आपका रोज़ का काम चलाता है, उसे रखिए। इस लॉन्च में कुछ नहीं जो चलते टूल से उस 0.1 पर माइग्रेट करना जायज़ ठहराए जो टूटन का वादा करती है। अच्छी ख़बर ये कि ये हमला सबको हिलने पर मजबूर करेगा: आप जिस भी एजेंट पर हों, उसकी कीमत गिरने का अब असली मौक़ा है।

स्रोत

अक्सर पूछे जाने वाले सवाल

DeepSeek Harness (dsh) क्या है?
DeepSeek Harness, छोटा नाम dsh, एक ओपन सोर्स कोडिंग एजेंट है जिसे DeepSeek ने 13 अगस्त 2026 को MIT लाइसेंस के तहत जारी किया। यह Claude Code का DeepSeek समकक्ष है, और एक एवरीथिंग-इज़-अ-प्लगइन आर्किटेक्चर पर बना है जहाँ मॉडल, टूल्स, सैंडबॉक्स, स्टोरेज और इंटरफ़ेस तक कॉन्फ़िगरेशन में बदले जा सकते हैं।
एजेंट harness क्या होता है?
harness वो मशीनरी है जो एक AI मॉडल के चारों ओर होती है ताकि वो आपके कंप्यूटर पर काम कर सके: वो लूप जो कॉल्स जोड़ता है, वो टूल्स जो मॉडल इस्तेमाल कर सकता है, कॉन्टेक्स्ट मैनेजमेंट, परमिशन, और इंटरफ़ेस। मॉडल तय करता है, harness चलाता है — Claude Code, Claude के लिए Anthropic का harness है, और Codex, GPT के लिए OpenAI का।
DeepSeek Harness कैसे इंस्टॉल करें?
`npx @deepseek-ai/dsh web` चलाइए और लोकल पोर्ट 3080 पर एक वेब इंटरफ़ेस खुल जाता है। शुरू करने के लिए न अकाउंट चाहिए न इंस्टॉलर, और रेपो को pnpm से चार कमांड में सोर्स से भी बनाया जा सकता है।
क्या DeepSeek V4 Pro, Claude से बेहतर है?
DeepSeek लगभग बराबरी का दावा करता है: SWE-bench Verified पर करीब 80.6% बनाम Claude Opus 4.6 का 80.8%, और रफ़्तार में 83 token प्रति सेकंड बनाम 52, हालाँकि Artificial Analysis इंडेक्स पर Opus 5, 63 से 53 आगे है। इनमें से कोई भी स्कोर अब तक स्वतंत्र रूप से दोहराया नहीं गया — सारे छपे आँकड़े DeepSeek से ही आते हैं।
DeepSeek V4 Pro, Claude से कितना सस्ता है?
लॉन्च कीमत पर ($0.435/M इनपुट, $0.87/M आउटपुट) V4 Pro इनपुट पर Claude Opus 5 से करीब 11 गुना और आउटपुट पर 28 गुना सस्ता है। 16 अगस्त 2026 से पीक/ऑफ़-पीक बिलिंग कीमत को इनपुट पर $0.66–$1.32 और आउटपुट पर $1.98–$3.96 तक ले जाती है, जिससे सबसे ख़राब दर पर भी ये Opus 5 से करीब 4 गुना सस्ता रहता है।
क्या मुझे Claude Code से DeepSeek Harness पर जाना चाहिए?
रोज़ के प्रोडक्शन काम के लिए अभी नहीं। dsh 0.1 डेवलपर प्रिव्यू है जिसका README कम्पैटिबिलिटी तोड़ने वाले बदलावों की चेतावनी देता है, और V4 Pro के बेंचमार्क सत्यापित नहीं हैं। अगर आप एजेंट टूलिंग बनाते हैं तो इसे इंस्टॉल करना सार्थक है, और Anthropic API कम्पैटिबिलिटी की वजह से V4 Pro साइड प्रोजेक्ट पर टेस्ट करने लायक़ है।

मिलते-जुलते वीडियो