AIDive

DeepSeek Claude Code'a saldırdı: Harness + V4 Pro

AIDive tarafından · Yayın

Kodlama agent'larıYapay zekâ modelleri

DeepSeek aynı gün iki kez vurdu

13 Ağustos 2026'da DeepSeek aynı anda iki ürün çıkardı. DeepSeek Harness, MIT lisanslı açık kaynak bir kodlama ajanı ve doğrudan Claude Code'u hedefliyor — Bloomberg bunu açıkça Anthropic'e meydan okuma olarak andı. Aynı gün DeepSeek V4 Pro (build 0813) genel kullanıma açıldı: bir milyon token'lık context window, girişte milyon token başına yarım dolardan az fiyatla.

Piyasa hemen fark etti. Modelin Hacker News gönderisi bir günde 990 puanı aştı, Harness deposu ise şimdiden 21.000'den fazla GitHub yıldızında. Bir araç artı bir model, aynı gün çıktı — Claude Code'u Claude Code yapan formül tam olarak bu.

Tek bir npx komutuyla DeepSeek Harness'ı kurduk, dokümanları okuduk ve DeepSeek'in yayımladığı her sayıyı inceledik. Bu yazı, "her şey bir eklenti" mimarisini, benchmark ve fiyatta V4 Pro'nun Claude karşısındaki değerini ve kimin geçmesi kimin beklemesi gerektiğini ele alıyor.

Ajan harness'ı aslında nedir

Harness, modelin bilgisayarınızda gerçekten çalışabilmesi için etrafını saran tüm makinedir: çağrıları zincirleyen döngü, modelin kullanabildiği araçlar, bağlam yönetimi, izinler ve arayüz. Model karar verir, harness yürütür — kısa bir cümle ama tüm iş bölümü bu.

Claude Code'a bir komut yazdığınızda model diskinize kendisi hiç dokunmaz. Harness'tan dosya okumasını, komut çalıştırmasını ya da test başlatmasını ister; harness bunun izinli olup olmadığını kontrol eder, çalıştırır ve sonucu geri verir. Her kodlama ajanı böyle çalışır.

Claude Code, Claude modellerine bağlı Anthropic harness'ıdır; Codex ise GPT'ye bağlı OpenAI harness'ı. DeepSeek'in resmisi hiç olmadı — modelleri başkasının araçlarında koştu. 13 Ağustos'un değiştirdiği şey bu: DeepSeek artık sadece motoru değil, tüm arabayı satıyor.

Her şey bir eklenti: dsh'nin içi

DeepSeek Harness — dokümanlarda kısaca dsh — tek bir ana fikrin üzerine kurulu: her şey bir eklenti. Bu bir pazarlama sloganı değil, gerçek mimarinin kendisi. Modeller eklenti. Araçlar eklenti. Skill'ler, oturumlar, sandbox'lar, depolama, döngüler, zamanlama ve hatta arayüz: hepsi eklenti. Resmî dokümanlar, herhangi bir yeteneği config içinde seçebileceğinizi, değiştirebileceğinizi ya da genişletebileceğinizi, harness kaynak koduna dokunmadan söylüyor.

Altta her şey Cordis'e dayanıyor: DeepSeek'in birleştirilebilirlik üzerine bir makalede anlattığı çekirdek. Projenin ağırlığı gerçek: 12.000'den fazla commit, bir Discord sunucusu ve GitHub'da özel bir dsh-plugin etiketi — topluluk eklentileri şimdiden görünüyor. Pratik sonuç, harness'ın donmuş bir çekirdeğinin olmaması: başka bir sandbox, başka bir oturum deposu ya da başka bir model isterseniz, kodu değil config'i değiştirirsiniz.

Kurulum tek komut: npx @deepseek-ai/dsh web, yerelde 3080 portunda bir web arayüzü açıyor. Başlamak için hesap gerekmiyor, kurulum aracı da — npm paketi yeter. Kaynaktan derlemeyi tercih ederseniz, tüm depo klonlanıp pnpm ile dört komutta derleniyor.

dsh dört çalışma modu getiriyor ve mimari bahsin görünür olduğu yer burası:

  • Standard modu tam kodlama ajanı: dosya düzenleme, shell, arama ve planlama — Claude Code'un doğrudan karşılığı.
  • Code modu modele, tek tek araç çağrısı zincirlemek yerine çok adımlı işleri kendi orkestre eden TypeScript ürettiriyor; bu da uzun görevlerde gidiş-dönüşü, gecikmeyi ve token'ı kısıyor.
  • Minimal modu ajanı bash ve bir dosya düzenleyiciye indiriyor, çoğunlukla çıplak modeli ölçmek için.
  • Creator modu kendi preset'lerinizi kurmak için; çalışma zamanı incelemesi ve canlı eklenti denemeleriyle.

Son parça izlenebilirlik. Modelin gördüğü her şey, yalnızca ekleme yapılan bir oturum log'una gidiyor — sadece sona ekleyebilirsiniz, geçmişi asla yeniden yazamazsınız. O log harness'ın doğruluk kaynağı; oradan devam edebilir, fork'layabilir, arayabilir ya da herhangi bir oturumu oynatabilirsiniz. Ajanınız kırk ikinci araç çağrısında raydan çıkınca transkripti eşelemiyorsunuz; oturumu kırılma noktasına kadar oynatıp modelin tam olarak ne gördüğünü görüyorsunuz. Bu işletim sistemi düşüncesi, bir API sarmalayıcısı daha değil.

V4 Pro: harness'ın arkasındaki motor

DeepSeek V4 Pro, build 0813, önizlemeden çıkıp genel kullanıma giren model ve DeepSeek API ya da OpenRouter ile şimdiden kullanılabiliyor. Bir mixture-of-experts modeli: her token'da ağın yalnızca bir kısmı etkinleşiyor, böylece büyük model kapasitesini küçük model hesap maliyetiyle alıyorsunuz. Teknik özellikler: bir milyon token'lık context window, 384.000'e kadar çıktı token'ı, araç çağrıları ve JSON çıktısı.

Bu hikâyede bir detay iki kat sayıyor: DeepSeek API, Anthropic API uyumluluğunu duyuruyor. Claude ile konuşmak için yazılan bir araç, temel URL ve anahtar değiştirilerek V4 Pro ile konuşabiliyor.

Benchmark'larda DeepSeek zirveye yakın skorlar iddia ediyor:

Benchmark DeepSeek V4 Pro Claude
SWE-bench Verified ~%80,6 (Max varyantı) %80,8 (Opus 4.6)
Terminal Bench 2.1 iddia edilen galibiyet Opus 4.8
Artificial Analysis endeksi 53 63 (Opus 5)
Hız (token/saniye) 83 52

Ama bu sayıların hepsini nasıl okuduğunuzu değiştiren bir detay var: tek bir skor bile henüz üçüncü tarafça tekrarlanmadı. Dolaşımdaki her şey DeepSeek'e ya da DeepSeek'i kopyalayan yazılara dayanıyor. Simon Willison, benchmark'ların ilk olarak DeepSeek'in resmî WeChat grubunda dolaştığını, moderatörlerin sildiği bir Reddit gönderisine kopyalandığını ve Hacker News'te ASCII tablo olarak bittiğini anlatıyor. Resmî bir duyuru sayfası olmadığını, açık ağırlıkların da doğrulanmadığını ekliyor — gerçi nisandaki V4 Pro ve temmuzdaki V4 Flash Hugging Face'e düştü, yani bir yayın olası görünüyor. Pelikan testi en azından sıra dışı bir şey gösterdi: üç akıl yürütme seviyesi, üç kökten farklı pelikan üretti. Model muhtemelen çok iyi; ama şu an bunu söyleyen yalnızca DeepSeek.

Claude ile fiyat farkı

DeepSeek en sert fiyatta vuruyor. Lansmanda V4 Pro, DeepSeek API üzerinden milyon giriş token'ı başına 0,435 dolar ve milyon çıktı token'ı başına 0,87 dolar.

Model Giriş ($/milyon token) Çıkış ($/milyon token)
DeepSeek V4 Pro (lansman tarifesi) 0,435 $ 0,87 $
Claude Sonnet 5 2 $ 10 $
Claude Opus 5 5 $ 25 $
Claude Fable 5 10 $ 50 $

Lansman tarifesiyle V4 Pro girişte Opus 5'ten yaklaşık 11 kat, çıkışta 28 kat ucuz. Anthropic'in ucuz seçeneği Sonnet 5 bile dört ila on bir kat pahalı kalıyor.

50.000 token giriş ve 15.000 çıkışlık tipik bir kodlama ajanı oturumunda Opus 5 yaklaşık 0,62 dolar, V4 Pro lansman tarifesiyle yaklaşık 0,035 dolar tutuyor. Bir ajan için gizli kalem önbellek, çünkü harness her döngü turunda aynı bağlamı yeniden gönderiyor: önbellek isabeti Opus 5'te milyon başına 0,50 dolar, DeepSeek'te yaklaşık 0,0036 dolar.

Ancak bu taban fiyatın bir son kullanma tarihi var ve yakın. 16 Ağustos'tan itibaren — lansmandan üç gün sonra — API yoğun ve yoğun olmayan saat faturalamasına geçiyor:

Tarife dönemi Giriş ($/milyon) Çıkış ($/milyon)
Lansman (16 Ağustos'a kadar) 0,435 $ 0,87 $
Yoğun olmayan saat 0,66 $ 1,98 $
Yoğun saat (UTC 1–4 ve 6–10) 1,32 $ 3,96 $

Bu hafta herkesin karşılaştırdığı fiyat en az yarı yarıya artıyor, çıkışta ise dört katından fazla. En kötü tarifede bile V4 Pro, Opus 5'ten neredeyse dört kat ucuz kalıyor, yani argüman ayakta — ama Hacker News'te dolaşan sayı üç günde biten bir promosyon. Takvim ajanlar için de önemli: yoğun saatler Çin mesaisini izliyor, dolayısıyla gece cron'ları yoğun olmayana denk gelirken öğleden sonra kodlama yoğun saatleri yiyor.

Claude Code'un yerini alabilir mi?

Mimaride dsh'nin, Claude Code'un olmayan argümanları var. Ajanınız raydan çıkınca Claude Code transkripti eşelemenize izin verir; dsh oturumu olay olay oynatmanıza izin verir. Eklenti sistemi Anthropic'in skill'leri ve MCP sunucularından öteye gider, çünkü sandbox'ı, depolamayı ve döngünün kendisini de kapsar — Claude Code'da ajanı genişletirsiniz, dsh'de onu yeniden kurabilirsiniz. Harness, DeepSeek dışındaki modelleri de kabul ediyor; Claude Code ise resmî olmayan proxy'lerden geçmediğiniz sürece Claude'a kilitli kalıyor.

Öte yandan Claude Code'un olgunluğu var ve ağır basıyor: on binlerce ekipte aylarca üretim, skill, hook ve entegrasyonlardan oluşan devasa bir ekosistem, skorlarını bağımsız değerlendiricilerin doğruladığı modeller ve faturalama sürprizlerinden koruyan abonelik erişimi. dsh ise her token'ı faturalıyor.

dsh, 0.1 sürümünde bir developer preview ve README, uyumluluğu bozan değişiklikler olacağını büyük harfle yazıyor. Ama Anthropic API uyumluluğu, aslında bir taraf seçmek zorunda olmadığınız anlamına geliyor: harness'ınızı koruyup bazı iş akışlarını V4 Pro'ya yöneltin ya da hâlihazırda kullandığınız modelle dsh'yi deneyin. dsh, Claude Code'un karşılaştığı en inandırıcı meydan okuyucu — ve koltuktaki şampiyona karşı 0.1'lik bir meydan okuyucu.

Geçmeden önceki tuzaklar

Bir şeyi kaldırmadan önce tartılacak üç sınır var.

Birincisi, dsh uyumluluğu habersiz bozan bir developer preview: bu hafta yazdığınız eklenti gelecek ay yüklenmeyebilir. Günlük iş akışınızı bugün buna kurmak, düzenli onarımı kabul etmek demek.

İkincisi, her V4 Pro benchmark'ı kendi beyanı. Bağımsız tekrar yok, duyuru sayfası yok, bir WeChat grubundan çıkan sayılar. Doğru olabilirler ama DeepSeek dışında bunu henüz kimse bilmiyor.

Üçüncüsü, gürültü koparan fiyat ödünç zamanda. 16 Ağustos'tan itibaren zaman dilimli faturalama çıktıyı yoğun saatte milyon başına 3,96 dolara çıkarıyor — lansman günü fiyatının dört buçuk katı. dsh size ajanınızın mimarisi üzerinde tam özgürlük veriyor ve bir ay sonra neyin doğru kalacağına dair neredeyse hiç garanti vermiyor. Ajan yığınınız işinizi çeviriyorsa, bu hafta taşınma haftası değil.

Peki, geçmeli mi geçmemeli mi?

Bir gün içeride kaldıktan sonraki okumamız üç profile iniyor. Harness ya da ajan araçları yapıyorsanız bu hafta dsh'yi kurun: tümüyle eklentili mimari ve tekrar oynatılabilir log şu an ortadaki en ilginç iki fikir, ve tek bir npx komutu size fikir verir. Sadece ajan görevlerinde daha küçük bir API faturası istiyorsanız V4 Pro'yu bir yan projede deneyin — ama hesabı 16 Ağustos tarifesiyle yapın ve prodüksiyonu yönlendirmeden önce skorların bağımsız onayını bekleyin.

Claude Code günlük işinizi çeviriyorsa onu koruyun. Bu lansmanda, çalışan bir aracı kırılma vaat eden 0.1'e taşımayı haklı çıkaran hiçbir şey yok. İyi haber: bu saldırı herkesi harekete zorluyor — hangi ajanı kullanırsanız kullanın, fiyatının düşme şansı artık gerçek.

Kaynaklar

Sık sorulan sorular

DeepSeek Harness (dsh) nedir?
DeepSeek Harness, kısaca dsh, DeepSeek'in 13 Ağustos 2026'da MIT lisansıyla yayımladığı açık kaynak bir kodlama ajanıdır. Claude Code'un DeepSeek karşılığı olup, modellerin, araçların, sandbox'ların, depolamanın ve hatta arayüzün config içinde değiştirilebildiği her-şey-bir-eklenti mimarisi üzerine kurulu.
Ajan harness'ı nedir?
Harness, bir yapay zekâ modelinin bilgisayarınızda çalışabilmesi için etrafını saran makinedir: çağrıları zincirleyen döngü, modelin kullanabildiği araçlar, bağlam yönetimi, izinler ve arayüz. Model karar verir, harness yürütür — Claude Code, Claude için Anthropic'in harness'ı; Codex ise GPT için OpenAI'nin harness'ı.
DeepSeek Harness nasıl kurulur?
`npx @deepseek-ai/dsh web` komutunu çalıştırın; yerelde 3080 portunda bir web arayüzü açılır. Başlamak için hesap ya da kurulum aracı gerekmiyor, depo pnpm ile dört komutta kaynaktan da derlenebiliyor.
DeepSeek V4 Pro, Claude'dan iyi mi?
DeepSeek neredeyse eşitlik iddia ediyor: SWE-bench Verified'da yaklaşık %80,6'ya karşı Claude Opus 4.6'nın %80,8'i ve hızda saniyede 83 token'a karşı 52; Artificial Analysis endeksinde ise Opus 5 63'e 53 önde. Bu skorların hiçbiri henüz bağımsız olarak tekrarlanmadı — yayımlanan tüm sayılar DeepSeek'in kendisine dayanıyor.
DeepSeek V4 Pro, Claude'dan ne kadar ucuz?
Lansman fiyatıyla (girişte milyon başına 0,435 dolar, çıkışta 0,87 dolar) V4 Pro girişte Claude Opus 5'ten yaklaşık 11 kat, çıkışta 28 kat ucuz. 16 Ağustos 2026'dan itibaren yoğun/yoğun olmayan saat faturalaması fiyatları girişte 0,66–1,32 dolara, çıkışta 1,98–3,96 dolara taşıyor; en kötü tarifede bile Opus 5'ten yaklaşık 4 kat ucuz kalıyor.
Claude Code'dan DeepSeek Harness'a geçmeli miyim?
Günlük üretim işi için henüz değil. dsh, README'si uyumluluğu bozan değişiklikler konusunda uyaran 0.1 developer preview ve V4 Pro'nun benchmark'ları doğrulanmış değil. Ajan araçları yapıyorsanız kurmaya değer; V4 Pro ise Anthropic API uyumluluğu sayesinde yan projelerde denemeye değer.

İlgili videolar