AIDive

10 Claude Code modunu test ettim: 3'ü kalıyor

AIDive tarafından · Yayın

Kodlama agent'larıYapay zekâ güvenliği

Giriş: on mod, üçü kalıyor

Claude Code modları, plugin'lerin içinde gelen ve Claude Code'un arayüzünü yeniden çizebilen ya da yaptığı işi yeniden yazabilen TypeScript fonksiyonlarıdır. Ekim başındaki lansmanlarından bir gün sonra üç ayrı video turu geliştiricilere bunlardan ondan tanesini kurmalarını söyledi. Bu yaratıcılardan ikisi kamera önünde bazı modların hiçbir şey kazandırmadığını itiraf ediyor, ama hiçbiri tek bir modu bile ölçmedi. Bu test ölçüyor: abartılan on modun her biri gerçek bir haftalık işte çalıştırıldı; her biri için ek yük, kazanç ve tut ya da sil kararını gösteren bir sayı var. Sonuç baştan şu: on modun yalnızca üçü çalışan bir geliştiricinin makinesinde yer hak ediyor ve bunlardan biri her cevapta sessizce token harcıyor.

Dalga ve ne çalıştırdık

Anthropic'in kendi tanımı tek nefeste söylenir: mod, bir olaya bağlanan bir fonksiyondur ve o olaydan önce, sonra ya da onun yerine çalışabilir. Olay; bir tool call, gönderilmiş bir prompt ya da arayüzün çizilen bir parçası olabilir. Modlar düz TypeScript'tir ve diğer her şey gibi kurduğunuz bir plugin'in içinde gelir.

Lansman tweet'i yaklaşık bir günde dört milyon görüntülemeyi aştı; yirmi bin beğeni aldı ve yer imi sayısı cevap ile yeniden paylaşımın toplamından fazlaydı. Lansmandan iki gün sonra bir topluluk kataloğu, yüzlerce depoda bin taneden fazla herkese açık modu çoktan taramıştı.

Bu testin tezgahı gerçek bir haftalık iş: dört projede 85 oturum, neredeyse 900 prompt ve 6.000'e yakın tool call. Her mod, neye bağlandığını ve nelere dokunabildiğini listeleyen doğrulayıcının denetiminden geçti ve her biri aynı görevi temiz bir referansa karşı, güncel sürümde, aynı makinede çalıştırdı.

Başlıktaki ayrım: on modun altısı çalışma anında ölçülebilir hiçbir maliyet getirmiyor, üçü gerçek zamana ya da gerçek token'a mal oluyor, biri ise verdiği tek sözü bozuyor.

Süs katmanı, ölçüldü

Sessiz altılı bağlantının gürültüsü içinde kalıyor. Hedef göstergesi, depo ısı haritası, uçuş kaydedici, model yönlendirici, oturum yer imleri ve otomatik devir; hepsi yaklaşık dört saniyelik bir referans görevde çeyrek saniye kazanç ile saniyenin beşte biri kayıp arasında kalıyor.

Mod Çalışma anı farkı Notlar
Hedef göstergesi gürültü içinde süs paneli
Depo ısı haritası gürültü içinde okunan dosyaları aydınlatır
Uçuş kaydedici gürültü içinde turun canlı zaman çizelgesi
Model yönlendirici gürültü içinde subagent'larda karşılığını verir, karara bakın
Oturum yer imleri gürültü içinde geniş yetki alanı
Otomatik devir ~70 ms boşta bağlam eşiğinde tek bir devir yazar

Harika görünüyorlar ve hiçbir şey bozulmadı: her yapılandırmanın her çalıştırması görevi doğru bitirdi. Headless modda hiçbir maliyetleri yok, çünkü çizilecek bir şey yok; terminalde bu paneller saniyede otuz kereye kadar yeniden çiziliyor, yani süs katmanının dürüst maliyeti token değil dikkattir.

Doğrulayıcının denetimi işin şakası bittiği yer. Yer imleri modu modeli çağırabiliyor, makinenizde işlem başlatabiliyor, dosya yazabiliyor ve yapılandırma yollarını ortamdan okuyor. Hiçbiri gizli değil ve hiçbiri kötü niyetli değil, ama bir yer imi için çok fazla erişim. Dört mod burada elenir: hedef göstergesi, ısı haritası ve uçuş kaydedici ölçülen sıfır faydayla süs olduğu için, yer imleri modu ise kazandığından fazlasını istediği için.

Amiral gemisi her turda fatura çıkarıyor

Öneri motoru, her videonun ilk gösterdiği moddur: cevabınız biter, yazı alanının üstünde üç prompt önerisi belirir, bir rakama basarsınız ve taslak kendiliğinden dolar. Mekanizmayı kendi yazarı belgelemiş: turunuz tamamlandığında, bu öneriler için bir modele sormak üzere oturumu çatallıyor ve çatal oturumun prompt önbelleğini paylaştığı için maliyeti kısa bir cevap kadar oluyor. Turlar o satırdan hiç söz etmiyor.

Tezgahta ölçülen: nitelikli cevap başına yaklaşık 250 ek çıktı token'ı ve neredeyse üç saniye ek duvar saati süresi; nitelikli cevap da neredeyse her cevap, yani yaklaşık seksen karakterden uzun her şey. Çatalın bir yüzey kapısı da yok. Öneriler yalnızca terminalde çizilir, ama çatal her yerde tetiklenir; hiçbir şeyin çizilemediği headless çalıştırmalar dahil.

Mod Ölçülen maliyet Ne zaman tetiklenir
Öneri motoru nitelikli cevap başına ~250 çıktı token'ı + ~2,9 sn ~80 karakterden uzun her cevap, headless dahil
Önbellek koruyucu tur başına ~1,5 sn, artı ısıtma modunda model çağrıları her tur, saatlerce ısıtma

Önbellek koruyucunun şekli aynı: tur başına yaklaşık bir buçuk saniye ve prompt önbelleğiniz soğumasın diye saatlerce küçük model çağrıları harcayan bir ısıtma modu. Abonelik planında önbellek penceresi zaten bir saat, yani planın büyük ölçüde çözdüğü bir sorun için ping ödüyorsunuz. İkisi de belgelenmiş maliyetleri olan dürüst tasarımlar, ikisi de kurulum listelerinin hiç fiyatlamadığı, her tura konan birer vergi ve ikisi de makineden çıkıyor.

Mod mu hook mu, aynı iş

Claude Code'un zaten hook'ları vardı: ayarlarınızda, aynı olaylarda tetiklenen bir kabuk betiği. Belgeler seçimi tablonun tek bir satırında yanıtlıyor: mod arayüz ve olayları yeniden yazmak içindir; hook ise elinizde zaten olan bir betikle engellemek, izin vermek ya da loglamak içindir.

Ölçülebilir fark işlem başlatma. Ayarlardaki bir hook her tool call'da yepyeni bir işlem başlatır. Bu makinede zamanlandığında, hiçbir şey yapmayan bir kabuk hook'u yaklaşık 8 ms, Node başlatan bir hook ise yaklaşık 43 ms tutuyor; her tek çağrıda, betik daha bir şey yapmadan önce. Tezgah haftasının 5.993 tool call'ında bu, dört dakikayı aşan saf yorumlayıcı başlatma demek. Mod bunların hiçbirini ödemez: handler'ı motorun kendi işleminin içinde çalışır ve motorun logu bu geçişin yaklaşık bir milisaniyede oturduğunu gösteriyor.

Handler Çağrı başına maliyet 5.993 çağrılık bir hafta
Kabuk hook'u (boş) ~8 ms ~48 sn
Node hook'u (boş) ~43 ms ~4,3 dk
Mod (işlem içi) ~1 ms ~6 sn

Sahada görülen tek gerçek geçiş raporu da aynı şeyi söylüyor: yirmi yedi kabuk hook'u beş moda indirildi ve her çağrıdaki işlem başlatma bedeli onlarla birlikte yok oldu. Geriye kalan kural: arayüz ya da olay yeniden yazma, mod; güvendiğiniz bir betikle engelleme, izin verme ya da loglama, hook (başlatma maliyeti ancak binlerce çağrıda önem kazanır); sürekli tekrarladığınız bilgi, skill. Okuduğunuz bir hook, okumadığınız bir moddan iyidir.

Hiçbir şey yapmayan koruyucu

Olabilecek en basit güvenlik modu, her kabuk komutunu izleyen bir koruyucu ve bu bilerek çökecek şekilde yazıldı. Claude Code'dan bir işaret dosyası oluşturması istendi; koruyucu hata fırlattı; komut yine de çalıştı ve dosya göründü. Bu bir hata değil, belgelenmiş varsayılan: bir hook hata fırlattığında, zaman aşımına uğradığında ya da yanlış biçimde döndüğünde Claude Code onu atlayıp devam eder. Bozuk bir süs oturumu çökertmemeli, ama bozuk bir koruyucu sessizce açık kalır; kimsenin okumadığı bir hata ayıklama logunda tek bir satırla.

Çözüm, deny döndüren tek bir catch handler. Aynı çöken koruyucu catch ile birlikte komutu reddediyor ve hatanın adını koyuyor. Tek bir satır, bir koruyucunun açık mı kapalı mı kalacağına karar veriyor; belgeler tam bu kalıbı sunuyor ve neredeyse kimse kurmuyor.

Bir topluluk ekibi vakaları güncel sürümde yeniden çalıştırdı ve modelin söylediğine göre değil, işaret dosyalarına göre karar verdi. Catch kalıbı üç çalıştırmanın üçünde de kapalı kaldı ve tek bir yol hâlâ sessizce bozuk: çağrı zaten iletildikten sonra döndürülen bir deny aracı durdurmuyor. Modele yazma işleminin başarısız olduğu söylenirken dosya üç kez üçte indi.

Bu sorunu adlandıran saha raporu günlerce etkin, yüklü ve hiçbir şey yapmayan bir koruyucu çalıştırdı, çünkü eski kalmış bir bayrak onu altından kapatmıştı: sıfırda takılı bir sayacın üstünde üç yeşil durum rozeti. Tıpkı sağlık gibi görünen bir sessizlik.

Çakışma koruyucusu ilk tut kararını hak ediyor. Gerçek bir sorunu çözüyor, aynı dosyayı düzenleyen iki açık sohbeti, ve hata biçimi gürültülü: bir iletişim kutusunda soruyor, asla sessizce izin vermiyor. Düzenlemelerde yaklaşık yarım saniyeye mal oluyor ve prompt'a hiçbir şey eklemiyor. Kurun ve yine de catch handler'ını verin.

Yapıştırdığınızda ne yetkisi veriyorsunuz

Anthropic bunu lansman gününde düz sözlerle söylüyor: modlar makinenize Claude Code'un kendisiyle aynı erişimle çalışır. Sandbox içinde değildirler; onları bilgisayarınıza kuracağınız herhangi bir kod gibi kurun. Somut olarak bir mod makinenizde sizin adınıza hareket edebilir: API anahtarlarının durduğu ortamı ve ayarları okuyabilir; her prompt'u ve her tool call'ı görebilir; onları yeniden yazabilir; siz daha sorulmadan bir tool call'ı onaylayabilir; ve planınızın kullanım hakkını kendi model çağrılarına harcayabilir.

Dikkatli kullanıcıları bile iki tuzak yakalıyor. İzin kuralları Claude'un tool call'larını yönetir, modun kendi çağrılarını değil: Claude'a bir env dosyasını yasaklasanız bile mod o dosyayı kendi dosya erişimiyle doğrudan okuyabilir ya da okuyan bir program başlatabilir. Ağ politikasında da aynı kenar var: web trafiğini kapatırsanız modun kendi fetch çağrıları reddedilir, ama modun başlattığı bir alt işlem ağa tam erişimle ulaşır. Her şeyden önce yüklenen yerleşik bir koruyucu mod var, ama yalnızca yönetilen makinelerde ve Team ya da Enterprise koltuklarında; kişisel abonelikteki tek kişilik bir koltuk bunun hiçbirini almıyor.

Bunların hiçbiri teorik değil. Bir kullanıcı lansmandan günler sonra bir kavram kanıtı yayımladı: düğmesi bir program başlatan ve ana dizine yazan bir mod, katalogdan hiçbir uyarı olmadan kuruldu. Ve haklı olduğu nokta ortada: katalog bir uygulama mağazası gibi görünüyor, bu da olmayan bir incelemeyi akla getiriyor. Ayrı bir hook hatası subagent yalıtımını bir gün boyunca bozdu; bakımcı bunu büyük bir gaf olarak niteledi ve bir sürüm sonra düzeltti.

Kataloğun bin taneden fazla herkese açık mod üzerindeki kendi taraması: dört yüzden fazlası ana makinede işlem başlatıyor, dörde yakın yüzü dosya okuyor ve üç yüzden fazlası her tool call'ı görüyor. Kataloğun kendi uyarısı doğru çerçeve: bu bir ayak izi, bir hüküm değil; bir PR takipçisinin git çalıştırması gerekir. Disiplin iki dakikaya mal oluyor: bir şeyi etkinleştirmeden önce doğrulayıcıyı çalıştırın ve çıkışları bilin; tek oturum için güvenli mod, kurulu her hook'u kalıcı olarak durduran tek bir ayar.

Üçünü tut, yedisini sil

On modun üçü yerini hak ediyor: çakışma koruyucusu, model yönlendirici ve otomatik devir.

Mod Karar Arkasındaki sayı
Çakışma koruyucusu tut düzenlemelerde ~0,5 sn, gürültülü hata verir, prompt'a hiçbir şey eklemez
Model yönlendirici tut subagent ucuz modelde faturalanır, üçte bir fiyat
Otomatik devir tut 70 ms hiçbir şey, bağlam eşiğinde tek bir devir yazımı
Öneri motoru sil her nitelikli cevapta ~250 çıktı token'ı + ~2,9 sn
Önbellek koruyucu sil tur başına ~1,5 sn, 1 saatlik önbellek penceresine karşı ısıtma pingleri
Kayıt modu sil ekranı maskeler ama diski maskelemez
Hedef göstergesi sil süs, ölçülen sıfır fayda
Depo ısı haritası sil süs, ölçülen sıfır fayda
Uçuş kaydedici sil süs, ölçülen sıfır fayda
Oturum yer imleri sil işinin çok ötesinde erişim

Model yönlendiricinin bir makbuzu var: büyük modeldeki bir oturum tek bir subagent başlattı ve çalıştırmanın kendi kullanım dökümü, subagent'ın aynı küçük iş için üçte bir fiyatla ucuz modelde faturalandığını gösterdi. Subagent'ın yoğun olduğu haftalarda bu gerçek para. Otomatik devir, karşılığını verdiği ana kadar hiçbir şeye mal olmuyor: yetmiş milisaniyelik boşta ek yük ve bir bağlam eşiğinden sonra soğuk başlangıç için devri bir kez yazıyor. Dalganın yaratıcılarından biri manuel devir düğmesinin gerçekten zaman kazandırmadığını itiraf ediyor; otomatik bir eşik yazımı olarak ise gerçekten kazandırıyor.

Testten geriye kalan disiplin: bir şeyi etkinleştirmeden önce doğrulayıcının denetimini okuyun, her koruyucuya catch handler'ını verin ki kapalı kalsın ve demoları maskeleyen bir moda güvenmek yerine güvenli modda kaydedin. Sınırlar gerçek: bir hafta, bir makine, bir iş yükü, küçük modelde nokta başına üç çalıştırma. Sizin üçünüz farklı olabilir, ama artık onları nasıl bulacağınızı biliyorsunuz.

Kaynaklar

Sık sorulan sorular

Claude Code modları nedir?
Modlar, Claude Code plugin'lerinin içinde gelen TypeScript fonksiyonlarıdır: bir olaya (bir tool call, gönderilen bir prompt, arayüzün çizilen bir parçası) bağlanır ve ondan önce, sonra ya da onun yerine çalışabilir. Arayüzü yeniden çizebilir ya da Claude Code'un yaptığı işi yeniden yazabilir.
Hangi Claude Code modlarını kurmaya gerçekten değer?
Gerçek işin ölçüldüğü bir haftada, abartılan on modun üçü yerini hak etti: çakışma koruyucusu (iki sohbetin aynı dosyayı düzenlemesini engeller, gürültülü hata verir), model yönlendirici (üçte bir fiyatla faturalanan bir subagent) ve otomatik devir (70 ms boşta maliyet, tek bir otomatik devir yazımı).
Claude Code modları token harcar mı?
Çoğu harcamaz, ama öneri motoru her nitelikli cevaptan sonra oturumu çatallıyor ve tur başına yaklaşık 250 çıktı token'ına ve neredeyse üç saniyelik duvar saati süresine mal oluyor; önbellek koruyucunun ısıtma modu da saatlerce küçük model çağrıları harcıyor.
Claude Code modlarını kurmak güvenli mi?
Modlar makinenize Claude Code'un kendisiyle aynı erişimle çalışır ve sandbox içinde değildir. İzin kuralları Claude'un tool call'larını yönetir, modun kendi çağrılarını değil; bu yüzden bir mod, kuralların Claude'a yasakladığı dosyaları okuyabilir ya da işlemler başlatabilir. Bir şeyi etkinleştirmeden önce doğrulayıcının denetimini çalıştırın.
Claude Code modu ile hook arasındaki fark nedir?
İkisi de aynı olaylarda tetiklenir. Hook, her tool call'da yeni bir işlem başlatma bedeli ödeyen bir kabuk betiğidir (kabukta yaklaşık 8 ms, Node'da 43 ms); modun handler'ı ise motorun işleminin içinde yaklaşık bir milisaniyede çalışır. Arayüz ya da olay yeniden yazma için mod, güvendiğiniz bir betikle engelleme, izin verme ya da loglama için hook kullanın.
Bir Claude Code koruyucu modu çökerse ne olur?
Varsayılan olarak açık kalır: Claude Code bozuk handler'ı atlar ve komut, bir hata ayıklama logunda tek bir satırla yine de çalışır. Deny döndüren bir catch handler eklemek koruyucuyu kapalı kalır hale getiriyor ve belgeler tam bu kalıbı sunuyor.

İlgili videolar