AIDive

10 Mod Claude Code Diuji: 3 Layak, 7 Hapus

Oleh AIDive · Terbit

Coding agentKeamanan AI

Intro — sepuluh mod, tiga bertahan

Mod Claude Code adalah fungsi TypeScript di dalam plugin yang bisa menggambar ulang antarmuka Claude Code atau menulis ulang apa yang dikerjakannya, dan dalam sehari setelah peluncurannya di awal Oktober, tiga tur video terpisah menyuruh developer memasang sepuluh mod. Dua kreator mengakui di depan kamera bahwa sebagian mod tidak menghemat apa pun, dan tak satu pun dari mereka mengukur satu mod pun. Tes ini mengukurnya: kesepuluh mod yang lagi hype dijalankan dalam seminggu kerja nyata, dengan angka untuk overhead, penghematan, dan vonis simpan atau hapus. Hasilnya di depan: hanya tiga dari sepuluh yang layak ada di mesin developer yang bekerja, dan salah satunya diam-diam menghabiskan token di setiap jawaban.

Gelombangnya, dan apa yang kami jalankan

Definisi resmi dari Anthropic muat dalam satu tarikan napas: mod adalah fungsi yang terpasang pada sebuah event, dan bisa jalan sebelum event itu, sesudahnya, atau menggantikannya. Event bisa berupa panggilan tool, prompt yang dikirim, atau bagian antarmuka yang sedang digambar. Mod adalah TypeScript biasa, dikirim di dalam plugin yang kamu pasang seperti plugin lain.

Tweet peluncurannya melewati empat juta tayangan dalam sekitar sehari, dengan dua puluh ribu like dan jumlah bookmark yang lebih banyak daripada reply dan repost digabung. Dua hari setelah peluncuran, sebuah katalog komunitas sudah memindai lebih dari seribu mod publik di ratusan repositori.

Bench untuk tes ini adalah seminggu kerja nyata: 85 sesi di empat proyek, hampir 900 prompt, dan hanya di bawah 6.000 panggilan tool. Setiap mod melewati audit validator, yang mencantumkan apa yang dipasangi dan apa yang bisa disentuhnya, dan setiap mod menjalankan tugas yang sama terhadap baseline bersih, di rilis terkini, di mesin yang sama.

Pembagian utamanya: enam dari sepuluh tidak punya biaya yang bisa diukur saat runtime, tiga memakan waktu atau token sungguhan, dan satu melanggar satu-satunya janji yang dibuatnya.

Tier dekorasi, diukur

Enam yang tenang itu masuk dalam batas noise koneksi. Goal meter, repo heatmap, flight recorder, model router, session bookmarks, dan auto handoff semuanya berada di antara seperempat detik lebih cepat dan seperlima detik lebih lambat, pada tugas baseline sekitar empat detik.

Mod Selisih runtime Catatan
Goal meter dalam batas noise panel dekorasi
Repo heatmap dalam batas noise menyalakan file saat dibaca
Flight recorder dalam batas noise timeline langsung dari turn
Model router dalam batas noise terbayar di subagent, lihat vonis
Session bookmarks dalam batas noise jejak kemampuan yang luas
Auto handoff ~70 ms saat idle menulis satu handoff pada ambang konteks

Tampilannya bagus, dan tak ada yang rusak: setiap run di setiap konfigurasi menyelesaikan tugas dengan benar. Di mode headless biayanya nol, karena tidak ada yang digambar; di terminal, panel ini menggambar ulang sampai tiga puluh kali per detik, jadi biaya jujur dari tier dekorasi adalah perhatian, bukan token.

Audit validator adalah titik di mana ini berhenti jadi lucu. Mod bookmarks bisa memanggil model, menjalankan proses di mesinmu, dan menulis file, dan ia membaca path konfigurasimu dari environment. Tak ada yang disembunyikan dan tak ada yang jahat, tapi itu jangkauan yang sangat luas untuk sebuah bookmark. Empat mod keluar di sini: goal meter, heatmap, dan flight recorder sebagai dekorasi dengan manfaat terukur nol, dan mod bookmarks karena meminta lebih banyak daripada yang dihasilkannya.

Mod andalan menagihmu tiap turn

Suggestion engine adalah mod yang didemokan pertama di setiap video: jawabanmu selesai, tiga saran prompt muncul di atas composer, kamu menekan angka, dan draf terisi sendiri. Mekanismenya didokumentasikan oleh penulisnya sendiri: saat turn-mu selesai, mod ini mem-fork sesi untuk meminta saran itu dari sebuah model, dan fork-nya berbagi prompt cache sesi, jadi biayanya sekitar satu balasan pendek. Tur-tur itu tidak pernah menyebut barisnya.

Terukur di bench, itu sekitar 250 token output tambahan per jawaban yang memenuhi syarat dan hampir tiga detik waktu tambahan, dan jawaban yang memenuhi syarat itu hampir setiap jawaban: apa pun yang lebih panjang dari sekitar delapan puluh karakter. Fork-nya juga tidak punya gerbang surface. Sarannya hanya digambar di terminal, tapi fork-nya menyala di mana-mana, termasuk run headless di mana tidak ada yang bisa digambar sama sekali.

Mod Biaya terukur Kapan aktif
Suggestion engine ~250 token output + ~2,9 dtk per jawaban yang memenuhi syarat setiap jawaban di atas ~80 karakter, termasuk headless
Cache keeper ~1,5 dtk per turn, plus panggilan model mode warming setiap turn, warming berjam-jam

Cache keeper punya bentuk yang sama: sekitar satu setengah detik per turn, dengan mode warming yang menghabiskan panggilan model kecil selama berjam-jam supaya prompt cache-mu tidak dingin. Di paket langganan, jendela cache sudah satu jam, jadi kamu membayar ping untuk masalah yang sebagian besar sudah diselesaikan paketnya. Keduanya desain yang jujur dengan biaya terdokumentasi, keduanya pajak di setiap turn yang tidak pernah dihargai daftar instalasi, dan keduanya dicopot dari mesin.

Mod vs hook, tugas yang sama

Claude Code sudah punya hook: skrip shell di settings-mu yang jalan pada event yang sama. Dokumentasi menjawab pilihannya dalam satu baris tabel: mod untuk antarmuka dan untuk menulis ulang event; hook untuk memblokir, mengizinkan, atau mencatat dengan skrip yang sudah kamu punya.

Perbedaan yang terukur ada di spawn proses. Hook di settings memulai proses baru di setiap panggilan tool. Diukur di mesin ini, hook shell yang tidak melakukan apa-apa memakan sekitar 8 ms dan hook yang menjalankan Node sekitar 43 ms, di setiap panggilan, sebelum skripnya mengerjakan apa pun. Dari 5.993 panggilan tool di minggu bench, itu lebih dari empat menit murni startup interpreter. Mod tidak membayar itu: handler-nya jalan di dalam proses engine sendiri, dan log engine menunjukkan lompatannya selesai dalam sekitar satu milidetik.

Handler Biaya per panggilan Seminggu 5.993 panggilan
Hook shell (no-op) ~8 ms ~48 dtk
Hook Node (no-op) ~43 ms ~4,3 mnt
Mod (dalam proses) ~1 ms ~6 dtk

Satu-satunya laporan migrasi nyata di lapangan mengatakan hal yang sama: dua puluh tujuh hook shell diciutkan jadi lima mod, dan spawn di setiap panggilan ikut hilang. Aturan yang bertahan: antarmuka atau penulisan ulang event, mod; blokir, izinkan, atau catat dengan skrip yang kamu percaya, hook — biaya spawn baru terasa di ribuan panggilan; pengetahuan yang terus kamu ulang, skill. Hook yang sudah kamu baca lebih baik daripada mod yang belum.

Penjaga yang tak melakukan apa-apa

Mod keamanan paling sederhana adalah penjaga yang mengawasi setiap perintah shell — dan yang ini sengaja ditulis untuk crash. Claude Code diminta membuat file penanda; penjaganya melempar error; perintahnya tetap jalan dan file-nya muncul. Itu bukan bug, melainkan default yang terdokumentasi: saat sebuah hook melempar error, timeout, atau mengembalikan bentuk yang salah, Claude Code melewatinya dan lanjut. Dekorasi yang rusak tidak boleh membuat sesi mati total, tapi penjaga yang rusak fail open, diam-diam, dengan satu baris di log debug yang tak dibaca siapa pun.

Perbaikannya satu catch handler yang mengembalikan deny. Penjaga yang sama yang crash, dengan catch itu, menolak perintah dan menyebut kegagalannya. Satu baris menentukan apakah penjaga fail open atau fail closed, dokumentasi menyertakan pola persis ini, dan hampir tak ada yang memasangnya.

Sebuah tim komunitas menjalankan ulang kasus-kasus itu di rilis terkini dan menilai dari file penanda, bukan dari apa yang dikatakan model. Pola catch fail closed tiga kali dari tiga run — dan satu jalur masih rusak diam-diam: deny yang dikembalikan setelah panggilan sudah diteruskan tidak menghentikan tool. File-nya mendarat tiga kali dari tiga sementara model diberi tahu bahwa penulisannya gagal.

Laporan lapangan yang menamai masalah ini menjalankan penjaga selama berhari-hari yang aktif, termuat, dan tidak melakukan apa-apa, karena flag basi mematikannya dari bawah: tiga chip status hijau di atas penghitung yang macet di nol. Keheningan yang tampak persis seperti sehat.

Collision guard mendapat keep pertama. Ia menyelesaikan masalah nyata — dua chat terbuka mengedit file yang sama — dan mode gagalnya bersuara: ia bertanya lewat dialog dan tidak pernah mengizinkan diam-diam. Biayanya sekitar setengah detik pada edit dan tidak menambah apa pun ke prompt. Pasang, dan tetap beri catch handler.

Apa yang kamu serahkan saat memasangnya

Anthropic mengatakannya terus terang di hari peluncuran: mod jalan dengan akses ke mesinmu yang sama seperti Claude Code sendiri. Mod tidak di-sandbox; pasang seperti kamu memasang kode apa pun di komputermu. Secara konkret, mod bisa bertindak di mesinmu sebagai kamu: membaca environment dan settings-mu, tempat API key berada; melihat setiap prompt dan setiap panggilan tool; menulis ulangnya; menyetujui panggilan tool sebelum kamu ditanya; dan menghabiskan kuota paketmu untuk panggilan model miliknya sendiri.

Dua jebakan menangkap bahkan pengguna yang hati-hati. Aturan izin mengatur panggilan tool Claude, bukan panggilan milik mod: tolak Claude membaca file env, dan mod tetap bisa membaca file itu langsung dengan akses file miliknya, atau menjalankan program yang melakukannya. Kebijakan jaringan punya tepi yang sama: matikan trafik web dan panggilan fetch milik mod ditolak, tapi proses anak yang dijalankan mod menjangkau jaringan dengan akses penuh. Ada mod penjaga bawaan yang dimuat sebelum yang lain, tapi hanya di mesin terkelola dan untuk seat Team atau Enterprise; seat tunggal di langganan pribadi tidak mendapat apa pun dari itu.

Semua ini bukan teori. Seorang pengguna menerbitkan proof of concept beberapa hari setelah peluncuran: mod yang tombolnya menjalankan program dan menulis ke direktori home, dipasang dari katalog tanpa peringatan — dan poinnya benar: katalog tampak seperti app store, yang mengisyaratkan penyaringan yang tidak ada. Bug hook terpisah merusak isolasi subagent selama sehari; maintainer menyebutnya blunder besar dan memperbaikinya satu rilis kemudian.

Pemindaian katalog itu sendiri atas lebih dari seribu mod publik: lebih dari empat ratus menjalankan proses host, hampir empat ratus membaca file, dan lebih dari tiga ratus melihat setiap panggilan tool. Catatan katalog adalah kerangka yang tepat — itu jejak, bukan vonis; pelacak PR memang harus menjalankan git. Disiplinnya makan dua menit: jalankan validator sebelum mengaktifkan apa pun, dan kenali jalan keluarnya — safe mode untuk satu sesi, satu setting untuk menghentikan semua hook terpasang selamanya.

Simpan tiga, hapus tujuh

Dari sepuluh, tiga layak tempatnya: collision guard, model router, dan auto handoff.

Mod Vonis Angka di baliknya
Collision guard simpan ~0,5 dtk pada edit, gagal dengan bersuara, tidak menambah apa pun ke prompt
Model router simpan subagent ditagih di model murah, sepertiga harganya
Auto handoff simpan 70 ms tanpa aktivitas, satu penulisan handoff pada ambang konteks
Suggestion engine hapus ~250 token output + ~2,9 dtk di setiap jawaban yang memenuhi syarat
Cache keeper hapus ~1,5 dtk per turn, ping warming terhadap jendela cache 1 jam
Recording mode hapus menutupi layar tapi tidak disk
Goal meter hapus dekorasi, manfaat terukur nol
Repo heatmap hapus dekorasi, manfaat terukur nol
Flight recorder hapus dekorasi, manfaat terukur nol
Session bookmarks hapus jangkauan jauh melampaui tugasnya

Model router punya bukti: sesi di model besar memunculkan satu subagent, dan keterangan usage dari run itu menunjukkan subagent ditagih di model murah, sepertiga harga untuk pekerjaan kecil yang sama. Di minggu yang penuh subagent, itu uang sungguhan. Auto handoff tidak memakan biaya sampai saat ia terbayar: tujuh puluh milidetik overhead saat idle, dan melewati ambang konteks ia menulis handoff untuk cold start, sekali. Salah satu kreator gelombang ini mengaku tombol handoff manual tidak benar-benar menghemat waktu; sebagai penulisan otomatis di ambang batas, ia memang menghemat.

Disiplin yang bertahan dari tes ini: baca audit validator sebelum mengaktifkan apa pun, beri setiap penjaga catch handler agar fail closed, dan rekam demo di safe mode alih-alih memercayai mod penutup. Batasnya nyata — satu minggu, satu mesin, satu beban kerja, tiga run per titik di model kecil. Tiga milikmu mungkin berbeda, tapi sekarang kamu tahu cara menemukannya.

Sumber

Pertanyaan yang sering diajukan

Apa itu mod Claude Code?
Mod adalah fungsi TypeScript di dalam plugin Claude Code yang terpasang pada sebuah event — panggilan tool, prompt yang dikirim, bagian antarmuka yang digambar — dan bisa jalan sebelum, sesudah, atau menggantikannya. Mod bisa menggambar ulang antarmuka atau menulis ulang apa yang dikerjakan Claude Code.
Mod Claude Code mana yang benar-benar layak dipasang?
Dalam seminggu kerja nyata yang terukur, tiga dari sepuluh mod yang lagi hype layak disimpan: collision guard (mencegah dua chat mengedit file yang sama, gagal dengan bersuara), model router (subagent ditagih sepertiga harga), dan auto handoff (biaya idle 70 ms, satu penulisan handoff otomatis).
Apakah mod Claude Code memakan token?
Kebanyakan tidak, tapi suggestion engine mem-fork sesi setelah setiap jawaban yang memenuhi syarat, dengan biaya sekitar 250 token output dan hampir tiga detik waktu tambahan per turn, dan mode warming cache keeper menghabiskan panggilan model kecil selama berjam-jam.
Apakah mod Claude Code aman dipasang?
Mod jalan dengan akses ke mesinmu yang sama seperti Claude Code sendiri dan tidak di-sandbox. Aturan izin mengatur panggilan tool Claude, bukan panggilan milik mod, jadi mod bisa membaca file atau menjalankan proses yang kamu tolak untuk Claude. Jalankan audit validator sebelum mengaktifkan apa pun.
Apa bedanya mod Claude Code dengan hook?
Keduanya aktif pada event yang sama. Hook adalah skrip shell yang membayar spawn proses baru di setiap panggilan tool (sekitar 8 ms untuk shell, 43 ms untuk Node), sementara handler mod jalan di dalam proses engine dalam sekitar satu milidetik. Pakai mod untuk antarmuka atau penulisan ulang event, hook untuk memblokir, mengizinkan, atau mencatat dengan skrip yang kamu percaya.
Apa yang terjadi kalau mod penjaga Claude Code crash?
Secara default ia fail open: Claude Code melewati handler yang rusak dan perintahnya tetap jalan, dengan satu baris di log debug. Menambahkan catch handler yang mengembalikan deny membuat penjaga fail closed, dan dokumentasi menyertakan pola persis itu.

Video terkait