Intro — sepuluh mod, tiga bertahan
Mod Claude Code adalah fungsi TypeScript di dalam plugin yang bisa menggambar ulang antarmuka Claude Code atau menulis ulang apa yang dikerjakannya, dan dalam sehari setelah peluncurannya di awal Oktober, tiga tur video terpisah menyuruh developer memasang sepuluh mod. Dua kreator mengakui di depan kamera bahwa sebagian mod tidak menghemat apa pun, dan tak satu pun dari mereka mengukur satu mod pun. Tes ini mengukurnya: kesepuluh mod yang lagi hype dijalankan dalam seminggu kerja nyata, dengan angka untuk overhead, penghematan, dan vonis simpan atau hapus. Hasilnya di depan: hanya tiga dari sepuluh yang layak ada di mesin developer yang bekerja, dan salah satunya diam-diam menghabiskan token di setiap jawaban.
Gelombangnya, dan apa yang kami jalankan
Definisi resmi dari Anthropic muat dalam satu tarikan napas: mod adalah fungsi yang terpasang pada sebuah event, dan bisa jalan sebelum event itu, sesudahnya, atau menggantikannya. Event bisa berupa panggilan tool, prompt yang dikirim, atau bagian antarmuka yang sedang digambar. Mod adalah TypeScript biasa, dikirim di dalam plugin yang kamu pasang seperti plugin lain.
Tweet peluncurannya melewati empat juta tayangan dalam sekitar sehari, dengan dua puluh ribu like dan jumlah bookmark yang lebih banyak daripada reply dan repost digabung. Dua hari setelah peluncuran, sebuah katalog komunitas sudah memindai lebih dari seribu mod publik di ratusan repositori.
Bench untuk tes ini adalah seminggu kerja nyata: 85 sesi di empat proyek, hampir 900 prompt, dan hanya di bawah 6.000 panggilan tool. Setiap mod melewati audit validator, yang mencantumkan apa yang dipasangi dan apa yang bisa disentuhnya, dan setiap mod menjalankan tugas yang sama terhadap baseline bersih, di rilis terkini, di mesin yang sama.
Pembagian utamanya: enam dari sepuluh tidak punya biaya yang bisa diukur saat runtime, tiga memakan waktu atau token sungguhan, dan satu melanggar satu-satunya janji yang dibuatnya.
Tier dekorasi, diukur
Enam yang tenang itu masuk dalam batas noise koneksi. Goal meter, repo heatmap, flight recorder, model router, session bookmarks, dan auto handoff semuanya berada di antara seperempat detik lebih cepat dan seperlima detik lebih lambat, pada tugas baseline sekitar empat detik.
| Mod | Selisih runtime | Catatan |
|---|---|---|
| Goal meter | dalam batas noise | panel dekorasi |
| Repo heatmap | dalam batas noise | menyalakan file saat dibaca |
| Flight recorder | dalam batas noise | timeline langsung dari turn |
| Model router | dalam batas noise | terbayar di subagent, lihat vonis |
| Session bookmarks | dalam batas noise | jejak kemampuan yang luas |
| Auto handoff | ~70 ms saat idle | menulis satu handoff pada ambang konteks |
Tampilannya bagus, dan tak ada yang rusak: setiap run di setiap konfigurasi menyelesaikan tugas dengan benar. Di mode headless biayanya nol, karena tidak ada yang digambar; di terminal, panel ini menggambar ulang sampai tiga puluh kali per detik, jadi biaya jujur dari tier dekorasi adalah perhatian, bukan token.
Audit validator adalah titik di mana ini berhenti jadi lucu. Mod bookmarks bisa memanggil model, menjalankan proses di mesinmu, dan menulis file, dan ia membaca path konfigurasimu dari environment. Tak ada yang disembunyikan dan tak ada yang jahat, tapi itu jangkauan yang sangat luas untuk sebuah bookmark. Empat mod keluar di sini: goal meter, heatmap, dan flight recorder sebagai dekorasi dengan manfaat terukur nol, dan mod bookmarks karena meminta lebih banyak daripada yang dihasilkannya.
Mod andalan menagihmu tiap turn
Suggestion engine adalah mod yang didemokan pertama di setiap video: jawabanmu selesai, tiga saran prompt muncul di atas composer, kamu menekan angka, dan draf terisi sendiri. Mekanismenya didokumentasikan oleh penulisnya sendiri: saat turn-mu selesai, mod ini mem-fork sesi untuk meminta saran itu dari sebuah model, dan fork-nya berbagi prompt cache sesi, jadi biayanya sekitar satu balasan pendek. Tur-tur itu tidak pernah menyebut barisnya.
Terukur di bench, itu sekitar 250 token output tambahan per jawaban yang memenuhi syarat dan hampir tiga detik waktu tambahan, dan jawaban yang memenuhi syarat itu hampir setiap jawaban: apa pun yang lebih panjang dari sekitar delapan puluh karakter. Fork-nya juga tidak punya gerbang surface. Sarannya hanya digambar di terminal, tapi fork-nya menyala di mana-mana, termasuk run headless di mana tidak ada yang bisa digambar sama sekali.
| Mod | Biaya terukur | Kapan aktif |
|---|---|---|
| Suggestion engine | ~250 token output + ~2,9 dtk per jawaban yang memenuhi syarat | setiap jawaban di atas ~80 karakter, termasuk headless |
| Cache keeper | ~1,5 dtk per turn, plus panggilan model mode warming | setiap turn, warming berjam-jam |
Cache keeper punya bentuk yang sama: sekitar satu setengah detik per turn, dengan mode warming yang menghabiskan panggilan model kecil selama berjam-jam supaya prompt cache-mu tidak dingin. Di paket langganan, jendela cache sudah satu jam, jadi kamu membayar ping untuk masalah yang sebagian besar sudah diselesaikan paketnya. Keduanya desain yang jujur dengan biaya terdokumentasi, keduanya pajak di setiap turn yang tidak pernah dihargai daftar instalasi, dan keduanya dicopot dari mesin.
Mod vs hook, tugas yang sama
Claude Code sudah punya hook: skrip shell di settings-mu yang jalan pada event yang sama. Dokumentasi menjawab pilihannya dalam satu baris tabel: mod untuk antarmuka dan untuk menulis ulang event; hook untuk memblokir, mengizinkan, atau mencatat dengan skrip yang sudah kamu punya.
Perbedaan yang terukur ada di spawn proses. Hook di settings memulai proses baru di setiap panggilan tool. Diukur di mesin ini, hook shell yang tidak melakukan apa-apa memakan sekitar 8 ms dan hook yang menjalankan Node sekitar 43 ms, di setiap panggilan, sebelum skripnya mengerjakan apa pun. Dari 5.993 panggilan tool di minggu bench, itu lebih dari empat menit murni startup interpreter. Mod tidak membayar itu: handler-nya jalan di dalam proses engine sendiri, dan log engine menunjukkan lompatannya selesai dalam sekitar satu milidetik.
| Handler | Biaya per panggilan | Seminggu 5.993 panggilan |
|---|---|---|
| Hook shell (no-op) | ~8 ms | ~48 dtk |
| Hook Node (no-op) | ~43 ms | ~4,3 mnt |
| Mod (dalam proses) | ~1 ms | ~6 dtk |
Satu-satunya laporan migrasi nyata di lapangan mengatakan hal yang sama: dua puluh tujuh hook shell diciutkan jadi lima mod, dan spawn di setiap panggilan ikut hilang. Aturan yang bertahan: antarmuka atau penulisan ulang event, mod; blokir, izinkan, atau catat dengan skrip yang kamu percaya, hook — biaya spawn baru terasa di ribuan panggilan; pengetahuan yang terus kamu ulang, skill. Hook yang sudah kamu baca lebih baik daripada mod yang belum.
Penjaga yang tak melakukan apa-apa
Mod keamanan paling sederhana adalah penjaga yang mengawasi setiap perintah shell — dan yang ini sengaja ditulis untuk crash. Claude Code diminta membuat file penanda; penjaganya melempar error; perintahnya tetap jalan dan file-nya muncul. Itu bukan bug, melainkan default yang terdokumentasi: saat sebuah hook melempar error, timeout, atau mengembalikan bentuk yang salah, Claude Code melewatinya dan lanjut. Dekorasi yang rusak tidak boleh membuat sesi mati total, tapi penjaga yang rusak fail open, diam-diam, dengan satu baris di log debug yang tak dibaca siapa pun.
Perbaikannya satu catch handler yang mengembalikan deny. Penjaga yang sama yang crash, dengan catch itu, menolak perintah dan menyebut kegagalannya. Satu baris menentukan apakah penjaga fail open atau fail closed, dokumentasi menyertakan pola persis ini, dan hampir tak ada yang memasangnya.
Sebuah tim komunitas menjalankan ulang kasus-kasus itu di rilis terkini dan menilai dari file penanda, bukan dari apa yang dikatakan model. Pola catch fail closed tiga kali dari tiga run — dan satu jalur masih rusak diam-diam: deny yang dikembalikan setelah panggilan sudah diteruskan tidak menghentikan tool. File-nya mendarat tiga kali dari tiga sementara model diberi tahu bahwa penulisannya gagal.
Laporan lapangan yang menamai masalah ini menjalankan penjaga selama berhari-hari yang aktif, termuat, dan tidak melakukan apa-apa, karena flag basi mematikannya dari bawah: tiga chip status hijau di atas penghitung yang macet di nol. Keheningan yang tampak persis seperti sehat.
Collision guard mendapat keep pertama. Ia menyelesaikan masalah nyata — dua chat terbuka mengedit file yang sama — dan mode gagalnya bersuara: ia bertanya lewat dialog dan tidak pernah mengizinkan diam-diam. Biayanya sekitar setengah detik pada edit dan tidak menambah apa pun ke prompt. Pasang, dan tetap beri catch handler.
Apa yang kamu serahkan saat memasangnya
Anthropic mengatakannya terus terang di hari peluncuran: mod jalan dengan akses ke mesinmu yang sama seperti Claude Code sendiri. Mod tidak di-sandbox; pasang seperti kamu memasang kode apa pun di komputermu. Secara konkret, mod bisa bertindak di mesinmu sebagai kamu: membaca environment dan settings-mu, tempat API key berada; melihat setiap prompt dan setiap panggilan tool; menulis ulangnya; menyetujui panggilan tool sebelum kamu ditanya; dan menghabiskan kuota paketmu untuk panggilan model miliknya sendiri.
Dua jebakan menangkap bahkan pengguna yang hati-hati. Aturan izin mengatur panggilan tool Claude, bukan panggilan milik mod: tolak Claude membaca file env, dan mod tetap bisa membaca file itu langsung dengan akses file miliknya, atau menjalankan program yang melakukannya. Kebijakan jaringan punya tepi yang sama: matikan trafik web dan panggilan fetch milik mod ditolak, tapi proses anak yang dijalankan mod menjangkau jaringan dengan akses penuh. Ada mod penjaga bawaan yang dimuat sebelum yang lain, tapi hanya di mesin terkelola dan untuk seat Team atau Enterprise; seat tunggal di langganan pribadi tidak mendapat apa pun dari itu.
Semua ini bukan teori. Seorang pengguna menerbitkan proof of concept beberapa hari setelah peluncuran: mod yang tombolnya menjalankan program dan menulis ke direktori home, dipasang dari katalog tanpa peringatan — dan poinnya benar: katalog tampak seperti app store, yang mengisyaratkan penyaringan yang tidak ada. Bug hook terpisah merusak isolasi subagent selama sehari; maintainer menyebutnya blunder besar dan memperbaikinya satu rilis kemudian.
Pemindaian katalog itu sendiri atas lebih dari seribu mod publik: lebih dari empat ratus menjalankan proses host, hampir empat ratus membaca file, dan lebih dari tiga ratus melihat setiap panggilan tool. Catatan katalog adalah kerangka yang tepat — itu jejak, bukan vonis; pelacak PR memang harus menjalankan git. Disiplinnya makan dua menit: jalankan validator sebelum mengaktifkan apa pun, dan kenali jalan keluarnya — safe mode untuk satu sesi, satu setting untuk menghentikan semua hook terpasang selamanya.
Simpan tiga, hapus tujuh
Dari sepuluh, tiga layak tempatnya: collision guard, model router, dan auto handoff.
| Mod | Vonis | Angka di baliknya |
|---|---|---|
| Collision guard | simpan | ~0,5 dtk pada edit, gagal dengan bersuara, tidak menambah apa pun ke prompt |
| Model router | simpan | subagent ditagih di model murah, sepertiga harganya |
| Auto handoff | simpan | 70 ms tanpa aktivitas, satu penulisan handoff pada ambang konteks |
| Suggestion engine | hapus | ~250 token output + ~2,9 dtk di setiap jawaban yang memenuhi syarat |
| Cache keeper | hapus | ~1,5 dtk per turn, ping warming terhadap jendela cache 1 jam |
| Recording mode | hapus | menutupi layar tapi tidak disk |
| Goal meter | hapus | dekorasi, manfaat terukur nol |
| Repo heatmap | hapus | dekorasi, manfaat terukur nol |
| Flight recorder | hapus | dekorasi, manfaat terukur nol |
| Session bookmarks | hapus | jangkauan jauh melampaui tugasnya |
Model router punya bukti: sesi di model besar memunculkan satu subagent, dan keterangan usage dari run itu menunjukkan subagent ditagih di model murah, sepertiga harga untuk pekerjaan kecil yang sama. Di minggu yang penuh subagent, itu uang sungguhan. Auto handoff tidak memakan biaya sampai saat ia terbayar: tujuh puluh milidetik overhead saat idle, dan melewati ambang konteks ia menulis handoff untuk cold start, sekali. Salah satu kreator gelombang ini mengaku tombol handoff manual tidak benar-benar menghemat waktu; sebagai penulisan otomatis di ambang batas, ia memang menghemat.
Disiplin yang bertahan dari tes ini: baca audit validator sebelum mengaktifkan apa pun, beri setiap penjaga catch handler agar fail closed, dan rekam demo di safe mode alih-alih memercayai mod penutup. Batasnya nyata — satu minggu, satu mesin, satu beban kerja, tiga run per titik di model kecil. Tiga milikmu mungkin berbeda, tapi sekarang kamu tahu cara menemukannya.
AIDive