AIDive

Ho Installato 8 Repo Claude Code Virali. Uno Solo Merita.

Di AIDive · Pubblicato il

Agent di codingSicurezza e IA

Otto repo, un progetto, 87 run

Otto repository GitHub compaiono su ogni lista degli essenziali per Claude Code di questo mese: Chisle, Ouroboros, Reticle, Caliper, Anti-Slop, UI Skills, img2threejs e FWC SwiftUI Skills. Insieme superano le 37.000 stelle. Quelle liste dicono cosa promette ogni repo e come si installa. Nessuno le installa tutte insieme e misura.

Così tutte e otto sono finite su un unico progetto reale, un'app React con 111 test che passano. Una di loro si è scritta da sola nelle impostazioni di altri nove strumenti AI sulla macchina. Una non è mai stata eseguita, per via di una singola riga nel suo sorgente. E tre di loro hanno collegato un server a Claude Code che non è mai stato chiamato, nemmeno una volta, in 63 run.

Il test Valore
Repo installati 8
Run totali 87
Spesa totale circa 6 dollari
Progetto 1 app React, 111 test superati
Modello 1
Durata 1 giorno

Tre domande guidano il resto: quanto costa ogni repo all'avvio, cosa è davvero cambiato nell'output, e quali vale la pena tenere.

Cosa costa ognuno prima di scrivere

Il costo di avvio è ciò che Claude Code carica nel contesto prima del primo messaggio. Su un progetto vuoto sono circa 17.000 token, e li si paga a ogni turno. Per misurare un'installazione, a Claude è stato chiesto di rispondere con una sola parola, e si è letto il conto. L'unità è il token, non il dollaro: due run identiche possono differire di 10 volte nel prezzo solo per via della cache.

Installazione Token di avvio aggiunti
Chisle circa 3.500
Ouroboros circa 1.600
Reticle circa 900
img2threejs (file di istruzioni da 33 KB) 107
Anti-Slop (skill di supporto) 95
UI Skills 37
Tutto il resto da 100 a 300 ciascuno
Tutte e otto insieme sotto i 7.000

Due delle otto non sono affatto pensate per uno sviluppatore web. img2threejs trasforma una foto in una scena 3D, e FWC SwiftUI Skills serve per le app Apple. Ne è stato misurato solo il costo. La skill 3D include un file di istruzioni da 33 kilobyte e costa comunque 107 token, perché fino alla chiamata carica solo la descrizione della skill.

Anche i server sono diventati economici. Claude Code ora carica solo i nomi degli strumenti di un server e recupera i dettagli quando servono. Sono circa 45 token per strumento, qualunque cosa faccia. Con tutte e otto installate, i costi semplicemente si sommano. Niente si moltiplica.

Claude Code ha un comando che proietta questo costo per un plugin, ed elenca gli hook come gratuiti. Per un plugin usato ogni giorno su questa macchina, ha proiettato circa 540 token. La misurazione è stata di 744, perché il suo hook di avvio scrive direttamente nella sessione.

L'avvio non è dove questi repo diventano costosi. Sono i turni.

Stessi task, con e senza

Il banco di prova è composto da tre task che uno sviluppatore affiderebbe davvero: un bug nella costruzione di un indirizzo web, una funzione che mostra il tempo di lettura, e un contatore di caratteri su un form. Ogni task è stato eseguito con un repo installato, con tutti e otto, e con nessuno, tre run ogni volta. Il giudice è un test che l'agente non vede mai, più la suite del progetto, più il type checker. Ogni run ha usato la stessa lista fissa di strumenti consentiti, senza bypass dei permessi.

Risultato Valore
Run dei task 63
Superati 63
Nuovi errori di tipo 0
Chiamate ai tre server collegati 0
Fix del bug, base 7 turni, 27 secondi
Task del form, base 22 turni, circa 1 minuto

Niente ha fatto fallire un task a Claude, e niente gli ha fatto superare un task che avrebbe fallito senza.

Tre di questi repo collegano un server pieno di strumenti. In 63 run, Claude ha chiamato quegli strumenti zero volte. Incluso il task del form, scritto apposta perché consigli di design e test visivi avessero qualcosa da fare. Va detto, due di loro non hanno mai avuto la loro occasione: Reticle richiede un browser abbinato all'app in esecuzione, e quell'abbinamento è andato in crash. Ouroboros richiede una configurazione sull'intera macchina, che non gli è stata data.

Il rumore è enorme. Stesso prompt, stessa installazione: una run ha scritto 4.300 token, un'altra 7.100. Solo due risultati hanno superato il proprio rumore, entrambi sul task più breve. Una singola dimostrazione prima-e-dopo non prova niente.

Il 52% di Chisle, sul coding reale

Chisle è un plugin di compressione dell'output, ed è l'unico degli otto a promettere un numero: il suo benchmark dice che la bolletta scende al 52 percento. Sui tre task, l'output è arrivato al 94 percento del base. Il README lo spiega con parole proprie: quelle cifre riguardano prompt singoli senza strumenti, non il costo dell'intera sessione.

Misura Valore
Promessa del benchmark di Chisle output al 52%
Chisle sui tre task output al 94% del base
Il plugin di brevità per uso quotidiano, stessi task 113%, dentro il rumore
Un fix di bug: token letti 95.000
Un fix di bug: token scritti 1.700

In una sessione di coding reale, l'output è la parte piccola della bolletta. Chisle carica le sue regole all'avvio e allega un promemoria a ogni prompt inviato, così le sue run costano più del base su due task su tre. Le regole pesano più delle parole che fanno risparmiare. Il suo compressore per l'output degli strumenti ha girato in ogni sessione e non ha mai registrato un risparmio.

Nessuno dei due plugin ha risparmiato qualcosa di misurabile. Un utente di Chisle ha trovato lo stesso risultato su 173 sessioni, e l'autore dice che quel bug è stato corretto. Va riconosciuto: Chisle pubblica le proprie perdite, e la sua gestione dei file è curata e solida.

La regola da trarne: un plugin che parla a ogni turno è il tipo più costoso.

Le installazioni che escono dal progetto

L'ambito di installazione è quanto lontano arriva la configurazione di un repo oltre la cartella in cui è stato eseguito. Qui tutto è stato installato dentro una sola cartella, di proposito, così che nulla toccasse il resto della macchina.

Il comando di setup di Reticle aveva altri piani. Il suo stesso log dice che si è registrato con altri 8 agenti: VS Code, Copilot, Warp, Kiro, Amazon Q, Cline, Amp, e uno in più. In Gemini, si è auto-approvato in anticipo. Nelle impostazioni di Claude Code, ha aggiunto una regola che approva i propri strumenti. Niente di tutto ciò è nascosto, è tutto lì nel sorgente, l'installer è esplicito su ciò che fa e include un comando di disinstallazione. Ma gli è stato dato un solo flag di conferma, per un solo progetto.

Caliper doveva essere lo strumento di misurazione. Il suo harness lancia Claude con ogni controllo dei permessi disattivato, senza possibilità di cambiarlo, e copia le credenziali di accesso in ogni run di test. Non è mai stato eseguito; è stato sostituito da uno script su misura.

Repo Si installa in modo pulito dentro un progetto? Note
Anti-Slop Sì Copia file e nient'altro
UI Skills Sì Libreria di skill remota
img2threejs Sì Una skill
FWC SwiftUI Skills Sì Testo semplice
Reticle In parte Registrato con 8 altri agenti, regola di auto-approvazione
Chisle No Solo globale, controlla gli aggiornamenti all'avvio, salva l'output grezzo degli strumenti su disco
Ouroboros No Solo a livello di macchina, riporta l'utilizzo di default, l'installer può inviare uno script da internet direttamente nella shell
Caliper Mai eseguito Controlli dei permessi disattivati, credenziali copiate in ogni run

Niente di tutto ciò è malware. È comodità che dà per scontato che tu voglia lo strumento ovunque. Prima di ogni installazione, apri tre cose: gli hook, lo script di installazione e la configurazione del server.

Cosa succede quando si sovrappongono

Sovrapporsi significa installare tutte e otto insieme: nessun crash, nessun errore, e i costi si sommano quasi esattamente. Una trappola è costata un'ora. Nelle run scriptate, un server di progetto attende un'approvazione che nessuno può dare, così sembra quasi gratuito. Ogni cifra sui server qui è stata misurata di nuovo dopo aver corretto questo.

Gli hook sono il punto d'incontro tra i repo. Un hook è uno script che Claude Code esegue in un momento preciso, e qualunque cosa stampi può finire davanti al modello. Con tre di questi strumenti collegati, tre script partono all'avvio e altri tre a ogni prompt. Una frase digitata normalmente è arrivata al modello con due note allegate: una che gli diceva di scrivere in modo conciso, una che chiedeva un passaggio di configurazione impossibile da completare dentro un progetto. Quella seconda nota ritorna a ogni prompt che contiene una delle sue parole chiave.

I nomi degli strumenti non possono collidere, perché ogni server antepone il proprio prefisso. Per gli hook, la documentazione lo conferma: quando più hook aggiungono contesto, Claude riceve tutti i valori.

Uno studio del maggio 2026 ha misurato cosa fa a un agente un grande insieme di skill. Con circa 200 skill, il tasso di successo è calato fino al 21 percento, e gran parte di quella perdita deriva dall'agente che sceglie una skill dall'aspetto simile invece di quella giusta. Otto repo equivalgono a 10 skill, lontano da quella soglia. Chi ne ha installate decine, invece, ci è vicino.

Quello che ha cambiato il codice

Anti-Slop è un insieme di regole di lint che si copia nel proprio progetto, non un plugin. Non c'è un pacchetto da installare; l'autore vuole che tu copi le regole e le modifichi. Un linter legge il codice fuori dal modello, quindi non costa contesto: 95 token per la sua skill di supporto, e niente per turno.

Nel task del form, Claude doveva collegare un nuovo campo attraverso un componente. Ha copiato la riga sopra, cast di tipo non sicuro incluso. Anti-Slop lo ha segnalato, tre run su tre. È il genere di cosa che un revisore lascia passare, perché sembra identica alle righe vicine.

Rilievo di Anti-Slop Valore
Cast di tipo non sicuro segnalato 3 run su 3
Riga vuota mancante segnalata in una funzione corretta di sei righe 2 run su 3
Rilievi sul progetto non toccato 109
Quota da due regole di stile 83%
Altre regole 16

Il rilievo sulla riga vuota è una questione di gusto, non un bug, e il linter legge un solo file alla volta. Il costo si presenta il primo giorno: decidi su quelle due regole di stile prima di giudicare le altre 16. Un'insidia: le regole sono distribuite come moduli, quindi il tuo progetto deve dichiararsi a sua volta un modulo, o il linter va in crash.

UI Skills è la più economica da tenere: 37 token per una libreria remota di skill di design, e zero chiamate in queste run. Ad luglio aveva 18 link morti. Tutti e 300 sono stati testati la mattina del video, e nessuno è rotto.

Cosa tengo, e come controllare il tuo setup

Otto repo classificati. L'aspettativa era di tre da tenere. I dati ne danno una che se l'è guadagnata, e tre libere da tenere.

Repo Verdetto
Anti-Slop Se l'è guadagnata: ha colto un errore reale ogni volta per quasi niente
UI Skills Libera da tenere: 37 token, non collide con niente
img2threejs, FWC SwiftUI Skills Libere da tenere se le chiamerai mai: qualche centinaio di token in tutto
Chisle È costata più di quanto ha risparmiato sul coding reale
Caliper Mai eseguita
Reticle, Ouroboros Vogliono l'intera macchina, mai viste fare il loro lavoro vero, quindi nessun verdetto su a cosa servano

Lo stesso maintainer di Ouroboros conta circa il 40 percento delle sue run che falliscono.

I limiti contano: un progetto React, un modello, tre task, tre run ciascuno. Con un rumore così ampio, gli effetti piccoli sono invisibili. Quello che i dati stabiliscono è che il pavimento è alto. Claude ha superato tutto con o senza questi strumenti, e gli strumenti che restano nel contesto in attesa di essere chiamati per lo più non vengono chiamati. Serve un workflow che li vada a cercare.

Puoi controllare il tuo setup in due minuti. Un comando mostra cosa è caricato in questo momento. Uno proietta il costo di un plugin, e ricorda che conta gli hook come gratuiti. Uno riporta quanto costa ogni skill e quanto viene usata. E prima di ogni installazione, apri gli hook, lo script di installazione e la configurazione del server.

Fonti

Domande frequenti

Quali repo per Claude Code vale davvero la pena installare?
Su otto repo testati su un progetto React, solo Anti-Slop si è guadagnato il suo posto: le sue regole di lint hanno colto un vero cast di tipo non sicuro tre run su tre per quasi nessun costo di contesto. UI Skills, img2threejs e FWC SwiftUI Skills costano insieme qualche centinaio di token e non collidono con niente, quindi sono libere da tenere se le chiamerai mai.
Quanti token aggiungono all'avvio i plugin di Claude Code?
Un progetto vuoto carica già circa 17.000 token. In questo test Chisle ne ha aggiunti circa 3.500, Ouroboros 1.600, Reticle 900 e UI Skills 37, e tutti e otto i repo insieme hanno aggiunto meno di 7.000. Le skill caricano solo la loro descrizione finché non vengono chiamate, e un server MCP costa circa 45 token per strumento.
Chisle riduce davvero la bolletta di Claude Code al 52 percento?
Non sul coding reale. Su tre task di sviluppo l'output è arrivato al 94 percento del base, e le run di Chisle sono costate più del base su due task su tre, perché carica regole all'avvio e aggiunge un promemoria a ogni prompt. Il suo README dice che la cifra del 52 percento viene da prompt singoli senza strumenti, non dal costo dell'intera sessione.
I plugin di Claude Code fanno superare più task di coding?
Non in questo test. Su 63 run di tre task, con ogni repo, con tutti e otto e con nessuno, ogni run ha superato un test nascosto, la suite del progetto e il type checker. Il rumore da run a run era ampio, da 4.300 a 7.100 token di output per lo stesso prompt, quindi una singola dimostrazione prima-e-dopo non prova niente.
È sicuro installare i repo popolari per Claude Code?
Nessuno degli otto è malware, ma diversi vanno oltre il progetto. Il setup di Reticle si è registrato con 8 altri agenti e ha aggiunto una regola che approva i propri strumenti, Caliper lancia Claude con ogni controllo dei permessi disattivato e copia le credenziali di accesso in ogni run, e Chisle e Ouroboros si installano solo a livello di macchina. Apri gli hook, lo script di installazione e la configurazione del server prima di ogni installazione.
Cosa succede installando insieme molti plugin per Claude Code?
Tutte e otto installate insieme senza crash, e i loro costi di avvio semplicemente si sommano. Gli hook sono il punto d'incontro: con tre strumenti basati su hook, una frase digitata è arrivata al modello con due note iniettate. Uno studio del maggio 2026 ha trovato tassi di successo in calo fino al 21 percento con circa 200 skill, soprattutto perché l'agente sceglie una skill dall'aspetto simile.

Video correlati