Oito repositórios, um projeto, 87 execuções
Oito repositórios do GitHub aparecem em toda lista de essenciais do Claude Code deste mês: Chisle, Ouroboros, Reticle, Caliper, Anti-Slop, UI Skills, img2threejs e FWC SwiftUI Skills. Juntos, somam mais de 37.000 estrelas. Essas listas dizem o que cada repositório promete e como instalar. Ninguém instala todos juntos e mede o resultado.
Então os oito foram colocados em um projeto real, um app React com 111 testes passando. Um deles se escreveu sozinho nas configurações de outras nove ferramentas de IA na máquina. Um nunca chegou a rodar, por causa de uma única linha no seu código-fonte. E três deles conectaram um servidor ao Claude Code que nunca foi chamado, nem uma vez, em 63 execuções.
| O teste | Valor |
|---|---|
| Repositórios instalados | 8 |
| Total de execuções | 87 |
| Gasto total | cerca de US$ 6 |
| Projeto | 1 app React, 111 testes passando |
| Modelo | 1 |
| Duração | 1 dia |
Três perguntas guiam o resto: quanto cada repositório custa no arranque, o que realmente mudou no resultado, e quais valem a pena manter.
Quanto cada um custa antes de você digitar
Custo de arranque é o que o Claude Code carrega no contexto antes da sua primeira mensagem. Em um projeto vazio isso é cerca de 17.000 tokens, e você paga por eles em cada turno. Para medir uma instalação, pediu-se ao Claude que respondesse com uma única palavra, e a conta foi lida. A unidade é token, não dólar: duas execuções idênticas podem diferir 10 vezes no preço só por causa do cache.
| Instalação | Tokens de arranque adicionados |
|---|---|
| Chisle | cerca de 3.500 |
| Ouroboros | cerca de 1.600 |
| Reticle | cerca de 900 |
| img2threejs (arquivo de instrução de 33 KB) | 107 |
| Anti-Slop (skill auxiliar) | 95 |
| UI Skills | 37 |
| Todo o resto | de 100 a 300 cada |
| Os oito juntos | menos de 7.000 |
Dois dos oito não são para um desenvolvedor web. img2threejs transforma uma foto em uma cena 3D, e FWC SwiftUI Skills é para apps da Apple. Só o custo deles foi medido. A skill de 3D vem com um arquivo de instrução de 33 quilobytes e ainda assim custa 107 tokens, porque só a descrição de uma skill carrega até que ela seja chamada.
Servidores também ficaram baratos. O Claude Code agora carrega apenas os nomes das ferramentas de um servidor e busca os detalhes sob demanda. Isso dá cerca de 45 tokens por ferramenta, seja qual for a função dela. Com os oito instalados, os custos simplesmente se somam. Nada se multiplica.
O Claude Code tem um comando que projeta esse custo para um plugin, e ele lista os hooks como gratuitos. Para um plugin usado todo dia nessa máquina, ele projetou cerca de 540 tokens. A medição foi de 744, porque o hook de arranque dele imprime direto na sessão.
O arranque não é onde esses repositórios ficam caros. São os turnos.
Mesmas tarefas, com e sem
O benchmark são três tarefas que um desenvolvedor realmente delegaria: um bug em como um endereço web é montado, uma funcionalidade que mostra o tempo de leitura, e um contador de caracteres em um formulário. Cada tarefa rodou com um repositório instalado, com os oito, e sem nenhum, três execuções de cada vez. O juiz é um teste que o agente nunca vê, mais o conjunto de testes do próprio projeto, mais o verificador de tipos. Toda execução usou a mesma lista fixa de ferramentas permitidas, sem burlar permissões.
| Resultado | Valor |
|---|---|
| Execuções de tarefas | 63 |
| Aprovações | 63 |
| Novos erros de tipo | 0 |
| Chamadas aos três servidores conectados | 0 |
| Correção de bug, referência | 7 turnos, 27 segundos |
| Tarefa do formulário, referência | 22 turnos, cerca de 1 minuto |
Nada fez o Claude falhar em uma tarefa, e nada o fez passar em uma que ele teria falhado sem aquilo.
Três desses repositórios conectam um servidor cheio de ferramentas. Em 63 execuções, o Claude chamou essas ferramentas zero vezes. Isso inclui a tarefa do formulário, escrita justamente para que orientação de design e teste visual tivessem algo a fazer. Para ser justo, dois deles nunca chegaram a exercer sua função real. O Reticle precisa de um navegador pareado com o app em execução, e esse pareamento travou. O Ouroboros precisa de uma configuração em toda a máquina, e não recebeu isso.
O ruído é enorme. Mesmo prompt, mesma instalação: uma execução escreveu 4.300 tokens, outra escreveu 7.100. Só dois resultados superaram seu próprio ruído, ambos na tarefa mais curta. Uma única demonstração de antes-e-depois não prova nada.
Os 52% do Chisle, no trabalho real de código
Chisle é um plugin de compressão de saída, e o único dos oito que promete um número: seu benchmark diz que sua conta cai para 52%. Nas três tarefas, a saída ficou em 94% da referência. O README explica por quê, com suas próprias palavras: esses números são de prompts únicos sem ferramentas, não do custo de uma sessão inteira.
| Medida | Valor |
|---|---|
| Promessa do benchmark do Chisle | saída em 52% |
| Chisle nas três tarefas | saída em 94% da referência |
| O plugin de concisão de uso diário, mesmas tarefas | 113%, dentro do ruído |
| Uma correção de bug: tokens lidos | 95.000 |
| Uma correção de bug: tokens escritos | 1.700 |
Em uma sessão de código real, a saída é o lado pequeno da conta. O Chisle carrega suas regras no início e gruda um lembrete em cada prompt que você envia, então suas execuções custaram mais que a referência em duas tarefas de três. As regras pesam mais do que as palavras que economizam. Seu compressor de saída de ferramentas rodou em toda sessão e nunca registrou uma economia.
Nenhum dos dois plugins economizou algo mensurável. Um usuário do Chisle encontrou o mesmo resultado em 173 sessões, e o autor diz que esse bug já foi corrigido. Mérito onde é devido: o Chisle publica suas próprias perdas, e o tratamento de arquivos dele é cuidadosamente reforçado.
A regra a se tirar daqui: um plugin que fala em todo turno é o tipo mais caro que existe.
As instalações que saem do seu projeto
Escopo de instalação é até onde a configuração de um repositório alcança para além da pasta onde você o rodou. Tudo aqui foi instalado dentro de uma única pasta, de propósito, para que nada tocasse o resto da máquina.
O comando de configuração do Reticle tinha outros planos. Seu próprio log diz que ele se registrou com mais 8 agentes: VS Code, Copilot, Warp, Kiro, Amazon Q, Cline, Amp, e mais um. No Gemini, ele se aprovou antecipadamente. Nas configurações do Claude Code, ele adicionou uma regra que aprova suas próprias ferramentas. Nada disso está escondido, está bem ali no código-fonte, o instalador é explícito sobre o que faz, e ele vem com um comando de desinstalação. Mas foi dada apenas uma flag de confirmação, para um projeto.
O Caliper deveria ser a ferramenta de medição. Seu harness lança o Claude com toda verificação de permissão desligada, sem opção de mudar isso, e copia suas credenciais de login para cada execução de teste. Ele nunca foi rodado; um executor personalizado o substituiu.
| Repositório | Instala de forma limpa dentro de um projeto? | Notas |
|---|---|---|
| Anti-Slop | Sim | Copia arquivos e nada mais |
| UI Skills | Sim | Biblioteca remota de skills |
| img2threejs | Sim | Uma skill |
| FWC SwiftUI Skills | Sim | Texto simples |
| Reticle | Parcialmente | Se registrou com 8 outros agentes, regra de autoaprovação |
| Chisle | Não | Só global, verifica atualizações no arranque, salva a saída bruta das ferramentas em disco |
| Ouroboros | Não | Só em toda a máquina, reporta uso por padrão, o instalador pode canalizar um script da internet direto para o seu shell |
| Caliper | Não rodado | Verificações de permissão desligadas, credenciais copiadas em cada execução |
Nada disso é malware. É conveniência que assume que você quer a ferramenta em todo lugar. Abra três coisas antes de qualquer instalação: os hooks, o script de instalação, e a configuração do servidor.
O que acontece quando eles se empilham
Empilhar significa os oito instalados juntos: sem travamento, sem erro, e os custos se somam quase exatamente. Uma armadilha custou uma hora. Em execuções automatizadas, um servidor de projeto espera uma aprovação que ninguém pode dar, então ele parece quase gratuito. Cada número de servidor aqui foi medido de novo depois de corrigir isso.
Os hooks são onde os repositórios se encontram. Um hook é um script que o Claude Code roda em um momento fixo, e o que ele imprime pode acabar diante do modelo. Com três dessas ferramentas conectadas, três scripts disparam no arranque e mais três em cada prompt. Uma frase comum digitada chegou ao modelo com duas notas anexadas: uma dizendo para escrever de forma concisa, outra exigindo uma etapa de configuração que não pode ser concluída dentro de um projeto. Essa segunda nota volta a cada prompt que contém uma de suas palavras-chave.
Nomes de ferramentas não conseguem colidir, porque todo servidor prefixa o seu próprio. Para os hooks, a documentação confirma: quando vários hooks adicionam contexto, o Claude recebe todos os valores.
Um estudo de maio de 2026 mediu o que uma pilha grande de skills faz a um agente. Com cerca de 200 skills, a taxa de aprovação caiu até 21%, e a maior parte dessa perda vem do agente escolher uma skill parecida em vez da certa. Oito repositórios são 10 skills, longe disso. Quem tem dezenas instaladas, não está.
O que mudou o código
Anti-Slop é um conjunto de regras de lint que você copia para o seu projeto, não um plugin. Não há pacote para instalar; o autor quer que você copie as regras e as altere. Um linter lê seu código fora do modelo, então não custa contexto: 95 tokens para sua skill auxiliar, e nada por turno.
Na tarefa do formulário, o Claude teve que ligar um novo campo através de um componente. Ele copiou a linha acima, conversão de tipo insegura incluída. O Anti-Slop sinalizou isso, três execuções em três. É o tipo de coisa que um revisor deixa passar, porque parece igual às vizinhas.
| Achado do Anti-Slop | Valor |
|---|---|
| Conversão de tipo insegura sinalizada | 3 execuções em 3 |
| Linha em branco faltando sinalizada em uma função correta de seis linhas | 2 execuções em 3 |
| Achados no projeto intocado | 109 |
| Parcela desses vinda de duas regras de estilo | 83% |
| Outras regras | 16 |
O achado da linha em branco é uma questão de estilo, não um bug, e o linter só lê um arquivo por vez. O custo aparece no primeiro dia: decida sobre essas duas regras de estilo antes de julgar as outras 16. Uma pegadinha: as regras vêm como módulos, então seu projeto precisa se declarar módulo também, ou o linter trava.
UI Skills é o mais barato de manter: 37 tokens por uma biblioteca remota de skills de design, e zero chamadas nessas execuções. Ele tinha 18 links quebrados em julho. Todos os 300 foram testados na manhã do vídeo, e nenhum está quebrado.
O que eu mantenho, e como checar sua própria configuração
Oito repositórios classificados. A expectativa era de três que valessem a pena. Os dados dão um que realmente merece, e três que são livres para manter.
| Repositório | Veredito |
|---|---|
| Anti-Slop | Merece: pegou um erro real toda vez, por quase nada |
| UI Skills | Livre para manter: 37 tokens, não colide com nada |
| img2threejs, FWC SwiftUI Skills | Livres para manter se você algum dia for chamá-los: algumas centenas de tokens juntos |
| Chisle | Custou mais do que economizou no trabalho real de código |
| Caliper | Nunca rodou |
| Reticle, Ouroboros | Querem a máquina inteira, nunca vistos fazendo o trabalho real deles, então sem veredito sobre para que servem |
O próprio mantenedor do Ouroboros conta cerca de 40% de suas execuções falhando.
Os limites importam: um projeto React, um modelo, três tarefas, três execuções cada. Com um ruído tão largo, efeitos pequenos ficam invisíveis. O que os dados de fato resolvem é que a base é alta. O Claude passou em tudo com ou sem essas ferramentas, e ferramentas que ficam no contexto esperando serem chamadas, na maioria das vezes, não são chamadas. Elas precisam de um fluxo de trabalho que as busque.
Você pode checar sua própria configuração em dois minutos. Um comando mostra o que está carregado agora. Um projeta o custo de um plugin, e lembre-se de que ele conta os hooks como gratuitos. Um reporta quanto cada skill custa e com que frequência é usada. E antes de qualquer instalação, abra os hooks, o script de instalação, e a configuração do servidor.
AIDive