AIDive

Instalei 8 Repositórios do Claude Code. Só Um Merece

Por AIDive · Publicado em

Agentes de códigoSegurança e IA

Oito repositórios, um projeto, 87 execuções

Oito repositórios do GitHub aparecem em toda lista de essenciais do Claude Code deste mês: Chisle, Ouroboros, Reticle, Caliper, Anti-Slop, UI Skills, img2threejs e FWC SwiftUI Skills. Juntos, somam mais de 37.000 estrelas. Essas listas dizem o que cada repositório promete e como instalar. Ninguém instala todos juntos e mede o resultado.

Então os oito foram colocados em um projeto real, um app React com 111 testes passando. Um deles se escreveu sozinho nas configurações de outras nove ferramentas de IA na máquina. Um nunca chegou a rodar, por causa de uma única linha no seu código-fonte. E três deles conectaram um servidor ao Claude Code que nunca foi chamado, nem uma vez, em 63 execuções.

O teste Valor
Repositórios instalados 8
Total de execuções 87
Gasto total cerca de US$ 6
Projeto 1 app React, 111 testes passando
Modelo 1
Duração 1 dia

Três perguntas guiam o resto: quanto cada repositório custa no arranque, o que realmente mudou no resultado, e quais valem a pena manter.

Quanto cada um custa antes de você digitar

Custo de arranque é o que o Claude Code carrega no contexto antes da sua primeira mensagem. Em um projeto vazio isso é cerca de 17.000 tokens, e você paga por eles em cada turno. Para medir uma instalação, pediu-se ao Claude que respondesse com uma única palavra, e a conta foi lida. A unidade é token, não dólar: duas execuções idênticas podem diferir 10 vezes no preço só por causa do cache.

Instalação Tokens de arranque adicionados
Chisle cerca de 3.500
Ouroboros cerca de 1.600
Reticle cerca de 900
img2threejs (arquivo de instrução de 33 KB) 107
Anti-Slop (skill auxiliar) 95
UI Skills 37
Todo o resto de 100 a 300 cada
Os oito juntos menos de 7.000

Dois dos oito não são para um desenvolvedor web. img2threejs transforma uma foto em uma cena 3D, e FWC SwiftUI Skills é para apps da Apple. Só o custo deles foi medido. A skill de 3D vem com um arquivo de instrução de 33 quilobytes e ainda assim custa 107 tokens, porque só a descrição de uma skill carrega até que ela seja chamada.

Servidores também ficaram baratos. O Claude Code agora carrega apenas os nomes das ferramentas de um servidor e busca os detalhes sob demanda. Isso dá cerca de 45 tokens por ferramenta, seja qual for a função dela. Com os oito instalados, os custos simplesmente se somam. Nada se multiplica.

O Claude Code tem um comando que projeta esse custo para um plugin, e ele lista os hooks como gratuitos. Para um plugin usado todo dia nessa máquina, ele projetou cerca de 540 tokens. A medição foi de 744, porque o hook de arranque dele imprime direto na sessão.

O arranque não é onde esses repositórios ficam caros. São os turnos.

Mesmas tarefas, com e sem

O benchmark são três tarefas que um desenvolvedor realmente delegaria: um bug em como um endereço web é montado, uma funcionalidade que mostra o tempo de leitura, e um contador de caracteres em um formulário. Cada tarefa rodou com um repositório instalado, com os oito, e sem nenhum, três execuções de cada vez. O juiz é um teste que o agente nunca vê, mais o conjunto de testes do próprio projeto, mais o verificador de tipos. Toda execução usou a mesma lista fixa de ferramentas permitidas, sem burlar permissões.

Resultado Valor
Execuções de tarefas 63
Aprovações 63
Novos erros de tipo 0
Chamadas aos três servidores conectados 0
Correção de bug, referência 7 turnos, 27 segundos
Tarefa do formulário, referência 22 turnos, cerca de 1 minuto

Nada fez o Claude falhar em uma tarefa, e nada o fez passar em uma que ele teria falhado sem aquilo.

Três desses repositórios conectam um servidor cheio de ferramentas. Em 63 execuções, o Claude chamou essas ferramentas zero vezes. Isso inclui a tarefa do formulário, escrita justamente para que orientação de design e teste visual tivessem algo a fazer. Para ser justo, dois deles nunca chegaram a exercer sua função real. O Reticle precisa de um navegador pareado com o app em execução, e esse pareamento travou. O Ouroboros precisa de uma configuração em toda a máquina, e não recebeu isso.

O ruído é enorme. Mesmo prompt, mesma instalação: uma execução escreveu 4.300 tokens, outra escreveu 7.100. Só dois resultados superaram seu próprio ruído, ambos na tarefa mais curta. Uma única demonstração de antes-e-depois não prova nada.

Os 52% do Chisle, no trabalho real de código

Chisle é um plugin de compressão de saída, e o único dos oito que promete um número: seu benchmark diz que sua conta cai para 52%. Nas três tarefas, a saída ficou em 94% da referência. O README explica por quê, com suas próprias palavras: esses números são de prompts únicos sem ferramentas, não do custo de uma sessão inteira.

Medida Valor
Promessa do benchmark do Chisle saída em 52%
Chisle nas três tarefas saída em 94% da referência
O plugin de concisão de uso diário, mesmas tarefas 113%, dentro do ruído
Uma correção de bug: tokens lidos 95.000
Uma correção de bug: tokens escritos 1.700

Em uma sessão de código real, a saída é o lado pequeno da conta. O Chisle carrega suas regras no início e gruda um lembrete em cada prompt que você envia, então suas execuções custaram mais que a referência em duas tarefas de três. As regras pesam mais do que as palavras que economizam. Seu compressor de saída de ferramentas rodou em toda sessão e nunca registrou uma economia.

Nenhum dos dois plugins economizou algo mensurável. Um usuário do Chisle encontrou o mesmo resultado em 173 sessões, e o autor diz que esse bug já foi corrigido. Mérito onde é devido: o Chisle publica suas próprias perdas, e o tratamento de arquivos dele é cuidadosamente reforçado.

A regra a se tirar daqui: um plugin que fala em todo turno é o tipo mais caro que existe.

As instalações que saem do seu projeto

Escopo de instalação é até onde a configuração de um repositório alcança para além da pasta onde você o rodou. Tudo aqui foi instalado dentro de uma única pasta, de propósito, para que nada tocasse o resto da máquina.

O comando de configuração do Reticle tinha outros planos. Seu próprio log diz que ele se registrou com mais 8 agentes: VS Code, Copilot, Warp, Kiro, Amazon Q, Cline, Amp, e mais um. No Gemini, ele se aprovou antecipadamente. Nas configurações do Claude Code, ele adicionou uma regra que aprova suas próprias ferramentas. Nada disso está escondido, está bem ali no código-fonte, o instalador é explícito sobre o que faz, e ele vem com um comando de desinstalação. Mas foi dada apenas uma flag de confirmação, para um projeto.

O Caliper deveria ser a ferramenta de medição. Seu harness lança o Claude com toda verificação de permissão desligada, sem opção de mudar isso, e copia suas credenciais de login para cada execução de teste. Ele nunca foi rodado; um executor personalizado o substituiu.

Repositório Instala de forma limpa dentro de um projeto? Notas
Anti-Slop Sim Copia arquivos e nada mais
UI Skills Sim Biblioteca remota de skills
img2threejs Sim Uma skill
FWC SwiftUI Skills Sim Texto simples
Reticle Parcialmente Se registrou com 8 outros agentes, regra de autoaprovação
Chisle Não Só global, verifica atualizações no arranque, salva a saída bruta das ferramentas em disco
Ouroboros Não Só em toda a máquina, reporta uso por padrão, o instalador pode canalizar um script da internet direto para o seu shell
Caliper Não rodado Verificações de permissão desligadas, credenciais copiadas em cada execução

Nada disso é malware. É conveniência que assume que você quer a ferramenta em todo lugar. Abra três coisas antes de qualquer instalação: os hooks, o script de instalação, e a configuração do servidor.

O que acontece quando eles se empilham

Empilhar significa os oito instalados juntos: sem travamento, sem erro, e os custos se somam quase exatamente. Uma armadilha custou uma hora. Em execuções automatizadas, um servidor de projeto espera uma aprovação que ninguém pode dar, então ele parece quase gratuito. Cada número de servidor aqui foi medido de novo depois de corrigir isso.

Os hooks são onde os repositórios se encontram. Um hook é um script que o Claude Code roda em um momento fixo, e o que ele imprime pode acabar diante do modelo. Com três dessas ferramentas conectadas, três scripts disparam no arranque e mais três em cada prompt. Uma frase comum digitada chegou ao modelo com duas notas anexadas: uma dizendo para escrever de forma concisa, outra exigindo uma etapa de configuração que não pode ser concluída dentro de um projeto. Essa segunda nota volta a cada prompt que contém uma de suas palavras-chave.

Nomes de ferramentas não conseguem colidir, porque todo servidor prefixa o seu próprio. Para os hooks, a documentação confirma: quando vários hooks adicionam contexto, o Claude recebe todos os valores.

Um estudo de maio de 2026 mediu o que uma pilha grande de skills faz a um agente. Com cerca de 200 skills, a taxa de aprovação caiu até 21%, e a maior parte dessa perda vem do agente escolher uma skill parecida em vez da certa. Oito repositórios são 10 skills, longe disso. Quem tem dezenas instaladas, não está.

O que mudou o código

Anti-Slop é um conjunto de regras de lint que você copia para o seu projeto, não um plugin. Não há pacote para instalar; o autor quer que você copie as regras e as altere. Um linter lê seu código fora do modelo, então não custa contexto: 95 tokens para sua skill auxiliar, e nada por turno.

Na tarefa do formulário, o Claude teve que ligar um novo campo através de um componente. Ele copiou a linha acima, conversão de tipo insegura incluída. O Anti-Slop sinalizou isso, três execuções em três. É o tipo de coisa que um revisor deixa passar, porque parece igual às vizinhas.

Achado do Anti-Slop Valor
Conversão de tipo insegura sinalizada 3 execuções em 3
Linha em branco faltando sinalizada em uma função correta de seis linhas 2 execuções em 3
Achados no projeto intocado 109
Parcela desses vinda de duas regras de estilo 83%
Outras regras 16

O achado da linha em branco é uma questão de estilo, não um bug, e o linter só lê um arquivo por vez. O custo aparece no primeiro dia: decida sobre essas duas regras de estilo antes de julgar as outras 16. Uma pegadinha: as regras vêm como módulos, então seu projeto precisa se declarar módulo também, ou o linter trava.

UI Skills é o mais barato de manter: 37 tokens por uma biblioteca remota de skills de design, e zero chamadas nessas execuções. Ele tinha 18 links quebrados em julho. Todos os 300 foram testados na manhã do vídeo, e nenhum está quebrado.

O que eu mantenho, e como checar sua própria configuração

Oito repositórios classificados. A expectativa era de três que valessem a pena. Os dados dão um que realmente merece, e três que são livres para manter.

Repositório Veredito
Anti-Slop Merece: pegou um erro real toda vez, por quase nada
UI Skills Livre para manter: 37 tokens, não colide com nada
img2threejs, FWC SwiftUI Skills Livres para manter se você algum dia for chamá-los: algumas centenas de tokens juntos
Chisle Custou mais do que economizou no trabalho real de código
Caliper Nunca rodou
Reticle, Ouroboros Querem a máquina inteira, nunca vistos fazendo o trabalho real deles, então sem veredito sobre para que servem

O próprio mantenedor do Ouroboros conta cerca de 40% de suas execuções falhando.

Os limites importam: um projeto React, um modelo, três tarefas, três execuções cada. Com um ruído tão largo, efeitos pequenos ficam invisíveis. O que os dados de fato resolvem é que a base é alta. O Claude passou em tudo com ou sem essas ferramentas, e ferramentas que ficam no contexto esperando serem chamadas, na maioria das vezes, não são chamadas. Elas precisam de um fluxo de trabalho que as busque.

Você pode checar sua própria configuração em dois minutos. Um comando mostra o que está carregado agora. Um projeta o custo de um plugin, e lembre-se de que ele conta os hooks como gratuitos. Um reporta quanto cada skill custa e com que frequência é usada. E antes de qualquer instalação, abra os hooks, o script de instalação, e a configuração do servidor.

Fontes

Perguntas frequentes

Quais repositórios do Claude Code realmente valem a pena instalar?
De oito repositórios testados em um projeto React real, só o Anti-Slop merece seu lugar: suas regras de lint pegaram uma conversão de tipo insegura real em três execuções de três, por quase nenhum custo de contexto. UI Skills, img2threejs e FWC SwiftUI Skills custam algumas centenas de tokens juntos e não colidem com nada, então são livres para manter se você algum dia for chamá-los.
Quantos tokens os plugins do Claude Code adicionam no arranque?
Um projeto vazio já carrega cerca de 17.000 tokens. Neste teste, o Chisle adicionou cerca de 3.500, o Ouroboros 1.600, o Reticle 900 e o UI Skills 37, e os oito repositórios juntos adicionaram menos de 7.000. Skills carregam só a descrição até serem chamadas, e um servidor MCP custa cerca de 45 tokens por ferramenta.
O Chisle realmente reduz a conta do Claude Code para 52%?
Não no trabalho real de código. Em três tarefas de desenvolvedor, a saída ficou em 94% da referência, e as execuções do Chisle custaram mais que a referência em duas de três tarefas, porque ele carrega regras no arranque e adiciona um lembrete a cada prompt. Seu README diz que o número de 52% vem de prompts únicos sem ferramentas, não do custo de uma sessão inteira.
Plugins do Claude Code fazem o Claude passar em mais tarefas de código?
Não neste teste. Em 63 execuções de três tarefas, com cada repositório, com os oito e sem nenhum, toda execução passou em um teste oculto, no conjunto de testes do projeto e no verificador de tipos. O ruído entre execuções foi grande, de 4.300 a 7.100 tokens de saída para o mesmo prompt, então uma única demonstração de antes-e-depois não prova nada.
É seguro instalar repositórios populares do Claude Code?
Nenhum dos oito é malware, mas vários alcançam além do projeto. A configuração do Reticle se registrou com 8 outros agentes e adicionou uma regra aprovando suas próprias ferramentas, o Caliper lança o Claude com toda verificação de permissão desligada e copia credenciais de login em cada execução, e o Chisle e o Ouroboros só instalam em toda a máquina. Abra os hooks, o script de instalação e a configuração do servidor antes de qualquer instalação.
O que acontece quando você instala muitos plugins do Claude Code juntos?
Os oito instalados juntos não travaram, e seus custos de arranque simplesmente se somam. Os hooks são onde eles se encontram: com três ferramentas baseadas em hooks, uma frase digitada chegou ao modelo com duas notas injetadas. Um estudo de maio de 2026 encontrou taxas de aprovação caindo até 21% com cerca de 200 skills, na maior parte pelo agente escolher uma skill parecida em vez da certa.

Vídeos relacionados