Liczba, której nikt nie sprawdza
Everything Claude Code, zwykle skracane do ECC, to repozytorium konfiguracji Claude Code opublikowane przez Affaana Mustafę po tym, jak wygrał hackathon Anthropic i wydał produkt zbudowany w całości przez agentów. Dziś ma około 250 000 gwiazdek na GitHubie.
Liczby przytaczane na jego temat nie zgadzają się ze sobą, a ta rozbieżność sporo mówi. Film, który przyniósł ECC szeroką publiczność, opublikowany cztery dni przed tym pomiarem, mówił o 64 agentach i 262 skillach. README samego repozytorium, w dniu, w którym je sklonowaliśmy, mówiło o 68 agentach i 286 skillach.
| Źródło | Agenci | Skille |
|---|---|---|
| Szeroko udostępniany film | 64 | 262 |
| README repozytorium, dzisiaj | 68 | 286 |
To nie są konkurencyjne wyliczenia. To starsze wyliczenia. Repozytorium zmienia się szybciej niż powstają filmy na jego temat, co jest niezłą miarą tego, ile warta jest pojedyncza liczba. Pod spodem leży pytanie zadane wprost na Reddicie i nigdy tak naprawdę nieodpowiedziane: nie czy ECC robi wrażenie, ale czy warto je instalować.
Czym właściwie jest ECC
ECC opisuje samo siebie jako system optymalizacji wydajności agent harness, obejmujący skille, instynkty, pamięć, bezpieczeństwo i rozwój oparty najpierw na researchu. Jego README ściska instalowaną pętlę do siedmiu słów: planuj, testuj, implementuj, recenzuj, weryfikuj, zapamiętuj, poprawiaj. Instalujesz raz i tak właśnie zaczyna pracować twój agent.
Policzone w świeżym klonie, repozytorium zawiera:
| Komponent | Liczba |
|---|---|
| Agenci | 68 |
| Skille | 286 |
| Komendy slash | 94 |
| Pliki reguł | 122 |
| Hooki (wszystkie w jednym pliku) | 23 |
README, które to wszystko opisuje, ma 2200 linii. Sam katalog dokumentacji waży 15 MB i jest przetłumaczony na 22 języki. Sklonowanie całego repozytorium ściąga 88 MB. Nie jest to też rozwiązanie wyłącznie dla Claude Code: ECC dostarcza konfigurację dla 19 różnych agentów i edytorów, od Codex i Cursor po Zed i Kimi.
To realny kawał pracy, a licencja jest MIT, co oznacza, że każdy jego element możesz skopiować. Problem zaczyna się dopiero wtedy, gdy instalujesz całość.
Rachunek za kontekst
Treść skilla jest czytana dopiero wtedy, gdy skill się odpali. Jego nazwa i opis siedzą jednak w twoim kontekście od pierwszego tokena każdej sesji. To samo dotyczy każdego subagenta. Te metadane to cena wstępu i akurat tę część pomijają filmy oprowadzające po repozytorium.
Zmierzone na świeżym klonie:
| Co ładuje się w każdej sesji | Rozmiar | Przybliżona liczba tokenów |
|---|---|---|
| 286 nazw i opisów skilli | 85 000 znaków | 21 000 |
| 68 opisów subagentów | 20 000 znaków | 5000 |
| Plik instrukcji samego repozytorium | — | 1000 |
| Łączny kontekst stały | — | ~27 000 |
Wobec okna kontekstowego o rozmiarze 200 000 tokenów pełna instalacja zajmuje około 14 procent, zanim napiszesz choć słowo. Czternaście procent brzmi znośnie, dopóki nie przypomnisz sobie, co dzieli z tym oknem miejsce: twoje pliki, twoje diffy, wyniki twoich narzędzi i sama rozmowa. Każdy skill, którego nigdy nie wywołasz, konkuruje z kodem, nad którym faktycznie pracujesz.
Repozytorium o tym wie. W jego własnym README stoi zdanie „optymalizuj okno kontekstowe, resztę utrwalaj”, po czym dostarcza 286 skilli. W wątku na Reddicie, który zadaje dokładnie to pytanie, najwyżej oceniona odpowiedź mówi, że zużycie tokenów przez opisy jest minimalne. Dwadzieścia jeden tysięcy tokenów to nie jest wartość minimalna.
Dwa uczciwe zastrzeżenia. Tokeny są tu szacowane po cztery znaki każdy, więc realna liczba zmienia się razem z tokenizerem. I nic z tego nie mówi, że skille są złe. Mówi, że nie są darmowe i że większość z nich nie jest twoja.
Element pierwszy i drugi: skaner i ustawienia
Pierwsze dwa elementy warte zabrania nie wymagają instalowania repozytorium w ogóle.
AgentShield to audytor bezpieczeństwa konfiguracji agentów. Jest dostarczany wewnątrz ECC, a także żyje na npm jako osobna paczka, gdzie zebrał 5500 pobrań w tydzień. Jedno polecenie kieruje go na katalog; audytuje twoje pliki agentów, twoje hooki, twoje serwery, twoje uprawnienia i twoje sekrety, a przyjmuje flagi na format wyjścia, próg istotności i bezpieczne automatyczne poprawki. Jego README tłumaczy powód istnienia liczbami ze stycznia: 12 procent jednego marketplace'u ze skillami dla agentów okazało się złośliwe, czyli 341 skilli z 2800, a jedno włamanie ujawniło 1,5 miliona tokenów API. To są twierdzenia paczki, nie nasze pomiary.
Jej ograniczeniem jest data. AgentShield opublikowano ostatnio w marcu, podczas gdy samo repozytorium zaktualizowano dzień przed naszym pomiarem, a jego README wciąż opisuje ekosystem na poziomie 42 000 gwiazdek wobec 250 000 dzisiaj. Skaner jest sześć miesięcy za rzeczą, z którą jest dostarczany.
Blok ustawień nic nie kosztuje w próbie. README publikuje cztery zmiany:
| Ustawienie | Zmiana |
|---|---|
| Model domyślny | Ustawiony na Sonnet |
| Budżet myślenia | Z 32 000 w dół do 10 000 |
| Próg compaction | Z 95 procent w dół do 50 procent |
| Subagenci | Przeniesieni na najtańszy model |
README twierdzi, że daje to około 60 procent oszczędności na koszcie modelu i 70 procent na ukrytym koszcie myślenia. To jego liczby, nie nasze, i opisują one transakcję wymienną: mniejszy model domyślny i tani subagenci będą cię kosztować przy trudnych recenzjach.
Element trzeci: instynkty
Instynkty to jedyny pomysł w tym repozytorium, którego nie widzieliśmy nigdzie indziej. Instynkt to małe wyuczone zachowanie z wagą pewności. Nie reguła, którą napisałeś, tylko wzorzec, który system zauważył w tym, co powtarzasz, i zapisał za ciebie.
Pierwsza wersja obserwowała tylko na końcu sesji. Obecna obserwuje przed i po każdym wywołaniu narzędzia, dlatego w ogóle cokolwiek wyłapuje. Każdy instynkt ma wagę między 0,3 a 0,9, a analiza działa w agencie działającym w tle na tanim modelu, więc nie zjada twojego głównego kontekstu, żeby wykonać swoją pracę.
Wersja 2.1 uczyniła instynkty ograniczonymi do projektu, więc twoje wzorce reactowe zostają w projekcie reactowym. Własne słowo repozytorium na to, co zostało w ten sposób naprawione, brzmi: kontaminacja. Kiedy ten sam instynkt pojawia się w dwóch różnych projektach, zostaje awansowany do poziomu globalnego: system decyduje, co jest uniwersalne, obserwując, zamiast pytać ciebie.
To nie jest zaślepka. Narzędzie za tym stojące ma 2200 linii i sześć komend, a droga, którą opisuje, wiedzie od instynktów przez klastry do prawdziwego skilla. Instynkty są też przenośne: eksportujesz swoją bibliotekę, przekazujesz ją komuś z zespołu, a ta osoba ją importuje, co jest pierwszą sensowną odpowiedzią, jaką widzieliśmy, na wdrożenie człowieka w konfigurację agenta.
Haczyk to runtime hooków. Wszystko to na nim jedzie, a runtime hooków to dokładnie ta część repozytorium, na którą musisz się świadomie zgodzić. Odmów hooków, a nie dostaniesz instynktów. Waga pewności jest zresztą heurystyką, a nie pomiarem.
Element czwarty i piąty: bierz tylko to, czego potrzebujesz
Element numer cztery to trzy skille, które rozliczają kontekst, zamiast go wydawać: budżet kontekstu, doradca compaction i doradca budżetu tokenów. Repozytorium, które kosztuje cię 14 procent, dostarcza też narzędzia, żeby to zobaczyć. Sama reguła compaction jest warta zabrania: rób compaction po researchu i przed implementacją, po kamieniu milowym, po debugowaniu, po nieudanym podejściu, i nigdy w środku implementacji, gdzie tracisz ścieżki plików i niedokończony stan.
Element numer pięć to instalator, czyli to, co sprawia, że pozostała czwórka jest w zasięgu. Dostarcza siedem profili, a najmniejszy z nich mówi we własnym opisie, że pomija runtime hooków w całości. Możesz też zrezygnować z profili i wskazać potrzebne skille po kolei, a doradca przyjmuje zwykłe zdanie o twojej pracy i zwraca pasujące komponenty, z podglądem, zanim cokolwiek zostanie zapisane na dysku. Instalator odmawia też zgadywania w sprawie hooków: każda instalacja, która wgrałaby runtime hooków na twoją maszynę, zatrzymuje się, wypisuje, co te hooki mogą zrobić, i czeka na tak lub nie.
Zainstaluj w ten sposób, a rachunek przestaje wynosić 14 procent i staje się jego ułamkiem. Nie podajemy liczby dla tego ułamka, bo nie zmierzyliśmy każdej kombinacji. Dolna granica jest jednak uczciwa: nawet najmniejszy profil wciąż niesie agentów i reguły, więc wskazanie skilli ręcznie to jedyny sposób, żeby płacić dokładnie za to, czego używasz.
Co zostawić w repozytorium
68 agentów jako komplet. Kosztują około 5000 tokenów stałego kontekstu, a większość z nich to recenzenci języków i naprawiacze buildów dla C++, C#, Django i Kotlina, dla stacków, w których nie piszesz. Weź te dwa, które pasują do twojej pracy. Ten zestaw nie jest pakietem nie do rozbicia.
94 komendy slash. README samo traktuje je jako tymczasowe, nazywając je wygodnymi punktami wejścia na czas, gdy repozytorium przechodzi na powierzchnię opartą przede wszystkim na skillach, a jest tam też katalog komend wycofanych. Komendy są zresztą najłatwiejszą rzeczą w tym ekosystemie do napisania samemu.
Plik z hookami. Każdy hook w tej konfiguracji mieszka w jednym pliku: 291 linii, 40 KB, 23 hooki, z czego 8 uruchamia się przed każdym wywołaniem narzędzia, a 7 za każdym razem, gdy agent się zatrzymuje. Kodu nie ma w skrypcie, który mógłbyś otworzyć. Każdy hook jest wciśnięty w jedną linię, 33 000 znaków tego, przy czym najdłuższa pojedyncza linia sięga 2000 znaków.
Bądźmy uczciwi: opisy obok nich są czytelne, a niektóre są dobre. Jeden blokuje agentowi edycję konfiguracji lintera i wyjaśnia dlaczego, kierując agenta ku naprawie kodu zamiast osłabiania reguł. To jest hook wart posiadania. Problemem nie jest intencja. Kod jest publiczny i jest na MIT. Problem polega na tym, że intencja to jedyna część, którą możesz przeczytać, a repozytorium mówi to pierwsze: hooki uruchamiają polecenia powłoki i należy je traktować jak wykonywalną konfigurację.
Balast. Konfiguracja dla 19 harnessów i 15 MB dokumentacji w 22 językach, dla narzędzia, którego używasz w jednym języku, w jednym miejscu.
Werdykt
Rabuj, nie instaluj. Pięć elementów, które przechodzą audyt, to skaner, blok ustawień, system instynktów, trzy skille liczące twój kontekst oraz instalator, który daje ci pierwszą czwórkę bez reszty.
Liczbą, która o tym rozstrzyga, jest 27 000 tokenów stałego kontekstu przy pełnej instalacji wobec okna o rozmiarze 200 000. Licencja czyni ten rabunek legalnym: to MIT, a skopiowanie pięciu katalogów z tego repozytorium jest zamierzonym użyciem, a nie obejściem.
Na Reddicie ludzie wciąż pytają, czy wybrać Superpowers, czy ECC. To nie są rzeczy tego samego rodzaju. Jedna to dyscyplina pracy agenta, druga to skrzynka z częściami, a odpowiedzią na skrzynkę z częściami jest wzięcie części.
Dwa ograniczenia tego wszystkiego. Wszystko tutaj zmierzono na wersji 2.2.1; repozytorium zaktualizowano dzień wcześniej i czeka w nim 110 otwartych pull requestów, więc się rusza. I nic z tego nie mierzy, czy skille poprawiają odpowiedzi. Mierzy, ile kosztuje cię ich posiadanie. To są różne pytania i tylko jedno z nich mieści się w filmie.
AIDive