--- title: "Zasady 4 CLAUDE.md Karpathy'ego zmniejszają błędy o 30%. Dodałem jeszcze 4, żeby jeszcze bardziej zmniejszyć liczbę do mniej niż 5." source: "https://medium.com/tech-and-ai-guild/karpathys-4-claude-md-rules-cut-mistakes-by-30-i-added-4-more-to-further-cut-it-down-to-5-3f2f03cbc969" author: - "[[Shashwat]]" published: 2026-05-13 created: 2026-06-15 description: "Architektura 8 reguł, która naprawia agentów AI" tags: - "clippings" --- ## Architektura 8 reguł, która naprawia agentów AI ![](https://miro.medium.com/v2/resize:fit:1400/format:webp/0*PeOH4O3aYQ7c-rms) Zdjęcie: Andrea De Santis na Unsplash > Po przekroczeniu 200 linii szybka zgodność gwałtownie spada, a twój agent cicho cię ignoruje xD > Więc jeśli nie projektujesz swoich ograniczeń, to tylko marnujesz tokeny! Jestem pewien, że wiesz, iż w styczniu 2026 roku **Andrej Karpathy** publicznie rozłożył na czynniki pierwsze, dlaczego kod Claude'a zawodził w produkcyjnych bazach kodu: *ciche założenia, nadmierna inżynieria i ortogonalne uszkodzenia.* I, Programista zapakował te skargi do uproszczonego, 4-zasadowego pliku.`CLAUDE.md` Eksplodowało to, stając się najszybciej rozwijającym się repozytorium GitHub w tym roku. Ale teraz, w maju, ekosystem AI porusza się jeszcze bardziej agresywnie. Obecnie prowadzimy coraz więcej wieloetapowych, autonomicznych przepływów pracy agentów. > *Kiedy wdrażałem autonomicznych agentów do refaktoryzacji warstwy pobierania danych, napotkałem tę przeszkodę:* > > *Agent wykonał trzy kroki perfekcyjnie, miał halucynacje na czwartym kroku i cicho nadpisał działający kod.* **Pierwotne zasady Karpathy'ego nie chroniły przed wieloetapową degradacją.** [Czytanie bezpłatne dla osób spoza członków](https://medium.com/@shashwatwrites/3f2f03cbc969?sk=d6a7c956d48f8281e73ab29787b9dfb4) To udowodniło, że choć oryginalne cztery zasady to podłoga, to nie są one sufitem. Projektując dokładnie 4 *dodatkowe* zasady specjalnie dla nowoczesnej orkiestracji agentów, wskaźnik błędów AI jeszcze bardziej się zmniejszył. Zrobiłem trzy od operatora na X i jeden z bloga! ### Fundacja: 4 zasady Karpathy'ego Wirusowa implementacja skarg Karpathy'ego ustanowiła punkt wyjścia. Te cztery blokują około 40% standardowych, pojedynczych mechanizmów awarii: 1. **Pomyśl przed zaprogramowaniem:** Bez cichych założeń. Sprzeciw się, jeśli istnieje prostsze podejście. 2. **Najpierw prostota:** Wymagany minimalny kod. Brak spekulatywnych cech. 3. **Zmiany chirurgiczne:** Dotykaj tylko tego, co musisz. Nie "poprawiaj" sąsiedniego formatowania. 4. **Realizacja ukierunkowana na cel:** Określ kryteria sukcesu i powtarzaj pętlę do zweryfikowania, zamiast ślepo podążać za sztywnymi krokami. **Dlaczego dziś się psują:** Te zasady są całkowicie nieobecne w przypadku wieloetapowych potoków. Nie dają agentowi tokenowego budżetu, nie wymuszają punktów kontrolnych i zakładają, że agent już rozumie otaczający kod. ### Warstwa Wykonawcza: 4 nowe zasady agentów **5\. Twarde budżety tokenów** Bez budżetów agent looping będzie nagrywał kontekstowy zrzut 50 000 tokenów, debugując ten sam komunikat o błędzie, aż aż zwariuje. *Zasada:* Ustal twardy budżet na zadanie (np. 4 000 tokenów) i budżet na sesję (30 000 tokenów). Jeśli dojdzie do naruszenia, zmuszaj agenta do podsumowania i ponownego rozpoczęcia sesji. Ujawnienie naruszenia jest zawsze lepsze niż ciche przekroczenie limitów API. **6\. Przeczytaj przed pisaniem** Zasady Karpathy'ego mówią "nie dotykaj sąsiedniego kodu", ale nie "rozumiem sąsiedniego kodu". To prowadzi do tego, że AI ślepo pisze zduplikowane funkcje, które już istnieją 30 linii dalej. *Zasada:* Przed dodaniem kodu do pliku zmuszcie agenta do odczytania eksportów pliku, natychmiastowych wywołujących i współdzielonych narzędzi. "Wygląda ortogonalnie" to niebezpieczne założenie. **7\. Operacje wieloetapowe z punktami kontrolnymi** Jeśli 6-stopniowa refaktoryzacja pójdzie nie tak w kroku 4, agent chętnie wykona kroki 5 i 6 na podstawie uszkodzonego stanu, niszcząc całą gałąź i wymuszając ręczne wykonanie.`git reset` *Zasada:* Po każdym istotnym kroku agent musi podsumować, co zostało zweryfikowane, a co pozostało. Nie może kontynuować ze stanu, którego nie potrafi ci opisać. **8\. Głośna porażka** Najdroższe porażki wyglądają dokładnie jak sukcesy. "Migracja zakończona" to kłamstwo, jeśli 30 rekordów bazy danych zostało cicho pominiętych z powodu naruszeń ograniczeń. *Zasada:* Domyślnie wywołuj niepewność. Jeśli agent coś pominął lub test przeszedł z niewłaściwych powodów, test musi się przegłosować i natychmiast powiadomić użytkownika. ![](https://miro.medium.com/v2/resize:fit:1400/format:webp/0*9zpXaC6sZKMrOMOP) Zdjęcie: Gabriel Heinzer na Unsplash Rzeczywistość jest taka, że po pewnym czasie Claude przestaje czytać zasady i po prostu dopasowuje się do faktu, że "zasady istnieją". Ograniczając plik do dokładnie 8 reguł o dużym wpływie, wskaźnik zgodności pozostaje powyżej 75%, a wskaźnik błędów spada niemal do zera. ### Architektura MistrzaCLAUDE.md Skopiuj ten dokładny tekst, zapisz go w swoim repozytorium i dołącz poniżej wszelkie niezbędne szczegóły stosu projektów.`CLAUDE.md` ```hs # CLAUDE.md — 8-Rule Architecture These rules apply to every task in this project unless explicitly overridden. Bias: caution over speed on non-trivial work. Use judgment on trivial tasks. ``` ```hs ## Rule 1 — Think Before Coding State assumptions explicitly. If uncertain, ask rather than guess. Push back when a simpler approach exists. Stop when confused.## Rule 2 — Simplicity First Minimum code that solves the problem. Nothing speculative. No features beyond what was asked. No abstractions for single-use code.## Rule 3 — Surgical Changes Touch only what you must. Clean up only your own mess. Don't "improve" adjacent code, comments, or formatting. Match existing style.## Rule 4 — Goal-Driven Execution Define success criteria. Loop until verified. Don't follow steps. Define success and iterate independently.## Rule 5 — Token budgets are not advisory Per-task: 4,000 tokens. Per-session: 30,000 tokens. If approaching budget, summarize and start fresh. Surface the breach. ## Rule 6 — Read before you write Before adding code, read exports, immediate callers, shared utilities. If unsure why code is structured a certain way, ask.## Rule 7 — Checkpoint after every significant step Summarize what was done, what's verified, what's left. Don't continue from a state you can't describe back. Stop and restate.## Rule 8 — Fail loud "Completed" is wrong if anything was skipped silently. "Tests pass" is wrong if any were skipped. Default to surfacing uncertainty, not hiding it. ``` `CLAUDE.md` jest ścisłym kontraktem behawioralnym mającym na celu zamknięcie konkretnych, kosztownych mechanizmów awarii. Początkowe zastrzeżenia Karpathy'ego definiowały problemy kodowania autouzupełniającego. Teraz organizujemy autonomicznych, wieloetapowych agentów. > Zamknij swoje środowiska, wymusz budżety tokenów i zażądaj punktów kontrolnych. *Jeśli spotykamy się po raz pierwszy, przyjdź* [*tutaj*](https://medium.com/@shashwatwrites/subscribe)*, warto będzie przeżyć kolejkę górską artykułów, które pojawią się w najbliższych tygodniach.* *Przysięgam, śledzenie tych aktualizacji to ostatnio praca sama w sobie.* *Oto* [*lista*](https://medium.com/@shashwatwrites/list/ai-updates-bbb9d001b651)*, którą zbudowałem i ciągle ją uzupełniam*. *A jeśli potrzebujesz pomocy w analizie walk UFC,* *sprawdź* [*BoutPredict*](https://boutpredict.aibucket.org/) *:)*