Files
DBAdmin/brain/raw/articles/Zasady 4 CLAUDE.md Karpathy'ego zmniejszają błędy o 30%. Dodałem jeszcze 4, żeby jeszcze bardziej zmniejszyć liczbę do mniej niż 5..md
T
2026-06-18 09:30:46 +00:00

7.7 KiB

title, source, author, published, created, description, tags
title source author published created description tags
Zasady 4 CLAUDE.md Karpathy'ego zmniejszają błędy o 30%. Dodałem jeszcze 4, żeby jeszcze bardziej zmniejszyć liczbę do mniej niż 5. https://medium.com/tech-and-ai-guild/karpathys-4-claude-md-rules-cut-mistakes-by-30-i-added-4-more-to-further-cut-it-down-to-5-3f2f03cbc969
Shashwat
2026-05-13 2026-06-15 Architektura 8 reguł, która naprawia agentów AI
clippings

Architektura 8 reguł, która naprawia agentów AI

Zdjęcie: Andrea De Santis na Unsplash

Po przekroczeniu 200 linii szybka zgodność gwałtownie spada, a twój agent cicho cię ignoruje xD

Więc jeśli nie projektujesz swoich ograniczeń, to tylko marnujesz tokeny!

Jestem pewien, że wiesz, iż w styczniu 2026 roku Andrej Karpathy publicznie rozłożył na czynniki pierwsze, dlaczego kod Claude'a zawodził w produkcyjnych bazach kodu:

ciche założenia, nadmierna inżynieria i ortogonalne uszkodzenia.

I,

Programista zapakował te skargi do uproszczonego, 4-zasadowego pliku.CLAUDE.md

Eksplodowało to, stając się najszybciej rozwijającym się repozytorium GitHub w tym roku.

Ale teraz, w maju, ekosystem AI porusza się jeszcze bardziej agresywnie.

Obecnie prowadzimy coraz więcej wieloetapowych, autonomicznych przepływów pracy agentów.

Kiedy wdrażałem autonomicznych agentów do refaktoryzacji warstwy pobierania danych, napotkałem tę przeszkodę:

Agent wykonał trzy kroki perfekcyjnie, miał halucynacje na czwartym kroku i cicho nadpisał działający kod.

Pierwotne zasady Karpathy'ego nie chroniły przed wieloetapową degradacją.

Czytanie bezpłatne dla osób spoza członków

To udowodniło, że choć oryginalne cztery zasady to podłoga, to nie są one sufitem.

Projektując dokładnie 4 dodatkowe zasady specjalnie dla nowoczesnej orkiestracji agentów, wskaźnik błędów AI jeszcze bardziej się zmniejszył.

Zrobiłem trzy od operatora na X i jeden z bloga!

Fundacja: 4 zasady Karpathy'ego

Wirusowa implementacja skarg Karpathy'ego ustanowiła punkt wyjścia. Te cztery blokują około 40% standardowych, pojedynczych mechanizmów awarii:

  1. Pomyśl przed zaprogramowaniem: Bez cichych założeń. Sprzeciw się, jeśli istnieje prostsze podejście.
  2. Najpierw prostota: Wymagany minimalny kod. Brak spekulatywnych cech.
  3. Zmiany chirurgiczne: Dotykaj tylko tego, co musisz. Nie "poprawiaj" sąsiedniego formatowania.
  4. Realizacja ukierunkowana na cel: Określ kryteria sukcesu i powtarzaj pętlę do zweryfikowania, zamiast ślepo podążać za sztywnymi krokami.

Dlaczego dziś się psują: Te zasady są całkowicie nieobecne w przypadku wieloetapowych potoków. Nie dają agentowi tokenowego budżetu, nie wymuszają punktów kontrolnych i zakładają, że agent już rozumie otaczający kod.

Warstwa Wykonawcza: 4 nowe zasady agentów

5. Twarde budżety tokenów

Bez budżetów agent looping będzie nagrywał kontekstowy zrzut 50 000 tokenów, debugując ten sam komunikat o błędzie, aż aż zwariuje.

Zasada: Ustal twardy budżet na zadanie (np. 4 000 tokenów) i budżet na sesję (30 000 tokenów). Jeśli dojdzie do naruszenia, zmuszaj agenta do podsumowania i ponownego rozpoczęcia sesji. Ujawnienie naruszenia jest zawsze lepsze niż ciche przekroczenie limitów API.

6. Przeczytaj przed pisaniem

Zasady Karpathy'ego mówią "nie dotykaj sąsiedniego kodu", ale nie "rozumiem sąsiedniego kodu". To prowadzi do tego, że AI ślepo pisze zduplikowane funkcje, które już istnieją 30 linii dalej.

Zasada: Przed dodaniem kodu do pliku zmuszcie agenta do odczytania eksportów pliku, natychmiastowych wywołujących i współdzielonych narzędzi. "Wygląda ortogonalnie" to niebezpieczne założenie.

7. Operacje wieloetapowe z punktami kontrolnymi

Jeśli 6-stopniowa refaktoryzacja pójdzie nie tak w kroku 4, agent chętnie wykona kroki 5 i 6 na podstawie uszkodzonego stanu, niszcząc całą gałąź i wymuszając ręczne wykonanie.git reset

Zasada: Po każdym istotnym kroku agent musi podsumować, co zostało zweryfikowane, a co pozostało. Nie może kontynuować ze stanu, którego nie potrafi ci opisać.

8. Głośna porażka

Najdroższe porażki wyglądają dokładnie jak sukcesy. "Migracja zakończona" to kłamstwo, jeśli 30 rekordów bazy danych zostało cicho pominiętych z powodu naruszeń ograniczeń.

Zasada: Domyślnie wywołuj niepewność. Jeśli agent coś pominął lub test przeszedł z niewłaściwych powodów, test musi się przegłosować i natychmiast powiadomić użytkownika.

Zdjęcie: Gabriel Heinzer na Unsplash

Rzeczywistość jest taka, że po pewnym czasie Claude przestaje czytać zasady i po prostu dopasowuje się do faktu, że "zasady istnieją".

Ograniczając plik do dokładnie 8 reguł o dużym wpływie, wskaźnik zgodności pozostaje powyżej 75%, a wskaźnik błędów spada niemal do zera.

Architektura MistrzaCLAUDE.md

Skopiuj ten dokładny tekst, zapisz go w swoim repozytorium i dołącz poniżej wszelkie niezbędne szczegóły stosu projektów.CLAUDE.md

# CLAUDE.md  8-Rule Architecture
These rules apply to every task in this project unless explicitly overridden.
Bias: caution over speed on non-trivial work. Use judgment on trivial tasks.
## Rule 1  Think Before Coding
State assumptions explicitly. If uncertain, ask rather than guess.
Push back when a simpler approach exists. Stop when confused.## Rule 2  Simplicity First
Minimum code that solves the problem. Nothing speculative.
No features beyond what was asked. No abstractions for single-use code.## Rule 3  Surgical Changes
Touch only what you must. Clean up only your own mess.
Don't "improve" adjacent code, comments, or formatting. Match existing style.## Rule 4  Goal-Driven Execution
Define success criteria. Loop until verified.
Don't follow steps. Define success and iterate independently.## Rule 5  Token budgets are not advisory
Per-task: 4,000 tokens. Per-session: 30,000 tokens.
If approaching budget, summarize and start fresh. Surface the breach. ## Rule 6  Read before you write
Before adding code, read exports, immediate callers, shared utilities.
If unsure why code is structured a certain way, ask.## Rule 7  Checkpoint after every significant step
Summarize what was done, what's verified, what's left.
Don't continue from a state you can't describe back. Stop and restate.## Rule 8  Fail loud
"Completed" is wrong if anything was skipped silently.
"Tests pass" is wrong if any were skipped.
Default to surfacing uncertainty, not hiding it.

CLAUDE.md jest ścisłym kontraktem behawioralnym mającym na celu zamknięcie konkretnych, kosztownych mechanizmów awarii.

Początkowe zastrzeżenia Karpathy'ego definiowały problemy kodowania autouzupełniającego.

Teraz organizujemy autonomicznych, wieloetapowych agentów.

Zamknij swoje środowiska, wymusz budżety tokenów i zażądaj punktów kontrolnych.

Jeśli spotykamy się po raz pierwszy, przyjdź tutaj, warto będzie przeżyć kolejkę górską artykułów, które pojawią się w najbliższych tygodniach.

Przysięgam, śledzenie tych aktualizacji to ostatnio praca sama w sobie.

Oto lista, którą zbudowałem i ciągle ją uzupełniam.

A jeśli potrzebujesz pomocy w analizie walk UFC, sprawdź BoutPredict :)