139 lines
7.7 KiB
Markdown
139 lines
7.7 KiB
Markdown
---
|
|
title: "Zasady 4 CLAUDE.md Karpathy'ego zmniejszają błędy o 30%. Dodałem jeszcze 4, żeby jeszcze bardziej zmniejszyć liczbę do mniej niż 5."
|
|
source: "https://medium.com/tech-and-ai-guild/karpathys-4-claude-md-rules-cut-mistakes-by-30-i-added-4-more-to-further-cut-it-down-to-5-3f2f03cbc969"
|
|
author:
|
|
- "[[Shashwat]]"
|
|
published: 2026-05-13
|
|
created: 2026-06-15
|
|
description: "Architektura 8 reguł, która naprawia agentów AI"
|
|
tags:
|
|
- "clippings"
|
|
---
|
|
## Architektura 8 reguł, która naprawia agentów AI
|
|
|
|

|
|
|
|
Zdjęcie: Andrea De Santis na Unsplash
|
|
|
|
> Po przekroczeniu 200 linii szybka zgodność gwałtownie spada, a twój agent cicho cię ignoruje xD
|
|
|
|
> Więc jeśli nie projektujesz swoich ograniczeń, to tylko marnujesz tokeny!
|
|
|
|
Jestem pewien, że wiesz, iż w styczniu 2026 roku **Andrej Karpathy** publicznie rozłożył na czynniki pierwsze, dlaczego kod Claude'a zawodził w produkcyjnych bazach kodu:
|
|
|
|
*ciche założenia, nadmierna inżynieria i ortogonalne uszkodzenia.*
|
|
|
|
I,
|
|
|
|
Programista zapakował te skargi do uproszczonego, 4-zasadowego pliku.`CLAUDE.md`
|
|
|
|
Eksplodowało to, stając się najszybciej rozwijającym się repozytorium GitHub w tym roku.
|
|
|
|
Ale teraz, w maju, ekosystem AI porusza się jeszcze bardziej agresywnie.
|
|
|
|
Obecnie prowadzimy coraz więcej wieloetapowych, autonomicznych przepływów pracy agentów.
|
|
|
|
> *Kiedy wdrażałem autonomicznych agentów do refaktoryzacji warstwy pobierania danych, napotkałem tę przeszkodę:*
|
|
>
|
|
> *Agent wykonał trzy kroki perfekcyjnie, miał halucynacje na czwartym kroku i cicho nadpisał działający kod.*
|
|
|
|
**Pierwotne zasady Karpathy'ego nie chroniły przed wieloetapową degradacją.**
|
|
|
|
[Czytanie bezpłatne dla osób spoza członków](https://medium.com/@shashwatwrites/3f2f03cbc969?sk=d6a7c956d48f8281e73ab29787b9dfb4)
|
|
|
|
To udowodniło, że choć oryginalne cztery zasady to podłoga, to nie są one sufitem.
|
|
|
|
Projektując dokładnie 4 *dodatkowe* zasady specjalnie dla nowoczesnej orkiestracji agentów, wskaźnik błędów AI jeszcze bardziej się zmniejszył.
|
|
|
|
Zrobiłem trzy od operatora na X i jeden z bloga!
|
|
|
|
### Fundacja: 4 zasady Karpathy'ego
|
|
|
|
Wirusowa implementacja skarg Karpathy'ego ustanowiła punkt wyjścia. Te cztery blokują około 40% standardowych, pojedynczych mechanizmów awarii:
|
|
|
|
1. **Pomyśl przed zaprogramowaniem:** Bez cichych założeń. Sprzeciw się, jeśli istnieje prostsze podejście.
|
|
2. **Najpierw prostota:** Wymagany minimalny kod. Brak spekulatywnych cech.
|
|
3. **Zmiany chirurgiczne:** Dotykaj tylko tego, co musisz. Nie "poprawiaj" sąsiedniego formatowania.
|
|
4. **Realizacja ukierunkowana na cel:** Określ kryteria sukcesu i powtarzaj pętlę do zweryfikowania, zamiast ślepo podążać za sztywnymi krokami.
|
|
|
|
**Dlaczego dziś się psują:** Te zasady są całkowicie nieobecne w przypadku wieloetapowych potoków. Nie dają agentowi tokenowego budżetu, nie wymuszają punktów kontrolnych i zakładają, że agent już rozumie otaczający kod.
|
|
|
|
### Warstwa Wykonawcza: 4 nowe zasady agentów
|
|
|
|
**5\. Twarde budżety tokenów**
|
|
|
|
Bez budżetów agent looping będzie nagrywał kontekstowy zrzut 50 000 tokenów, debugując ten sam komunikat o błędzie, aż aż zwariuje.
|
|
|
|
*Zasada:* Ustal twardy budżet na zadanie (np. 4 000 tokenów) i budżet na sesję (30 000 tokenów). Jeśli dojdzie do naruszenia, zmuszaj agenta do podsumowania i ponownego rozpoczęcia sesji. Ujawnienie naruszenia jest zawsze lepsze niż ciche przekroczenie limitów API.
|
|
|
|
**6\. Przeczytaj przed pisaniem**
|
|
|
|
Zasady Karpathy'ego mówią "nie dotykaj sąsiedniego kodu", ale nie "rozumiem sąsiedniego kodu". To prowadzi do tego, że AI ślepo pisze zduplikowane funkcje, które już istnieją 30 linii dalej.
|
|
|
|
*Zasada:* Przed dodaniem kodu do pliku zmuszcie agenta do odczytania eksportów pliku, natychmiastowych wywołujących i współdzielonych narzędzi. "Wygląda ortogonalnie" to niebezpieczne założenie.
|
|
|
|
**7\. Operacje wieloetapowe z punktami kontrolnymi**
|
|
|
|
Jeśli 6-stopniowa refaktoryzacja pójdzie nie tak w kroku 4, agent chętnie wykona kroki 5 i 6 na podstawie uszkodzonego stanu, niszcząc całą gałąź i wymuszając ręczne wykonanie.`git reset`
|
|
|
|
*Zasada:* Po każdym istotnym kroku agent musi podsumować, co zostało zweryfikowane, a co pozostało. Nie może kontynuować ze stanu, którego nie potrafi ci opisać.
|
|
|
|
**8\. Głośna porażka**
|
|
|
|
Najdroższe porażki wyglądają dokładnie jak sukcesy. "Migracja zakończona" to kłamstwo, jeśli 30 rekordów bazy danych zostało cicho pominiętych z powodu naruszeń ograniczeń.
|
|
|
|
*Zasada:* Domyślnie wywołuj niepewność. Jeśli agent coś pominął lub test przeszedł z niewłaściwych powodów, test musi się przegłosować i natychmiast powiadomić użytkownika.
|
|
|
|

|
|
|
|
Zdjęcie: Gabriel Heinzer na Unsplash
|
|
|
|
Rzeczywistość jest taka, że po pewnym czasie Claude przestaje czytać zasady i po prostu dopasowuje się do faktu, że "zasady istnieją".
|
|
|
|
Ograniczając plik do dokładnie 8 reguł o dużym wpływie, wskaźnik zgodności pozostaje powyżej 75%, a wskaźnik błędów spada niemal do zera.
|
|
|
|
### Architektura MistrzaCLAUDE.md
|
|
|
|
Skopiuj ten dokładny tekst, zapisz go w swoim repozytorium i dołącz poniżej wszelkie niezbędne szczegóły stosu projektów.`CLAUDE.md`
|
|
|
|
```hs
|
|
# CLAUDE.md — 8-Rule Architecture
|
|
These rules apply to every task in this project unless explicitly overridden.
|
|
Bias: caution over speed on non-trivial work. Use judgment on trivial tasks.
|
|
```
|
|
```hs
|
|
## Rule 1 — Think Before Coding
|
|
State assumptions explicitly. If uncertain, ask rather than guess.
|
|
Push back when a simpler approach exists. Stop when confused.## Rule 2 — Simplicity First
|
|
Minimum code that solves the problem. Nothing speculative.
|
|
No features beyond what was asked. No abstractions for single-use code.## Rule 3 — Surgical Changes
|
|
Touch only what you must. Clean up only your own mess.
|
|
Don't "improve" adjacent code, comments, or formatting. Match existing style.## Rule 4 — Goal-Driven Execution
|
|
Define success criteria. Loop until verified.
|
|
Don't follow steps. Define success and iterate independently.## Rule 5 — Token budgets are not advisory
|
|
Per-task: 4,000 tokens. Per-session: 30,000 tokens.
|
|
If approaching budget, summarize and start fresh. Surface the breach. ## Rule 6 — Read before you write
|
|
Before adding code, read exports, immediate callers, shared utilities.
|
|
If unsure why code is structured a certain way, ask.## Rule 7 — Checkpoint after every significant step
|
|
Summarize what was done, what's verified, what's left.
|
|
Don't continue from a state you can't describe back. Stop and restate.## Rule 8 — Fail loud
|
|
"Completed" is wrong if anything was skipped silently.
|
|
"Tests pass" is wrong if any were skipped.
|
|
Default to surfacing uncertainty, not hiding it.
|
|
```
|
|
|
|
`CLAUDE.md` jest ścisłym kontraktem behawioralnym mającym na celu zamknięcie konkretnych, kosztownych mechanizmów awarii.
|
|
|
|
Początkowe zastrzeżenia Karpathy'ego definiowały problemy kodowania autouzupełniającego.
|
|
|
|
Teraz organizujemy autonomicznych, wieloetapowych agentów.
|
|
|
|
> Zamknij swoje środowiska, wymusz budżety tokenów i zażądaj punktów kontrolnych.
|
|
|
|
*Jeśli spotykamy się po raz pierwszy, przyjdź* [*tutaj*](https://medium.com/@shashwatwrites/subscribe)*, warto będzie przeżyć kolejkę górską artykułów, które pojawią się w najbliższych tygodniach.*
|
|
|
|
*Przysięgam, śledzenie tych aktualizacji to ostatnio praca sama w sobie.*
|
|
|
|
*Oto* [*lista*](https://medium.com/@shashwatwrites/list/ai-updates-bbb9d001b651)*, którą zbudowałem i ciągle ją uzupełniam*.
|
|
|
|
*A jeśli potrzebujesz pomocy w analizie walk UFC,* *sprawdź* [*BoutPredict*](https://boutpredict.aibucket.org/) *:)* |