--- title: "Doer-Judge Split (Separacja Wykonawcy od Sędziego)" type: "concept" tags: [agent-ai, system-design, validation, verification] created: 2026-06-09 updated: 2026-06-09 sources: ["[[summaries/5-mental-models-for-ai-agents]]"] confidence: high --- # Doer-Judge Split (Separacja Wykonawcy od Sędziego) ## Definition Zasada projektowania systemów agentowych, nakazująca fizyczny podział ról na agenta wykonującego zadanie (**Doer** / Wykonawca) oraz niezależnego agenta weryfikującego jakość, poprawność i zgodność wyniku z regułami (**Judge** / Sędzia). ## How It Works Uruchomienie jednego agenta, który jednocześnie wykonuje pracę i sam ocenia swój wynik, jest częstym trybem awaryjnym (model ma skłonność do ignorowania własnych błędów). Wzdrzec Doer-Judge Split eliminuje to zjawisko: - **Doer (Wykonawca)**: Skupia się na kreatywnym lub technicznym rozwiązaniu problemu (np. pisanie kodu, generowanie raportu, parsowanie maili). - **Judge (Sędzia)**: Posiada rygorystyczny zestaw kryteriów walidacji (np. testy jednostkowe, schemat YAML, reguły bezpieczeństwa) i bezwzględnie odrzuca wyniki, które nie spełniają norm, wymuszając na wykonawcy poprawki. ## The Verification Spectrum (Spektrum Weryfikacji) Sędziowanie i walidacja mogą odbywać się na różnych poziomach rygoru: 1. *Walidacja deterministyczna*: Kompilatory, parsery JSON, lintery (np. nasz `lint_knowledge.ps1`). Szybkie i bezkosztowe. 2. *Weryfikacja LLM (Model-as-a-Judge)*: Użycie mniejszego, wyspecjalizowanego modelu do oceny semantycznej poprawności i spójności. 3. *Human-in-the-Loop (Nadzór człowieka)*: Ostateczna brama weryfikacji przed krytycznym zatwierdzeniem zmian w systemie. ## Why It Matters Separacja ta drastycznie podnosi niezawodność systemów agentowych w środowiskach produkcyjnych (np. w systemach finansowych, analizie oszustw, administracji bazami danych), eliminując przypadkowe halucynacje i błędy formatowania. ## Sources - [[summaries/5-mental-models-for-ai-agents]]