Files
2026-06-11 08:46:34 +00:00

2.0 KiB

title, type, tags, created, updated, sources, confidence
title type tags created updated sources confidence
Doer-Judge Split (Separacja Wykonawcy od Sędziego) concept
agent-ai
system-design
validation
verification
2026-06-09 2026-06-09
summaries/5-mental-models-for-ai-agents
high

Doer-Judge Split (Separacja Wykonawcy od Sędziego)

Definition

Zasada projektowania systemów agentowych, nakazująca fizyczny podział ról na agenta wykonującego zadanie (Doer / Wykonawca) oraz niezależnego agenta weryfikującego jakość, poprawność i zgodność wyniku z regułami (Judge / Sędzia).

How It Works

Uruchomienie jednego agenta, który jednocześnie wykonuje pracę i sam ocenia swój wynik, jest częstym trybem awaryjnym (model ma skłonność do ignorowania własnych błędów). Wzdrzec Doer-Judge Split eliminuje to zjawisko:

  • Doer (Wykonawca): Skupia się na kreatywnym lub technicznym rozwiązaniu problemu (np. pisanie kodu, generowanie raportu, parsowanie maili).
  • Judge (Sędzia): Posiada rygorystyczny zestaw kryteriów walidacji (np. testy jednostkowe, schemat YAML, reguły bezpieczeństwa) i bezwzględnie odrzuca wyniki, które nie spełniają norm, wymuszając na wykonawcy poprawki.

The Verification Spectrum (Spektrum Weryfikacji)

Sędziowanie i walidacja mogą odbywać się na różnych poziomach rygoru:

  1. Walidacja deterministyczna: Kompilatory, parsery JSON, lintery (np. nasz lint_knowledge.ps1). Szybkie i bezkosztowe.
  2. Weryfikacja LLM (Model-as-a-Judge): Użycie mniejszego, wyspecjalizowanego modelu do oceny semantycznej poprawności i spójności.
  3. Human-in-the-Loop (Nadzór człowieka): Ostateczna brama weryfikacji przed krytycznym zatwierdzeniem zmian w systemie.

Why It Matters

Separacja ta drastycznie podnosi niezawodność systemów agentowych w środowiskach produkcyjnych (np. w systemach finansowych, analizie oszustw, administracji bazami danych), eliminując przypadkowe halucynacje i błędy formatowania.

Sources