Files
2026-06-11 08:46:34 +00:00

32 lines
2.0 KiB
Markdown

---
title: "Doer-Judge Split (Separacja Wykonawcy od Sędziego)"
type: "concept"
tags: [agent-ai, system-design, validation, verification]
created: 2026-06-09
updated: 2026-06-09
sources: ["[[summaries/5-mental-models-for-ai-agents]]"]
confidence: high
---
# Doer-Judge Split (Separacja Wykonawcy od Sędziego)
## Definition
Zasada projektowania systemów agentowych, nakazująca fizyczny podział ról na agenta wykonującego zadanie (**Doer** / Wykonawca) oraz niezależnego agenta weryfikującego jakość, poprawność i zgodność wyniku z regułami (**Judge** / Sędzia).
## How It Works
Uruchomienie jednego agenta, który jednocześnie wykonuje pracę i sam ocenia swój wynik, jest częstym trybem awaryjnym (model ma skłonność do ignorowania własnych błędów). Wzdrzec Doer-Judge Split eliminuje to zjawisko:
- **Doer (Wykonawca)**: Skupia się na kreatywnym lub technicznym rozwiązaniu problemu (np. pisanie kodu, generowanie raportu, parsowanie maili).
- **Judge (Sędzia)**: Posiada rygorystyczny zestaw kryteriów walidacji (np. testy jednostkowe, schemat YAML, reguły bezpieczeństwa) i bezwzględnie odrzuca wyniki, które nie spełniają norm, wymuszając na wykonawcy poprawki.
## The Verification Spectrum (Spektrum Weryfikacji)
Sędziowanie i walidacja mogą odbywać się na różnych poziomach rygoru:
1. *Walidacja deterministyczna*: Kompilatory, parsery JSON, lintery (np. nasz `lint_knowledge.ps1`). Szybkie i bezkosztowe.
2. *Weryfikacja LLM (Model-as-a-Judge)*: Użycie mniejszego, wyspecjalizowanego modelu do oceny semantycznej poprawności i spójności.
3. *Human-in-the-Loop (Nadzór człowieka)*: Ostateczna brama weryfikacji przed krytycznym zatwierdzeniem zmian w systemie.
## Why It Matters
Separacja ta drastycznie podnosi niezawodność systemów agentowych w środowiskach produkcyjnych (np. w systemach finansowych, analizie oszustw, administracji bazami danych), eliminując przypadkowe halucynacje i błędy formatowania.
## Sources
- [[summaries/5-mental-models-for-ai-agents]]