Jun 11, 2026, 10:46 AM
This commit is contained in:
@@ -0,0 +1,31 @@
|
||||
---
|
||||
title: "Doer-Judge Split (Separacja Wykonawcy od Sędziego)"
|
||||
type: "concept"
|
||||
tags: [agent-ai, system-design, validation, verification]
|
||||
created: 2026-06-09
|
||||
updated: 2026-06-09
|
||||
sources: ["[[summaries/5-mental-models-for-ai-agents]]"]
|
||||
confidence: high
|
||||
---
|
||||
|
||||
# Doer-Judge Split (Separacja Wykonawcy od Sędziego)
|
||||
|
||||
## Definition
|
||||
Zasada projektowania systemów agentowych, nakazująca fizyczny podział ról na agenta wykonującego zadanie (**Doer** / Wykonawca) oraz niezależnego agenta weryfikującego jakość, poprawność i zgodność wyniku z regułami (**Judge** / Sędzia).
|
||||
|
||||
## How It Works
|
||||
Uruchomienie jednego agenta, który jednocześnie wykonuje pracę i sam ocenia swój wynik, jest częstym trybem awaryjnym (model ma skłonność do ignorowania własnych błędów). Wzdrzec Doer-Judge Split eliminuje to zjawisko:
|
||||
- **Doer (Wykonawca)**: Skupia się na kreatywnym lub technicznym rozwiązaniu problemu (np. pisanie kodu, generowanie raportu, parsowanie maili).
|
||||
- **Judge (Sędzia)**: Posiada rygorystyczny zestaw kryteriów walidacji (np. testy jednostkowe, schemat YAML, reguły bezpieczeństwa) i bezwzględnie odrzuca wyniki, które nie spełniają norm, wymuszając na wykonawcy poprawki.
|
||||
|
||||
## The Verification Spectrum (Spektrum Weryfikacji)
|
||||
Sędziowanie i walidacja mogą odbywać się na różnych poziomach rygoru:
|
||||
1. *Walidacja deterministyczna*: Kompilatory, parsery JSON, lintery (np. nasz `lint_knowledge.ps1`). Szybkie i bezkosztowe.
|
||||
2. *Weryfikacja LLM (Model-as-a-Judge)*: Użycie mniejszego, wyspecjalizowanego modelu do oceny semantycznej poprawności i spójności.
|
||||
3. *Human-in-the-Loop (Nadzór człowieka)*: Ostateczna brama weryfikacji przed krytycznym zatwierdzeniem zmian w systemie.
|
||||
|
||||
## Why It Matters
|
||||
Separacja ta drastycznie podnosi niezawodność systemów agentowych w środowiskach produkcyjnych (np. w systemach finansowych, analizie oszustw, administracji bazami danych), eliminując przypadkowe halucynacje i błędy formatowania.
|
||||
|
||||
## Sources
|
||||
- [[summaries/5-mental-models-for-ai-agents]]
|
||||
Reference in New Issue
Block a user