Files
DBAdmin/brain/knowledge/concepts/adversarial-framing.md
T
2026-06-18 09:56:58 +00:00

1.7 KiB

title, type, tags, created, updated, sources, confidence
title type tags created updated sources confidence
Adversarial Framing (Afrontacyjne Ramy) concept
prompting
system-design
alignment
security
2026-06-18 2026-06-18
summaries/10-claude-prompts-replace-consultant
high

Adversarial Framing (Afrontacyjne Ramy)

Definition

Technika inżynierii podpowiedzi (prompt engineering) polegająca na celowym instruowaniu modelu językowego do przyjęcia krytycznej, sceptycznej, wręcz wrogiej postawy wobec dostarczonego wejścia (kodu, umowy, tekstu). Usuwa to domyślne dążenie modelu do bycia miłym, uprzejmym i unikania bezpośredniej konfrontacji (tzw. filtr uprzejmości).

How It Works

Większość modeli LLM podczas standardowej interakcji stara się podobać użytkownikowi, co sprawia, że ich recenzje są powierzchowne, a błędy logiczne łagodzone słowami pocieszenia. Afrontacyjne ramy przełamują tę barierę poprzez użycie rygorystycznych, dyrektywnych zwrotów:

  • "Bądź głęboko sceptyczny wobec tego kodu i z nienawiścią podejdź do długu technicznego."
  • "Rozerwij tę umowę na strzępy."
  • "Pomiń wszelkie zastrzeżenia, uprzejmości i ostrzeżenia. Powiedz brutalnie szczerą prawdę."
  • "Nie bądź zachęcający — bądź bezwzględnie rygorystyczny."

Why It Matters

Afrontacyjne ramy drastycznie zmieniają jakość wyników analitycznych. Model przestaje działać jako prosty generator tekstu, a staje się surowym audytorem. Pomaga to wykryć krytyczne podatności w kodzie, ukryte ryzyka w umowach prawnych oraz luki w modelach biznesowych, których "uprzejmy asystent" nigdy by nie sformułował.

Sources