1.7 KiB
title, type, tags, created, updated, sources, confidence
| title | type | tags | created | updated | sources | confidence | |||||
|---|---|---|---|---|---|---|---|---|---|---|---|
| Adversarial Framing (Afrontacyjne Ramy) | concept |
|
2026-06-18 | 2026-06-18 |
|
high |
Adversarial Framing (Afrontacyjne Ramy)
Definition
Technika inżynierii podpowiedzi (prompt engineering) polegająca na celowym instruowaniu modelu językowego do przyjęcia krytycznej, sceptycznej, wręcz wrogiej postawy wobec dostarczonego wejścia (kodu, umowy, tekstu). Usuwa to domyślne dążenie modelu do bycia miłym, uprzejmym i unikania bezpośredniej konfrontacji (tzw. filtr uprzejmości).
How It Works
Większość modeli LLM podczas standardowej interakcji stara się podobać użytkownikowi, co sprawia, że ich recenzje są powierzchowne, a błędy logiczne łagodzone słowami pocieszenia. Afrontacyjne ramy przełamują tę barierę poprzez użycie rygorystycznych, dyrektywnych zwrotów:
- "Bądź głęboko sceptyczny wobec tego kodu i z nienawiścią podejdź do długu technicznego."
- "Rozerwij tę umowę na strzępy."
- "Pomiń wszelkie zastrzeżenia, uprzejmości i ostrzeżenia. Powiedz brutalnie szczerą prawdę."
- "Nie bądź zachęcający — bądź bezwzględnie rygorystyczny."
Why It Matters
Afrontacyjne ramy drastycznie zmieniają jakość wyników analitycznych. Model przestaje działać jako prosty generator tekstu, a staje się surowym audytorem. Pomaga to wykryć krytyczne podatności w kodzie, ukryte ryzyka w umowach prawnych oraz luki w modelach biznesowych, których "uprzejmy asystent" nigdy by nie sformułował.