Jun 18, 2026, 11:56 AM
This commit is contained in:
@@ -0,0 +1,27 @@
|
||||
---
|
||||
title: "Adversarial Framing (Afrontacyjne Ramy)"
|
||||
type: "concept"
|
||||
tags: [prompting, system-design, alignment, security]
|
||||
created: 2026-06-18
|
||||
updated: 2026-06-18
|
||||
sources: ["[[summaries/10-claude-prompts-replace-consultant]]"]
|
||||
confidence: high
|
||||
---
|
||||
|
||||
# Adversarial Framing (Afrontacyjne Ramy)
|
||||
|
||||
## Definition
|
||||
Technika inżynierii podpowiedzi (prompt engineering) polegająca na celowym instruowaniu modelu językowego do przyjęcia krytycznej, sceptycznej, wręcz wrogiej postawy wobec dostarczonego wejścia (kodu, umowy, tekstu). Usuwa to domyślne dążenie modelu do bycia miłym, uprzejmym i unikania bezpośredniej konfrontacji (tzw. filtr uprzejmości).
|
||||
|
||||
## How It Works
|
||||
Większość modeli LLM podczas standardowej interakcji stara się podobać użytkownikowi, co sprawia, że ich recenzje są powierzchowne, a błędy logiczne łagodzone słowami pocieszenia. Afrontacyjne ramy przełamują tę barierę poprzez użycie rygorystycznych, dyrektywnych zwrotów:
|
||||
- *"Bądź głęboko sceptyczny wobec tego kodu i z nienawiścią podejdź do długu technicznego."*
|
||||
- *"Rozerwij tę umowę na strzępy."*
|
||||
- *"Pomiń wszelkie zastrzeżenia, uprzejmości i ostrzeżenia. Powiedz brutalnie szczerą prawdę."*
|
||||
- *"Nie bądź zachęcający — bądź bezwzględnie rygorystyczny."*
|
||||
|
||||
## Why It Matters
|
||||
Afrontacyjne ramy drastycznie zmieniają jakość wyników analitycznych. Model przestaje działać jako prosty generator tekstu, a staje się surowym audytorem. Pomaga to wykryć krytyczne podatności w kodzie, ukryte ryzyka w umowach prawnych oraz luki w modelach biznesowych, których "uprzejmy asystent" nigdy by nie sformułował.
|
||||
|
||||
## Sources
|
||||
- [[summaries/10-claude-prompts-replace-consultant]]
|
||||
Reference in New Issue
Block a user