Promptovanie

ochranný prompt

Anglický výraz guardrail prompt

špecializovanéheslo č. 5985 otázok a odpovedí2 odborné zdroje

Presná definícia

Čo znamená ochranný prompt?

Ochranný prompt je sada pokynov, ktorá modelu opisuje bezpečnostné hranice, citlivé scenáre a požadovaný spôsob odmietnutia či eskalácie. Je mäkkou behaviorálnou kontrolou: môže zlepšiť správanie, ale útočný obsah ho môže oslabiť a neobmedzí technické oprávnenia. Preto patrí do viacvrstvovej ochrany.

Skúsenosť a kontext

Ako sa pojem používa v praxi

Aplikácia uvedie, ktoré akcie vyžadujú potvrdenie, ako pracovať s osobnými údajmi a kedy odovzdať človeku. Prompt je verzovaný a testovaný na povolených aj nepovolených prípadoch. Skutočné hranice prístupu, validácia schém, rate limits a audit sa vynucujú serverovo nezávisle od odpovede modelu.

Overiteľnosť

Odborné zdroje

  1. OpenAI Model Spec - chain of commandmodel-spec.openai.com
  2. OWASP - Prompt Injection Prevention Cheat Sheetcheatsheetseries.owasp.org

Praktické odpovede

Často kladené otázky

Ako funguje ochranný prompt?

Pokyny s vyššou autoritou podmieňujú model k detekcii rizikového zámeru a k voľbe povolenej odpovede alebo odmietnutia.

Kedy má ochranný prompt praktický význam?

Aplikácia uvedie, ktoré akcie vyžadujú potvrdenie, ako pracovať s osobnými údajmi a kedy odovzdať človeku.

S čím si pojem nezamieňať?

Bezpečnostný filter je samostatný klasifikátor či pravidlo; guardrail prompt je textová vrstva v kontexte generatívneho modelu.

Ako sa výsledok kontroluje?

Testuje sa správne povolenie a odmietnutie, konzistentnosť parafráz, injection, viac jazykov a zhoda s autorizáciou nástrojov.

Na čo si dať pozor?

Prompt môže uniknúť, zastarať alebo byť ignorovaný; príliš široké pravidlo vytvorí over-refusal a falošný pocit bezpečia.