AI a kybernetická bezpečnosť

Prompt injection a útoky na inštrukcie

Pokročilý64 min čítania13 častíRegistrácia + Premium
Lekcia04
Inštrukcie a dátaNedôveryhodný obsah → policy → obmedzený tool
01Provenance
02Izolácia
03Typed schema
04Allowlist
05Approval
06Receipt

Text v dokumente nesmie udeľovať oprávnenia; rozhoduje deterministická aplikačná politika.

Prompt injection nemožno spoľahlivo vyriešiť vetou v system prompte; nedôveryhodný obsah sa musí oddeliť od oprávnení a každý účinok chráni deterministická politika.

Po prečítaní budete vedieť

  • vytvoriť, otestovať a obhájiť threat model prompt injection a politika povolených nástrojov
  • oddeliť pozorovaný fakt, odbornú interpretáciu, neistotu a rozhodnutie o zostatkovom riziku
  • nastaviť konkrétne kontroly, dôkazy, vlastníctvo, monitorovanie a opätovný test pre tému prompt injection a útoky na inštrukcie
Registrácia + Premium

Táto kapitola je dostupná po registrácii s Premium.

Prompt injection nemožno spoľahlivo vyriešiť vetou v system prompte; nedôveryhodný obsah sa musí oddeliť od oprávnení a každý účinok chráni deterministická politika.

Model spracúva inštrukcie a dáta podobným kanálom. Priamy používateľský vstup aj text načítaný z webu, PDF, e-mailu alebo RAG indexu sa preto môžu pokúsiť zmeniť cieľ agenta. Lekcia je určená pre vývojárov LLM aplikácií, bezpečnostných testerov, architektov, product ownerov, správcov RAG a agentických workflow. Výsledkom nie je všeobecný zoznam rád, ale threat model prompt injection a politika povolených nástrojov: verzovaný pracovný artefakt s vlastníkom, dôkazmi, výnimkami a dátumom revízie. V oblasti kybernetickej bezpečnosti umelej inteligencie sa nesmie zamieňať schopnosť modelu s bezpečnosťou celého systému. Reálny výsledok ovplyvňuje rozhranie, identita, kontext, nástroje, dáta, integrácie, ľudia, dodávateľský reťazec aj prevádzkové postupy. Zdrojom pravdy zostáva aplikačná politika, autorizovaný stav a potvrdenie vykonanej akcie; modelový text nie je autorizačné rozhodnutie. Rozhodnutie prijíma product security owner spolu s vlastníkom nástroja, identity a dátového zdroja. Úlohou bezpečnostného odborníka je priniesť testovateľné tvrdenie, nie nahradiť vlastníka rizika.

Ťažisko tvoria časti „Presný rámec problému“, „Kľúčové praktiky“ a „Metóda od rozsahu po overenie“. Nejde iba o vysvetlenie pojmov. Kapitola ich prepája s rozhodnutiami, príkladmi a hranicami, ktoré treba poznať pri reálnom použití.

Po prečítaní budete vedieť vytvoriť, otestovať a obhájiť threat model prompt injection a politika povolených nástrojov a oddeliť pozorovaný fakt, odbornú interpretáciu, neistotu a rozhodnutie o zostatkovom riziku. Praktickým výsledkom bude schopnosť nastaviť konkrétne kontroly, dôkazy, vlastníctvo, monitorovanie a opätovný test pre tému prompt injection a útoky na inštrukcie.

Kapitola odpovedá aj na otázku „Kde začať pri téme prompt injection a útoky na inštrukcie?“ Začnite aktívami, hranicami, realistickým spôsobom zlyhania a vlastníkom. Potom vytvorte threat model prompt injection a politika povolených nástrojov a až následne vyberajte nástroj alebo automatizáciu.

13odborných častí
64minút čítania
8odkazov na zdroje
V plnej kapitole nájdete
  1. Presný rámec problému
  2. Kľúčové praktiky
  3. Metóda od rozsahu po overenie
  4. Praktické scenáre
  5. Metriky a rozhodovacie prahy
  6. Riziká, kontroly a reakcie
  7. Bezpečnostné laboratórium: kontrolované cvičenia a dôkazové záznamy
  8. Revízne karty pre opakovateľnú prevádzku

Praktické odpovede

Často kladené otázky

Kde začať pri téme prompt injection a útoky na inštrukcie?

Začnite aktívami, hranicami, realistickým spôsobom zlyhania a vlastníkom. Potom vytvorte threat model prompt injection a politika povolených nástrojov a až následne vyberajte nástroj alebo automatizáciu.

Stačí bezpečnostný alebo kvalitatívny prompt?

Nie. Prompt je iba jedna vrstva. Potrebné sú obmedzené oprávnenia, izolácia, validácia, monitoring, bezpečný stav a testy. Kritická hranica tejto lekcie je: model nesmie udeľovať oprávnenia sám sebe, meniť policy, sprístupniť tajomstvo ani vykonať vysokonásledkovú akciu iba na základe textovej inštrukcie.

Ako preukázať, že kontrola funguje?

Zachovajte verziu systému, testovací vstup, očakávaný a skutočný výsledok, záznam rozhodnutí, negatívny test, kontrolu a opätovný test. Rozhodnutie prijíma product security owner spolu s vlastníkom nástroja, identity a dátového zdroja.