Systém musí chrániť aktíva aj vtedy, keď je modelový výstup chybný alebo kompromitovaný.
Model nie je bezpečnostná hranica. Systém musí chrániť dáta, nástroje a ľudí aj vtedy, keď modelový výstup obsahuje chybu, podľahne prompt injection alebo ho zámerne manipuluje útočník.
Po prečítaní budete vedieť
- odlíšiť safety, security, privacy a reliability
- zmapovať prompt injection, únik dát, nadmernú agentnosť a supply-chain riziká
- navrhnúť defense-in-depth tok s minimálnymi právami a incidentným plánom
Celá kapitola je zadarmo po registrácii.
- Model nie je bezpečnostná hranica
- Threat model začína aktívami, nie zoznamom útokov
- Prompt injection: inštrukcia ukrytá v dátach
- Sensitive information disclosure
- Improper output handling
- Excessive agency: keď má systém priveľa možností
- Supply chain a poisoning
- Misinformation a dôveryhodne znejúci omyl
Prihlásenie zabezpečuje ChatGPT. PoznAI nedostane vaše heslo.
Praktické odpovede
Často kladené otázky
Zabráni dobrý system prompt všetkým útokom?
Nie. Je iba jednou vrstvou. Tajomstvá a akcie musia chrániť autentifikácia, autorizácia, izolácia, validácia, limity a potvrdenie mimo modelu.
Čo je nepriama prompt injection?
Škodlivá inštrukcia je ukrytá v obsahu, ktorý agent načíta - napríklad na webe, v e-maile, PDF alebo obrázku - a snaží sa ovplyvniť jeho ďalšie kroky.
Ako obmedziť riziko agenta s nástrojmi?
Dajte mu iba nevyhnutné oprávnenia, oddeľte čítanie od zápisu, validujte parametre, limitujte kroky a pred citlivou či nezvratnou akciou vyžiadajte presné potvrdenie človeka.
Prihlásiť / registrovať