DX Heroes logo
#ai
#security

Co jsou AI guardrails?

Délka: 

4 min

Publikováno: 

15. července 2026

Co jsou AI guardrails?

Co jsou AI guardrails?

AI guardrails (ochranné mantinely) jsou kontroly a limity, které obklopují AI model a hlídají, aby jeho vstupy i výstupy zůstaly bezpečné, u tématu a v mezích pravidel. Jazykový model odpoví skoro na cokoli, na co se ho zeptáte, včetně požadavků, které jsou nebezpečné, neodpovídají značce nebo jdou proti pravidlům. Guardrails prověří, co do modelu vstupuje a co z něj vychází, a pak zablokují, přepíšou nebo označí všechno, co překročí čáru, ještě než se to dostane k uživateli nebo spustí nějakou akci.

Lidsky řečeno

Představte si svodidla na horské silnici. Auto pořád řídí řidič, ale svodidla ho v ostré zatáčce nepustí přes okraj. AI guardrails fungují stejně. Model pořád píše odpověď sám, ale mantinel zachytí nebezpečné případy, třeba únik dat, urážlivý jazyk nebo vymyšlený fakt, dřív než napáchají škodu.

Jak guardrails fungují

  • Vstupní guardrails — prověří požadavek, ještě než dorazí k modelu. Zachytí prompt injection, dotazy mimo téma nebo osobní údaje, které by se posílat neměly.
  • Výstupní guardrails — prověří odpověď dřív, než ji někdo uvidí. Odfiltrují urážlivý obsah, zakázaná témata nebo prozrazené citlivé údaje.
  • Deterministická pravidla — pevné kontroly jako regulární výraz, seznam povolených či zakázaných hodnot nebo schéma, kterému odpověď musí odpovídat. Jsou rychlá a předvídatelná.
  • Kontroly přes model — druhý model posoudí, jestli je výstup bezpečný, u tématu a opřený o zdroj. Je to pružné, ale pomalejší a samo o sobě to spolehlivé není.

Proč na tom záleží

  • Modely nemají vlastní úsudek. Guardrail je místo, kde se vaše pravidlo opravdu vynutí, ne jen sepíše do dokumentu.
  • Agenti zasahují do reálného světa. Když model umí volat nástroj nebo poslat zprávu, špatný výstup se změní ve špatnou akci. Guardrail je poslední kontrola, než se to stane.
  • Důvěra a compliance na tom stojí. Regulovaná firma potřebuje důkaz, že nebezpečné výstupy zachytí a zaloguje, ne že je jen odradí v promptu.

Na co si dát pozor

  • Spoléhat na jediný prompt. Věta „buď prosím bezpečný“ v systémovém promptu není guardrail, protože chytře napsaný požadavek ji přebije. Limit vynuťte v kódu okolo modelu.
  • Hlídat jen jednu stranu. Hrozby přicházejí ve vstupu a odcházejí ve výstupu, takže pokryjte oba směry.
  • Nastavit guardrails tak přísně, že blokují běžnou práci. Přehnané blokování naučí lidi systém obcházet. Pravidla laďte podle reálného provozu a měřte, jak často se spustí omylem.
  • Vynechat logy. Když guardrail něco zablokuje a nikdo to nezaznamená, přijdete o auditní stopu i o signál, podle kterého se dá systém zlepšovat.

Související články

  • Co je AI governance? - Pravidla a dohled, které guardrails uvádějí do praxe.
  • Co je prompt injection? - Útok, na jehož zachycení jsou vstupní guardrails stavěné.
  • Co je bezpečnost agentní AI? - Zabezpečení AI, která koná, kde guardrails záleží nejvíc.
  • Co je AI halucinace? - Vymyšlený výstup, který se guardrails opřené o zdroj snaží omezit.

Chcete být o krok napřed?

Nenechte si utéct naše nejlepší postřehy. Žádný spam, jen praktické analýzy, pozvánky na exkluzivní eventy a shrnutí podcastů přímo do vaší schránky.