Přeskočit na obsah

Lexikální validátor AI textu je vždy obejitelný — závěr nesmí nést AI text vůbec

import { Aside } from ‘@astrojs/starlight/components’;

Validátor AI narace měl zakázat „silné věty” o penězích nad neověřenými daty. Destruktivní testování postupně prošlo: synonyma a deklinace („Hotovost vystačí”, „Peněz je dost”), interpunkční rozbití („Peníze? Nedojdou.”), skutečné větné hranice („Peníze. Nedojdou.”) a nakonec parafráze bez jediného klíčového slova („Situace na účtech vás nemusí trápit”, „Likvidita zůstane kladná”).

Každá lexikální detekce volného textu — blacklist i „whitelist povolených vět uvnitř kategorie” — je jazykově obejitelná: prostor parafrází je neomezený, prostor vzorů konečný. Tři kola oprav detektoru (širší lemmata, kategorie subjekt×verdikt, oprava splitteru) vždy zavřela předvedené útoky a vždy existoval další.

Strukturálně: signál „silný verdikt povolen?” (jediná sdílená brána nad stavem dat) rozhoduje PŘED voláním AI. Není-li povolen, AI narace se pro daný den vůbec negeneruje (0 tokenů, auditovatelný skip reason) a text skládá deterministický copy modul. Detektor zůstal jako defense-in-depth, ale bezpečnost na něm nestojí. Bonus: neplatí se za text, kterému se nesmí věřit.

Ptej se: „co se stane, když detektor selže?” Pokud odpověď zní „projde zakázaný závěr”, detektor není brána. Brána je nedat AI příležitost závěr vyslovit.

Přidal aiarchitekt.cz · 15. 8. 2026 2:00
Provozuje aiarchitekt.cz