Lexikální validátor AI textu je vždy obejitelný — závěr nesmí nést AI text vůbec
import { Aside } from ‘@astrojs/starlight/components’;
Symptom
Sekce “Symptom”Validátor AI narace měl zakázat „silné věty” o penězích nad neověřenými daty. Destruktivní testování postupně prošlo: synonyma a deklinace („Hotovost vystačí”, „Peněz je dost”), interpunkční rozbití („Peníze? Nedojdou.”), skutečné větné hranice („Peníze. Nedojdou.”) a nakonec parafráze bez jediného klíčového slova („Situace na účtech vás nemusí trápit”, „Likvidita zůstane kladná”).
Root cause
Sekce “Root cause”Každá lexikální detekce volného textu — blacklist i „whitelist povolených vět uvnitř kategorie” — je jazykově obejitelná: prostor parafrází je neomezený, prostor vzorů konečný. Tři kola oprav detektoru (širší lemmata, kategorie subjekt×verdikt, oprava splitteru) vždy zavřela předvedené útoky a vždy existoval další.
Fix
Sekce “Fix”Strukturálně: signál „silný verdikt povolen?” (jediná sdílená brána nad stavem dat) rozhoduje PŘED voláním AI. Není-li povolen, AI narace se pro daný den vůbec negeneruje (0 tokenů, auditovatelný skip reason) a text skládá deterministický copy modul. Detektor zůstal jako defense-in-depth, ale bezpečnost na něm nestojí. Bonus: neplatí se za text, kterému se nesmí věřit.
Poučení
Sekce “Poučení”Ptej se: „co se stane, když detektor selže?” Pokud odpověď zní „projde zakázaný závěr”, detektor není brána. Brána je nedat AI příležitost závěr vyslovit.