Jak stavíme AI, která si nevymýšlí
Největší brzda AI ve firmách nejsou schopnosti — je to důvěra. Jedno vymyšlené číslo v nabídce, jeden neexistující paragraf ve smlouvě, a celý projekt je mrtvý. Proto má každá AI vrstva, kterou nasazujeme, stejný standard: raději řekne „nevím“, než aby hádala.
Proč jsou halucinace problém číslo jedna#
Jazykové modely jsou od přírody výřečné — když neznají odpověď, vytvoří ji. Pro brainstorming skvělá vlastnost, pro firemní systém katastrofa: AI poradkyně, která doporučí neexistující produkt, nebo asistent, který cituje smlouvu špatně, nadělá víc škody než užitku.
Dobrá zpráva: halucinace nejsou přírodní zákon. Jsou důsledek toho, že model odpovídá bez podkladu. A to se dá změnit — pěti konkrétními pravidly, která platí v každém systému, který stavíme.
Pět principů, které to drží#
AI odpovídá z dokumentů, katalogů a databází klienta — ne z vlastní paměti. Když se ptáš na cenu, produkt nebo termín, odpověď pochází z reálného záznamu. A když záznam neexistuje, AI to řekne. Příklad z provozu: dermatologická poradkyně Rituel Cosmetics doporučuje jen produkty, které v katalogu skutečně jsou — nikdy nevymyslí přípravek, složení ani cenu.
Odeslat nabídku, provést platbu, publikovat text, potvrdit rezervaci — akce s reálným dopadem čekají na lidské schválení. AI připraví podklad, člověk rozhodne. Tam, kde je akce vratná a nízkoriziková, může AI jednat sama; hranici stavíme vědomě, ne náhodou.
Před nasazením projde AI vrstva baterií skutečných situací — včetně záludných: protichůdná zadání, chybějící data, pokusy vylákat, co má zůstat skryté. Nasazuje se, až když projde. A protože se modely i data mění, testy se opakují i za provozu.
Citlivá data klienta neopouštějí jeho systém a nikdo na nich netrénuje. AI kontrola smluv čte dokumenty uvnitř systému — ven nejde nic. GDPR tu není nálepka, ale konstrukční princip. Podrobně v Kde končí tvoje data.
Co AI udělala, kdy, pro koho a z jakého podkladu — všechno je zalogované. Když se chceš zeptat „proč mi systém tohle doporučil?“, existuje odpověď. Žádná černá skříňka.
Kde přesně vede hranice#
Druhý princip je ten, o kterém se v nabídkách mluví nejmíň a v provozu rozhoduje nejvíc. Nejde o to, jestli AI „smí jednat“ — jde o to, kde je ta čára nakreslená a jestli ji někdo nakreslil vědomě.
- Vyhledá a shrnez podkladů, ke kterým má přístup
- Připraví návrhtext, výpočet, seznam položek
- Roztřídí a označívratné akce s nízkým dopadem
- Přizná, že nevímísto věrohodně znějícího nesmyslu
- Odeslat klientoviv přesně tom znění, které někdo viděl
- Pohnout peněziplatba, vratka, kompenzace
- Publikovat venco má následky a nese podpis
- Uzavřít nebo potvrditodškrtnutí nese jméno a datum
Co to znamená, když si AI vrstvu objednáš#
Prakticky: dostaneš AI, kterou můžeš pustit na zákazníky bez strachu, že jim slíbí něco, co neexistuje. Interní nástroj, kterému tým věří, protože se umí zeptat „odkud to máš?“ a dostat odpověď. A systém, který projde GDPR kontrolou, protože tak byl navržený od začátku — ne dodatečně obalený politikou.
Jak si to ověřit u kteréhokoli dodavatele#
Tři otázky, které odliší návrh od naděje. Fungují i na nás.
Chceš slyšet konkrétní zdroj (katalog, dokument, tabulka) a konkrétní chování při jeho absenci. „Model to nějak zvládne“ je špatná odpověď; „řekne, že to neví, a nabídne kontakt“ je dobrá.
Nech si ten seznam vyjmenovat. Když ho dodavatel nemá připravený, ta hranice v systému nakreslená není — a nakreslí se až incidentem.
Co udělala, kdy, pro koho a z jakého podkladu. Když takový záznam neexistuje, nekupuješ systém, ale černou skříňku — a v okamžiku sporu nebudeš mít čím argumentovat.
Časté otázky#
Dá se halucinacím zabránit úplně?
Stoprocentní záruka neexistuje — ale dá se zařídit, že AI odpovídá jen z podkladů, přizná nevědomost a kritické akce schvaluje člověk. Tím se riziko posouvá z „AI občas plácne nesmysl zákazníkovi“ na „AI občas řekne nevím“ — a to je stav, se kterým se dá bezpečně pracovat.
Funguje to i s citlivými daty — smlouvy, zdravotní údaje, finance?
Ano, právě tam je to nejdůležitější. Data zůstávají v systému klienta, AI k nim přistupuje jen v rámci úlohy a nic se na nich netrénuje. Přesně takhle běží AI kontrola smluv v produkci.
Jak dlouho trvá nasadit AI vrstvu, které se dá věřit?
Řádově týdny, ne měsíce — grounding, schvalování i testování jsou součást standardní výbavy, ne výzkumný projekt. První funkční verzi vidíš obvykle do týdne a už na ní se testuje, co AI smí a nesmí.