Když webu chcete přidat umělou inteligenci, začněte u rozhraní
Před podpisem smlouvy si udělejte pilotní provoz na jednom oddělení nebo na jedné agendě. Vyberte tým, který není nejvíc zaneprázdněný, a nastavte měřitelná kritéria: o kolik minut se zkrátí jeden proces, kolik chyb zmizí, kolik dotazů na HR přestane chodit. Po třech až čtyřech týdnech vyhodnoťte výsledky a teprve pak se rozhodněte o rozšíření. Během pilotu sbírejte zpětnou vazbu od lidí, kteří nástroj používají denně – jejich výhrady odhalí problémy, které při prezentaci nikdo nezmíní.
Přístupová práva a šifrování rozhoduj
U nákladů nepočítejte jen předplatné. Skutečná cena se skládá ze tří položek: licence nebo provoz, čas na zavedení a čas na údržbu. Zavedení znamená napojení zdrojů, nastavení přístupů a ověření, že čísla sedí s účetnictvím. Údržba znamená reagovat na změny v systémech a opravovat rozbitá napojení. Levné řešení s krátkým zavedením často znamená dražší údržbu, protože každá změna se dělá ručně znovu.
Než sáhnete po jakékoli knihovně, napište si na papír, co má umělá inteligence na webu vlastně dělat. Rozhodněte se mezi dvěma základními scénáři: buď voláte hotový model přes rozhraní vzdálené služby, nebo si pouštíte menší model přímo v prohlížeči. První cesta je rychlejší na vývoj, druhá šetří soukromí a nezávisí na připojení. Pro začátek je klíčové zvolit jednu z nich a ne kombinovat obě, dokud nepochopíte tok dat.
Typická chyba je testovat nástroj na datech, která jsou pěkná a kompletní. Reálná data mají prázdné položky, duplicity a nekonzistentní názvy. Než cokoli nasadíte, prožeňte testovací sadu, která obsahuje právě tyto nepořádky. Druhá častá chyba je automatizovat report, aniž by někdo ověřoval správnost. Automatický výstup může být stejně chybný jako ruční, jen se chyba šíří rychleji a nikdo si jí nevšimne, dokud není pozdě.
Na co si dát pozor při zadávání vstupu: ořezávejte prázdné znaky, nastavte maximální délku a nikdy nevkládejte text uživatele přímo do systémové instrukce. Model berte jako nespolehlivého spolupracovníka, ne jako zdroj pravdy. Do rozhraní pište konkrétně, co má vrátit, a výstup vždy zkontrolujte, než ho ukážete lidem. Pokud odpověď závisí na datech z vaší databáze, nejdřív je vyberte a do dotazu je vložte jako hotový text, ne jako příkaz k jejich hledání.
Základní dělení je na nástroje pro extrakci dat z dokladů, pro kategorizaci a párování a na komplexní systémy, které se napojují přímo na účetní software. Extrakce z faktur zvládne i jednoduchý nástroj, ale česká specifika jsou tvrdý oříšek: diakritika, různé formáty částek, duplicitní symboly, dobropisy, zálohové listy a hlavně specifické daňové režimy. Pokud nástroj neumí pracovat s českým kontextem, ušetří jen na první pohled.
Typické chyby začátečníků se opakují: odesílání celé historie konverzace, dokud se nevyčerpá limit; ignorování časového limitu požadavku; zobrazování surové odpovědi včetně formátovacích značek; a testování jen na jednom příkladu. Zkuste alespoň dvacet různých vstupů, včetně nesmyslů a prázdného pole. Sledujte, kolik dotazů za minutu posíláte, a nastavte si strop. Až bude základ fungovat, teprve pak řešte vylepšení, jako je ukládání odpovědí nebo streamování textu po částech.
Praktický začátek vypadá tak, že si vytvoříte jednoduchou stránku s formulářem, tlačítkem a místem pro odpověď. Odesílání řešte přes funkci, která načte hodnotu vstupu, zavolá rozhraní a výsledek zobrazí. V kódu vždy ošetřete tři stavy: načítání, úspěch a chybu. Zapomenutý stav načítání je nejčastější důvod, proč uživatel zmáčkne tlačítko pětkrát a odešle pět požadavků.
Klíč nepatří do prohlížeče Přístupový klíč k modelu nikdy nevkládejte do veřejného souboru ani do HTML. Prohlížeč si může kdokoli otevřít a klíč zneužít. Řešení je jednoduché: postavte tenkou serverovou mezivrstvu, která klíč drží v proměnné prostředí a přijímá požadavky z vaší stránky. Tato mezivrstva zároveň slouží k omezení počtu dotazů, takže vás nezaskočí neočekávaný provoz. Není potřeba žádný složitý rámec, stačí několik řádků na straně serveru.