AI agent odpovedá správne na desať otázok, ktoré sme mu položili počas vývoja. Je pripravený na ostrú prevádzku? Nie nevyhnutne. Jedna z najväčších chýb pri nasadzovaní firemnej AI je otestovať niekoľko pekných scenárov, pozrieť sa na výsledky a povedať: „Vyzerá to dobre. Spustime to.“ Reálny zákazník sa však nebude pýtať iba tak, ako očakával programátor. Môže: použiť úplne iné slová, spraviť preklep, položiť neúplnú otázku, spojiť tri otázky do jednej, pýtať sa na údaj, ktorý vo firemných podkladoch vôbec nie je, odvolávať sa na starý dokument, požadovať operáciu, na ktorú nemá oprávnenie, alebo úmyselne skúšať dostať AI mimo jej pravidiel. A pri agentovi, ktorý dokáže používať nástroje, problém už nemusí znamenať iba nesprávnu vetu. Môže znamenať: nesprávne vytvorený ticket, zmenu nesprávnej objednávky, sprístupnenie nepovolených údajov, vykonanie nevhodnej operácie, alebo niekoľkonásobné zavolanie rovnakej funkcie. Preto považujeme testovanie za...