Když AI projekt selže, málokdy za to může model. Většinou se ukáže, že odpovídal přesně podle toho, co dostal: zastaralé ceníky, tři verze téhož dokumentu, smlouvy naskenované šikmo a složky, do kterých mají přístup všichni — nebo nikdo.
Čísla, která stojí za pozornost
- Víc než 80 % firemních dat je nestrukturovaných: dokumenty, e-maily, PDF, fotky, poznámky z jednání.
- 60–70 % času AI projektu se typicky spotřebuje na přípravu a čištění dat, ne na samotnou AI.
- Podle odhadů Gartneru bude do konce roku 2026 zrušeno 60 % AI iniciativ, které nemají data připravená.
Co znamená „připravená data" v praxi
Nic akademického. U menších a středních firem jde skoro vždy o čtyři věci:
- Jeden zdroj pravdy. Aktuální ceník, platné smlouvy a poslední verze směrnic jsou na jednom místě — a staré verze jsou označené jako staré.
- Přístupová práva. AI asistent nesmí kolegovi z výroby vypravovat o mzdách. Práva na dokumentech musí platit i pro AI.
- Původ. U každé odpovědi se dá dohledat, z jakého dokumentu vychází. Bez toho nikdo výstupům nevěří — a právem.
- Údržba. Data stárnou. Někdo musí vlastnit proces, kterým se znalostní báze doplňuje a čistí.
Praktický důsledek: než se pustíte do AI asistenta, zaplaťte si týden úklidu dokumentů. Je to nejnudnější položka celého projektu a zároveň jediná, bez které nefunguje nic dalšího.