Ako vaša firemná AI funguje
Riešenie staviame na osvedčených, štandardných komponentoch pre enterprise RAG (Retrieval-Augmented Generation), overených nasadeniami vo firmách po celom svete. Tu je prehľad, z čoho sa skladá a čo presne sa deje medzi vašou otázkou a odpoveďou.
RAG: model odpovedá z vašich dokumentov, nie z pamäte
Namiesto trénovania modelu na vašich dátach používame RAG. Jazykový model dostane pri každej otázke čerstvo vyhľadané podklady z vašich dokumentov a odpovedá len z nich. Dáta sú vždy aktuálne, odpovede overiteľné a model sa z vašich dát nič neučí.
Otázka a jej príprava
Zamestnanec sa spýta v bežnej reči, po slovensky, aj s firemnými pojmami a skratkami. Otázku podľa potreby doplníme o kontext z predošlej konverzácie, aby vyhľadávanie našlo to pravé.
Hybridné vyhľadávanie
Vyhľadávací engine spustí súčasne kľúčové vyhľadávanie (BM25 nad invertovaným indexom) a sémantické vyhľadávanie: otázku prevedie na vektor a cez index približných najbližších susedov (ANN) nájde významovo podobné úseky. Skóre z oboch prístupov spojí do jedného poradia, tak nájde aj parafrázy, aj presné kódy a čísla položiek.
Preváženie a zoradenie (reranking)
Užší výber najlepších kandidátov prehodnotí cross-encoder, model, ktorý spracuje dvojicu (otázka, úsek) naraz a odhadne relevantnosť presnejšie než samotná podobnosť vektorov. Do kontextu ide len top-K najrelevantnejších úryvkov, a výhradne zo zdrojov, ktoré má daný asistent a používateľ sprístupnené.
Zostavenie kontextu a generovanie
Do kontextového okna modelu poskladáme systémovú inštrukciu asistenta, vybrané úryvky a otázku. Model je inštruovaný odpovedať výlučne z dodaných podkladov, nie z toho, čo si „pamätá“ z trénovania; ak odpoveď v podkladoch nie je, povie to namiesto hádania. Odpoveď sa streamuje po častiach, ako ju model generuje.
Citácie a overenie
Každé kľúčové tvrdenie je previazané s konkrétnym úryvkom a zdrojovým dokumentom. Používateľ si jedným klikom pozrie, odkiaľ informácia pochádza, čo je zároveň hlavná poistka proti halucináciám.
Z čoho sa riešenie skladá
Vysokoúrovňový pohľad na hlavné komponenty vášho prostredia, každý má svoju jasnú úlohu.
Konektory na vaše zdroje
Súbory nahrané priamo k nám, alebo dokumenty z Microsoft 365, Google Workspace, SharePointu a zdieľaných diskov, aj denné exporty (CSV/XML) zo skladu či účtovníctva. Podľa potreby aj e-mail, Teams, Slack či iný systém.
Spracovanie a indexovanie
Každý dokument rozdelíme na kratšie prekrývajúce sa úseky (chunky) a ku každému priradíme vektor (embedding), číselné vyjadrenie jeho významu, podľa ktorého sa dá vyhľadávať. Používame viacjazyčný model naladený aj na slovenčinu vrátane jej tvaroslovia.
Vyhľadávací index
Jeden engine drží aj vektory (pre sémantické, ANN vyhľadávanie), aj invertovaný index (pre kľúčové, BM25). Hybridné vyhľadávanie tak prebehne nad rovnakými dátami naraz, s filtrovaním podľa metadát a oprávnení.
Jazykový model
V produkcii používame Microsoft Azure OpenAI, so zmluvným zákazom trénovania na vašich dátach. Dáta sú uložené v EÚ; spracúvanie požiadaviek modelom môže prebiehať aj mimo EÚ na globálnej infraštruktúre Microsoft Azure na základe štandardných zmluvných doložiek. Model je od zvyšku architektúry oddelený a odpovedá len nad dodaným kontextom.
Asistenti a riadenie prístupov
Každý asistent má vlastné inštrukcie, pridelené zdroje a okruh používateľov.
Prevádzka a monitoring
Vaše prostredie beží oddelene, s vlastnou databázou aj indexom, monitoringom, zálohami a pravidelnými aktualizáciami modelov aj komponentov, o ktoré sa staráme my.
Prečo práve tento prístup
Vždy aktuálne odpovede
Upravíte internú smernicu a AI hneď odpovedá z jej aktuálnej verzie. Žiadne čakanie na pretrénovanie modelu.
Overiteľné odpovede
Model odpovedá len z nájdených podkladov a cituje zdroje. Riziko vymyslených odpovedí je výrazne nižšie a každé tvrdenie si viete jedným klikom overiť.
Bezpečné už z princípu
Vaše dáta zostávajú vo vašom prostredí a netrénujú žiadny model. Bezpečnosť nie je doplnok, vyplýva priamo z architektúry.
Nezávislé od jedného modelu
Svet AI sa mení každý mesiac. Vďaka oddelenej architektúre vám vieme jazykový model priebežne vymieňať za najlepší dostupný, vy neriešite nič.
Realistické očakávania
K odbornej práci patrí aj to, čo systém nerobí. Toto sú reálne obmedzenia a ako s nimi pracujeme.
Kvalita odpovedí = kvalita podkladov
AI odpovedá len tak dobre, ako sú vaše dokumenty aktuálne, úplné a konzistentné. Preto súčasťou auditu je aj poriadok v dátach, nie len napojenie AI.
Aj s citáciami sa môže pomýliť
Model môže zle pochopiť kontext alebo úryvok. Preto je každá odpoveď overiteľná cez zdroj a finálne rozhodnutie ostáva na človeku, AI pripravuje podklad, nenahrádza zodpovednosť.
Nie je to real-time napojenie na všetko
Dáta zo systémov ako sklad či účtovníctvo sa načítavajú v intervaloch (napr. denný export), odpoveď zodpovedá poslednej indexácii. Dokumenty z Microsoft 365 či SharePointu držíme priebežne aktuálne.
Nesľubujeme fiktívne integrácie
Ak zdroj nevie dáta poskytnúť rozumným spôsobom, povieme to a navrhneme reálnu cestu (napr. export do priečinka), nie napojenie, ktoré by v praxi nefungovalo.
Radi vám architektúru ukážeme naživo, aj to, ako by vyzerala nad vašimi dátami.