Dokumentum AI (CoPilot)
Ezen az oldalon
Definíció#
A Dokumentum AI — a QUiCK felületén CoPilot néven is megjelenik — a Dokumentumok modul mesterséges intelligencián alapuló feldolgozó funkciója. A feltöltött szöveges PDF dokumentumok tartalmát elemzi, és kitölti a dokumentum metaadatait: az összefoglalót, a kulcsszavakat, a feladót, a címzettet és a dokumentumtípust, valamint jelzi, ha a dokumentum bírságot, adóterhet vagy más fizetendő összeget tartalmaz. A feldolgozást minden esetben a felhasználó indítja; a rendszer az elemzést a háttérben végzi, az eredményt a dokumentum adatlapjára tölti vissza.
A funkciócsoport határa: a Dokumentum AI kizárólag a nem számla típusú dokumentumokat dolgozza fel. A QUiCK-ben tőle teljesen függetlenül működik az Autoscan, amely a bejövő számlák felismerésére szolgál — a két rendszer más dokumentumtípust céloz, más technológiát használ (az Autoscan Google OCR motort és gépi tanulást, a Dokumentum AI OpenAI-alapú nyelvi modellt), és más aktiválási logikát követ: az Autoscan a háttérben automatikusan fut, a Dokumentum AI kizárólag explicit felhasználói indításra.
Cél és kontextus#
A Dokumentumok modul értéke a visszakereshetőségen áll vagy bukik — a visszakereshetőség viszont a metaadatokon: egy összefoglaló, kulcsszavak és típusbesorolás nélküli PDF a tárban van, de gyakorlatilag nem található meg. A Dokumentum AI ezt a metaadat-munkát váltja ki: a manuális adatbevitel helyett az AI olvassa ki és tölti elő a dokumentum legfontosabb adatait, amelyek azonnal becsatornázódnak a QUiCK keresőjébe. Az eredmény nem csak gépeléscsökkentés, hanem a dokumentumtár kereshetőségének rendszerszintű javulása — a szabadszavas kereső az AI által generált kulcsszavakon és összefoglalókon keresztül olyan iratokat is megtalál, amelyeket kézi adatbevitel mellett senki nem címkézett volna fel.
A működés adatkezelési kerete többszörös explicit hozzájáruláson alapul. A feldolgozás során a dokumentum szöveges tartalma külső szolgáltatóhoz (OpenAI) kerül, ezért a rendszer két szinten kér döntést: egy adminisztrátornak egyszer el kell fogadnia a fiókban az adatkezelési feltételeket, ezt követően pedig minden egyes feldolgozást a felhasználó indít el — egyedileg vagy tömeges futtatással. Automatikus feldolgozás nincs: sem feltöltéskor, sem e-mailes beérkezéskor nem indul elemzés. A felhasználó dönti el, mely dokumentumok tartalma kerül feldolgozásra.
Mikor ezt, mikor mást#
A Dokumentum AI ott térül meg, ahol a nem számla típusú iratok volumene meghaladja a kézi rendszerezés kapacitását: könyvelői anyagok gyűjtésénél (szerződések, teljesítési igazolások, bankszámlakivonatok), hatósági és adminisztratív dokumentáció kezelésénél (NAV levelek, önkormányzati iratok), és általában havi több tucat vagy több száz dokumentum feldolgozásánál. A „Fizetendőt tartalmaz" jelzés emellett kockázatkezelési funkciót is betölt: a bírságot vagy adóterhet hordozó iratok nem süllyednek el a tárban, hanem szűrhetővé válnak.
A választóvonal a Dokumentum AI és az Autoscan között a dokumentum természete: ami bejövő számla, azt az Autoscan dolgozza fel automatikusan a Költségek modulban; ami nem számla, az a Dokumentum AI terepe, felhasználói indításra. Ha egy számlakép tévedésből dokumentumként került a rendszerbe, nem a Dokumentum AI-jal kell feldolgozni, hanem a konvertálás funkcióval költségszámlává alakítani, hogy a számlafeldolgozási folyamatba kerüljön.
A Dokumentum AI javaslatokat tesz, nem döntéseket hoz: az AI által kitöltött mezők ellenőrzése és szükség szerinti javítása a felhasználó feladata — a funkció a tartalom emberi ellenőrzését nem helyettesíti.
Belépési pontok#
Dokumentum adatlap → Feldolgozás gomb — egyedi feldolgozás: a jobb oldali metaadat-panelen jelenik meg, ha a dokumentum megfelel az előfeltételeknek (szöveges PDF, még nem volt feldolgozva)
Dokumentumlista → „Feldolgozás indítható" gyorsszűrő — az AI-feldolgozásra alkalmas, még nem elemzett PDF dokumentumok leválogatása egy kattintással
Dokumentumlista → műveleti sáv → tömeges feldolgozás — a kiszűrt vagy kézzel kijelölt dokumentumok együttes feldolgozása
Előfeltételek#
Multibox előfizetés. A funkció kizárólag Multibox csomagban érhető el; alacsonyabb csomagokban a Feldolgozás gomb nem aktív, akkor sem, ha a dokumentumok egyébként csatolhatók számlákhoz és partnerekhez.
Adatkezelési feltételek elfogadása. Az első használat előtt egy adminisztrátor jogosultságú felhasználónak egyszer el kell fogadnia az adatkezelési feltételeket a fiókban. Ez egyszeri lépés — utána a funkció minden jogosult felhasználó számára elérhető.
Legalább Szerkesztő jogosultság. Megtekintő szerepkörrel a feldolgozás nem indítható.
Szöveges PDF formátum. Az AI kizárólag digitálisan létrehozott, szöveges PDF fájlokon működik. Szkennelt, faxolt vagy fényképből készült PDF esetén a Feldolgozás gomb nem jelenik meg — az ilyen irat az előnézeti képen látszik, de a szövegkinyerés nem lehetséges.
A dokumentum még nem volt feldolgozva. Ha az AI egyszer már lefutott egy dokumentumon — akár sikerrel, akár hibával —, a Feldolgozás gomb alapesetben nem jelenik meg újra.
Működés lépésről lépésre#
1. A dokumentum bekerül a rendszerbe. A PDF érkezhet manuális feltöltéssel, e-mailes beküldéssel az alias címre, böngészőbővítményből vagy publikus API-n keresztül. A rendszer az érkezési forrást rögzíti, de az a feldolgozás menetét nem befolyásolja.
2. Alkalmassági ellenőrzés. Feltöltés után a QUiCK automatikusan ellenőrzi, hogy a dokumentumnak van-e feltöltött fájlja (weblink-alapú dokumentumon az AI nem futtatható), a fájl kiterjesztése .pdf-e, és futott-e már rajta feldolgozás. Ha mindhárom feltétel teljesül, a dokumentum feldolgozásra alkalmasnak minősül: az adatlapján megjelenik a Feldolgozás gomb, és a listanézetben a „Feldolgozás indítható" szűrő feltételének megfelel. Az alkalmasság a listasorban külön jelölésként nem látszik — a szűrő az eszköz a leválogatására.
3. A feldolgozás elindítása. A felhasználó a dokumentum adatlapján a Feldolgozás gombbal, vagy a listanézetből tömeges futtatással indítja az elemzést. A rendszer ekkor ellenőrzi az adatkezelési feltételek elfogadottságát és a jogosultságot, majd a feladatot átadja a háttérben futó feldolgozónak.
4. Háttérbeli feldolgozás. A háttérfolyamat előkészíti a PDF-et, betölti a szöveges tartalmat — legfeljebb az első 10 oldalt —, majd a felhasználó alapnyelvének megfelelően beállítja a feldolgozás nyelvét: magyar alapnyelvű fióknál magyar, minden más esetben angol nyelvű felismerést alkalmaz. A szöveges tartalmat sablon alapján küldi el az OpenAI API-nak, amely visszaadja az eredményt.
5. A kinyert adatok. Az AI a következő mezőket tölti ki:
Összefoglaló — rövid szöveges összefoglalás a dokumentum tartalmáról;
Kulcsszavak — kereséshez és rendszerezéshez használható kulcsszavak listája;
Feladó — a dokumentumot kibocsátó szervezet vagy személy neve;
Címzett — a dokumentum címzettje;
Dokumentumtípus — az AI a QUiCK fix típuslistájából választ: szerződés, bankszámlakivonat, NAV értesítés, teljesítési igazolás, szállítólevél, egyéb. Új típust az AI nem hoz létre; a felhasználó által kézzel felvett egyedi típusokat az AI a besorolásnál nem veszi figyelembe;
Fizetendőt tartalmaz — bejelölve, ha az AI bírságot vagy adóterhet azonosít a dokumentumban.
6. Eredmény visszatöltése. Sikeres feldolgozás után a rendszer frissíti a dokumentumot az AI által kitöltött mezőkkel, a dokumentum pedig Frissült jelölést kap a listanézetben.
7. Hibaág — ha a felismerés sikertelen. Ha a dokumentum szövege nem értelmezhető, a feldolgozás hibás státuszba kerül. A dokumentum mezői érintetlenek maradnak, az eredmény üres. A feldolgozás manuálisan újraindítható.
Állapotok és állapotváltások#
Dokumentum: alkalmas → feldolgozott / hibás. Az alkalmassági státuszt a rendszer a feltöltés után automatikusan állapítja meg (fájl megléte + PDF kiterjesztés + még nem futott feldolgozás). A feldolgozott vagy hibás állapotba váltás kizárólag felhasználói indítás nyomán történik — nem a feltöltéskor és nem a beérkezéskor.
Az alkalmasság nem látható jelölés. A „Feldolgozás indítható" állapot a listasorban nem jelenik meg külön ikonként — a gyorsszűrő feltételeként és a Feldolgozás gomb megjelenéseként érzékelhető.
Feldolgozás után: a gomb eltűnik. Egy dokumentum alapesetben egyszer kerül feldolgozásra; a lefutott elemzés után — sikeres és hibás kimenetnél egyaránt — a sima Feldolgozás gomb nem jelenik meg újra. Hibás státuszú feldolgozás manuálisan újraindítható.
Sikeres feldolgozás: a mezők frissülnek, a dokumentum Frissült jelölést kap. A Frissült státusz a listanézet gyorsszűrőjében is elérhető — így a frissen feldolgozott dokumentumok ellenőrzése leválogatható munkafázis.
Hibás feldolgozás: állapotsemleges a mezőkre. A sikertelen elemzés a dokumentum meglévő metaadatait nem módosítja és nem törli.
A kitöltött mezők szabadon szerkeszthetők. Az AI által előtöltött adatok javítása, kiegészítése a dokumentum szerkesztésével bármikor lehetséges — az AI-kitöltés nem zárol semmit.
Limitációk és specialitások#
Csak szöveges PDF: szkennelt, faxolt vagy fényképből készült PDF-en az AI nem fut — a szövegkinyerés ezeknél nem lehetséges. OCR-alapú feldolgozás ebben a funkcióban nincs.
10 oldalas korlát: az elemzés legfeljebb az első 10 oldalt dolgozza fel; a 10. oldal utáni tartalomból adat nem kerül az eredménybe.
Egyszeri feldolgozás: egy dokumentumon az AI alapesetben egyszer fut le; ismételt futtatásra csak hibás státuszú feldolgozásnál van manuális lehetőség.
Feladó és címzett független a partnertörzstől: az AI által kitöltött Feladó és Címzett mező szabad szöveg, nincs összekapcsolva a QUiCK partnertörzsével. Ha az AI egy szállító nevét írja a Feladó mezőbe, a dokumentum ettől nem kerül az adott partnerhez — a partnerkapcsolást külön, manuálisan kell elvégezni.
A „Fizetendőt tartalmaz" jelölő hatóköre: a jelölő kifejezetten bírság vagy adóteher azonosításakor kerül bejelölésre — nem általánosan minden kifizetendő összegnél. Egy NAV bírságértesítőnél releváns; egy szállítói ajánlatnál bejelölése nem várható.
Weblinkes dokumentumon nem futtatható: URL-hivatkozásként rögzített dokumentumnál nincs feldolgozható fájltartalom.
Adatkezelés: a feldolgozás során kizárólag a dokumentum szöveges tartalma kerül az OpenAI API-hoz — maga a fájl nem. Az adattovábbítás titkosított. A QUiCK az OpenAI-nál Zero Data Retention (ZDR) protokollt kezdeményezett: a szöveges tartalom a feldolgozás után azonnal törlődik, és nem kerül felhasználásra AI-modellek tanítására.
Dokumentum AI ≠ Autoscan: két, egymástól teljesen független feldolgozó rendszer. Az Autoscan Google OCR motort és gépi tanulást használ bejövő számlák adatkinyerésére, automatikusan fut; a Dokumentum AI OpenAI-technológián alapul, kizárólag nem számla típusú dokumentumokat dolgoz fel, és csak felhasználói indításra fut.