OCR čitanje

Sistem za prepoznavanje dokumenata odnosno OCR program pretvara informacije iz slike u tekst, koje potom može da koristi čitač tekstova.
Naravno, nijedan OCR alat nije savršen, zato je potrebno nakon konverzije pregledati tekst i određene greške ručno popraviti. Pa ipak, korišćenje OCR alata je mnogo brže od ručnog prepisivanja celokupnog teksta.
OCR čitač odnosno sistem za prepoznavanje računa je ugrađen i u PANTHEON. U pitanju je programska oprema koja sama uči odnosno upotrebljava složene algoritme veštačke inteligencije za učenje. Na taj način svakim korišćenjem postaje za nijansu bolja.
Sistem za OCR čitanje u PANTHEON-u može pročitati različite podatke, odnosno najveći broj standardnih/obaveznih sadržaja na računu, npr. PIB pošiljaoca, naziv pošiljaoca, neto iznos, datum valute itd.
To možemo videti na donjem primeru primljenog računa. Skup podataka koje sistem prepoznaje zavisi i od kvaliteta PDF formata računa.

Konverzija dokumenata se obračunava po paketima obrađenih računa, bez obzira na to koliko strana ima pojedinačni račun. Kada potrošite račune u paketu, jednostavno možete naručiti novi.
Korisnici standardne usluge mogu u PANTHEON-u izabrati između dve opcije:
- detaljno čitanje pozicija dokumenata - za čitanje svake pojedinačne pozicije dokumenta
- sumarno čitanje pozicija dokumenta - za čitanje iznosa, združenih po poreskim stopama
|

|
UPOZORENJE
Za što kvalitetnije prepoznavanje preporučujemo upotrebu skenera u boji, sa rezolucijom 300 DPI, te skeniranje stranice tako što ćete je položiti pravo, tako da čitač stranicu raščitava odozgo nadole. Najniži prihvatljivi kvalitet je 150 DPI, mada treba napomenuti da su rezultati kod ove rezolucije obično 15% slabiji. Nikakvo dodatno procesiranje sa programima za skeniranje nije preporučljivo.
|