SharePoint Add-In pro vytěžování dat z dokumentů
Date issued
2017
Authors
Journal Title
Journal ISSN
Volume Title
Publisher
Západočeská univerzita v Plzni
Abstract
Tato práce je zaměřena na návrh a vytvoření SharePoint add-inu zajišťujícího vytěžování dat z naskenovaných faktur. V rámci experimentu byl vyzkoušen a porovnán vzorek OCR nástrojů. Nejlepších výsledků z~bezplatných řešení dosáhl nástroj OnlineOCR.net. Vyzkoušeno bylo také několik metod vytěžování dat z faktur. Jako nejvhodnější se ukázala metoda založená na Locality-Sensitive Hashing. Tyto poznatky byly využity při návrhu a implementaci výsledného add-inu. Kompletní řešení je hostováno na cloudové platformě Microsoft Azure. Pro asynchronní zpracovávání požadavků na vytěžování dat bylo použito několik Azure komponent (fronta, webová úloha). Výsledkem je funkční add-in do SharePoint Online, jehož použití částečně automatizuje ruční přepis faktur do systému a minimalizuje vzniklé chyby.
Description
Subject(s)
sharepoint, add-in, vytěžování dat, dolování dat, rozpoznávání znaků, ocr, účetní dokumenty, faktura, office 365, microsoft azure