Text Line Segmentation in Historical Newspapers
dc.contributor.author | Lenc, Ladislav | |
dc.contributor.author | Martínek, Jiří | |
dc.contributor.author | Král, Pavel | |
dc.date.accessioned | 2023-12-04T11:00:21Z | |
dc.date.available | 2023-12-04T11:00:21Z | |
dc.date.issued | 2022 | |
dc.description.abstract | Článek řeší problematiku segmentace textových řádek v historických novinách. Je zde navržen nový přístup, který dělí úlohu na dvě části: detekci textových bloků a detekci řádek. Tento přístup by měl odstranit nedostatky metod, které segmentaci řádek provádějí v jednom kroku. Jednotlivé podúlohy jsou řešeny s využitím plně konvolučních neuronových sítí. Metoda je vyhodnocena na dvou standardních datasetech, Europeana a RDCL 2019, a na novém korpusu, který byl vytvořen z dat dostupných na portálu Porta fontium. Tato datová sada je volně přístupná pro výzkumné účely. | cs |
dc.description.abstract-translated | The paper deals with text line segmentation in historical newspapers. We propose a novel approach which decomposes this problem into two steps: text-block and text-line segmentation. The method should solve issues that may appear in a more commonly used one-step approach. The particular tasks are handled using fully convolutional neural networks. The approach is evaluated on two standard corpora, Europeana and RDCL 2019, and on a novel dataset created from data available in Porta fontium portal. This dataset is freely available for research purposes. | en |
dc.format | ||
dc.format | 14 s. | cs |
dc.format.mimetype | application/pdf | |
dc.identifier.citation | LENC, L. MARTÍNEK, J. KRÁL, P. Text Line Segmentation in Historical Newspapers. In Artificial Intelligence and Soft Computing. Cham: Springer Nature Switzerland AG, 2022. s. 35-48. ISBN: 978-3-031-23479-8 , ISSN: 0302-9743 | cs |
dc.identifier.document-number | 972697500003 | |
dc.identifier.doi | 10.1007/978-3-031-23480-4_3 | |
dc.identifier.isbn | 978-3-031-23479-8 | |
dc.identifier.issn | 0302-9743 | |
dc.identifier.obd | 43939531 | |
dc.identifier.uri | 2-s2.0-85149639546 | |
dc.identifier.uri | http://hdl.handle.net/11025/54900 | |
dc.language.iso | ||
dc.language.iso | en | en |
dc.project.ID | EF17_048/0007267/InteCom: VaV inteligentních komponent pokročilých technologií pro plzeňskou metropolitní oblast | cs |
dc.publisher | Springer Nature Switzerland AG | en |
dc.relation.ispartofseries | Artificial Intelligence and Soft Computing | en |
dc.rights | Plný text je přístupný v rámci univerzity přihlášeným uživatelům | cs |
dc.rights | © The Author(s) | en |
dc.rights.access | restrictedAccess | en |
dc.subject | segmentace obrazových dokumentů | cs |
dc.subject | analýza rozložení stránky | cs |
dc.subject | plně konvoluční neuronové sítě | cs |
dc.subject | FCN | cs |
dc.subject.translated | document image segmentation | en |
dc.subject.translated | layout analysis | en |
dc.subject.translated | fully convolutional network | en |
dc.subject.translated | FCN | en |
dc.title | Text Line Segmentation in Historical Newspapers | en |
dc.title.alternative | Segmentace řádek textu v historických novinách | cs |
dc.type | konferenční příspěvek | cs |
dc.type | ConferenceObject | en |
dc.type.status | ||
dc.type.status | Peer-reviewed | en |
dc.type.version | publishedVersion | en |
Files
Original bundle
1 - 1 out of 1 results
No Thumbnail Available
- Name:
- 978-3-031-23480-4_3.pdf
- Size:
- 291.32 KB
- Format:
- Adobe Portable Document Format