Automatic punctuation annotation in czech broadcast news speech

Date issued

2004

Journal Title

Journal ISSN

Volume Title

Publisher

SPIIRAS

Abstract

Tento článek se zabývá našimi počátečními experimenty s automatickou anotací interpunkce v mluvené češtině. Použili jsme 2 statistické modely - prozodický a jazykový. Byly otestovány 2 implementace prozodického modelu - CART a MLP. Pro jazykové modelováni byl použit N-gramový model se skrytými událostmi. Kombinovaný model dosáhl na referenčních přepisech přesnosti 95.2% a F-measure 78.2%.

Description

Subject(s)

automatická interpunkce, prozodie, hranice vět, rozhlasové zprávy, morfologické značkování

Citation

KOLÁŘ, Jáchym; ŠVEC, Jan; PSUTKA, Josef. Automatic punctuation annotation in czech broadcast news speech. In: SPECOM 2004 Proceedings. St. Petersburg: Institute for Informatics and Automation of RAS (SPIIRAS), 2004, p. 319-325. ISBN 5-7452-0110-X.

Collections

OPEN License Selector