Metody redukce OOV ve statistických jazykových modelech založených na třídách

Date issued

2012

Journal Title

Journal ISSN

Volume Title

Publisher

Západočeská univerzita v Plzni

Abstract

Tato práce se zabývá statickými modely přirozeného jazyka a jejich speciálním druhem jazykovými modely postavené na třídách. Tyto modely se používají v~systémech rozpoznávání řeči. Práce se nezabývá obecným zlepšováním jazykového modelování, ale zaměřuje na oblast specifických skupin slov, které nelze dobře modelovat z~dostupných trénovacích dat. Nedostatečnost dat je limitující faktor pro jazykové modelování současných metod. Přidání slov do systému není triviální problém z důvodu požadavku, aby systém tato slova dokázal rozpoznat, budou-li vyslovena a současně se nezhoršila obecná přesnost rozpoznávání. Jelikož tyto třídy jsou otevřené, vyskytuje se často legitimní potřeba tato slova přidávat do již hotového ASR systému. Toto přidání ovšem není jednoduchá záležitost a často vede ke snížení přesnosti rozpoznávání. Cílem práce je připravit postup rozšíření slovníku systému rozpoznávání řeči a zajistit správné nastavení systému pro správné rozpoznávání těchto slov při současném nezhoršení parametrů celého systému.

Description

Subject(s)

rozpoznávání řeči, jazykové modelování, jazykový model s třídami, rozšíření slovníku, redukce OOV

Citation

OPEN License Selector