Název:
Automatická tvorba titulků k filmu rozpoznávačem řeči
Překlad názvu:
Automatic Generating of Subtitles by Speech Recognizer
Autoři:
Csintalan, György ; Plchot, Oldřich (oponent) ; Schwarz, Petr (vedoucí práce) Typ dokumentu: Bakalářské práce
Rok:
2011
Jazyk:
cze
Nakladatel: Vysoké učení technické v Brně. Fakulta informačních technologií
Abstrakt: [cze][eng]
Tato bakalářská práce popisuje vývoj aplikace pro automatickou tvorbu titulků k filmům pomocí BSAPI (Brno Speech Application Interface). V úvodní části, je čtenář uveden do problematiky a jsou naznačeny cíle práce. Následuje popis teoretického základu zpracování řeči a popis rozpoznávače a jeho API (BSAPI). Dále je uveden způsob extrakce zvukové stopy z videa z teoretického hlediska. V nasledující části jsou popsány principy zpracování výstupu rozpoznávače a vytvoření titulků. V další kapitole je popsána tvorba aplikáce z implementačního hlediska. Dále následuje popis experimentů vykonaných v různych situacích a jsou navrženy další možné způsoby zlepšení kvůli dosáhnutí kvalitnejšího výstupu, například filtrování zvuku pomocí Wienerova filtru. V závěrečné části jsou rozebrány dosáhnuté výsledky a získané zkušenosti.
This bachelor thesis describes developing an application for automatic generation of subtitles for films using BSAPI (Brno Speech Application Interface). At first the reader is guided to the problematics of this task and the aim of this work is described. In the next section the speech recognition API (BSAPI) is described from a theoretical point of wiev. After this, the next section is about extracting voice channel from video. The next chapter describes the implementation of the application. Further, experiments in different situations are described and possible improvements are discussed in order to achieve better outputs, for example speech enhancement by Wiener filter. In the conclusion are discussed achieved results and experiments.
Klíčová slova:
automatická tvorba titulků; AVI; BSAPI; directshow; redukování šumu; rozpoznávání řeči; SRT; Wienerův filter; automatic generating of subtitles; AVI; BSAPI; directshow; noise reduction; speech recognition; SRT; Wiener filter
Instituce: Vysoké učení technické v Brně
(web)
Informace o dostupnosti dokumentu:
Plný text je dostupný v Digitální knihovně VUT. Původní záznam: http://hdl.handle.net/11012/187432