Recovering capitalization and punctuation marks for automatic speech recognition: case study for Portuguese broadcast news

dc.contributor.authorBatista, F.
dc.contributor.authorCaseiro, D.
dc.contributor.authorMamede, N.
dc.contributor.authorTrancoso, I.
dc.date.accessioned2021-02-18T10:47:13Z
dc.date.available2021-02-18T10:47:13Z
dc.date.issued2008
dc.date.updated2021-02-18T10:45:22Z
dc.description.abstractThe following material presents a study about recovering punctuation marks, and capitalization information from European Portuguese broadcast news speech transcriptions. Different approaches were tested for capitalization, both generative and discriminative, using: finite state transducers automatically built from language models; and maximum entropy models. Several resources were used, including lexica, written newspaper corpora and speech transcriptions. Finite state transducers produced the best results for written newspaper corpora, but the maximum entropy approach also proved to be a good choice, suitable for the capitalization of speech transcriptions, and allowing straightforward on-the-fly capitalization. Evaluation results are presented both for written newspaper corpora and for broadcast news speech transcriptions. The frequency of each punctuation mark in BN speech transcriptions was analyzed for three different languages: English, Spanish and Portuguese. The punctuation task was performed using a maximum entropy modeling approach, which combines different types of information both lexical and acoustic. The contribution of each feature was analyzed individually and separated results for each focus condition are given, making it possible to analyze the performance differences between planned and spontaneous speech. All results were evaluated on speech transcriptions of a Portuguese broadcast news corpus. The benefits of enriching speech recognition with punctuation and capitalization are shown in an example, illustrating the effects of described experiments into spoken texts.eng
dc.description.versioninfo:eu-repo/semantics/acceptedVersion
dc.identifier.doi10.1016/j.specom.2008.05.008
dc.identifier.issn0167-6393
dc.identifier.urihttp://hdl.handle.net/10071/22063
dc.journalSpeech Communication
dc.language.isoeng
dc.number10
dc.pagination847 - 862
dc.peerreviewedyes
dc.publisherElsevier
dc.rightsopen access
dc.subjectRich transcriptioneng
dc.subjectPunctuation recoveryeng
dc.subjectSentence boundary detectioneng
dc.subjectCapitalizationeng
dc.subjectTruecasingeng
dc.subjectMaximum entropyeng
dc.subjectLanguage modelingeng
dc.subjectWeighted finite state transducerseng
dc.subject.fosDomínio/Área Científica::Ciências Naturais::Ciências da Computação e da Informaçãopor
dc.subject.fosDomínio/Área Científica::Ciências Naturais::Ciências Físicaspor
dc.subject.fosDomínio/Área Científica::Ciências Agrárias::Outras Ciências Agráriaspor
dc.titleRecovering capitalization and punctuation marks for automatic speech recognition: case study for Portuguese broadcast newseng
dc.typearticle
dc.volume50
degois.publication.firstPage847
degois.publication.issue10
degois.publication.lastPage862
degois.publication.titleRecovering capitalization and punctuation marks for automatic speech recognition: case study for Portuguese broadcast newseng
dspace.entity.typePublicationen
iscte.alternateIdentifiers.scopus2-s2.0-53149126088
iscte.alternateIdentifiers.wosWOS:000260702200006
iscte.identifier.cienciahttps://ciencia.iscte-iul.pt/id/ci-pub-16009

Ficheiros

Pacote original

A mostrar 1 - 1 de 1
A carregar...
Nome:
PEER_stage2_10.1016_j.specom.2008.05.008-3-34.pdf
Tamanho:
1.01 MB
Formato:
Adobe Portable Document Format
Descrição:
Versão Aceite