莱葩

大萊葩()是自動評測翻譯-{zh-cn:質量; zh-tw:品質}-的計算模型。最早公佈的版本始於2012年的機選語言學年度會議COLING。此評測模型不依賴於具體語言,可以方便應用於多種語言。此模型設計包含較豐富的評測指標因素以及可調參數,參數設置是為了滿足不同話題和不同語種下的相關需求。

背景研究
自從IBM研究團隊提出自動翻譯評測模型BLEU 之後,自動翻譯評測得到很多廣泛應用,因為其耗時少、花費少、操作方便快捷,對機器翻譯系統的開發工作提供很大的推動作用。於此同時,很多科研人員對此模型進行了分析,發現很多不足之處。陸續出現的自動評測模型包括METEOR,等。但是目前的評測模型仍然面臨很多不足之處,比如,評測指標設計不夠完整,導致評測不準確,評測偏差;以及,使用過多的語言學特征來提高評測-{zh-cn:質量; zh-tw:品質}-,但是導致評測結果不易重複。萊葩評測工具的提出是基於對存在問題的研究,努力克服這些議題,設置廣泛的評測因子提高評測準確性,減少語言學特征來使得評測過程可重複性好。

模型設計
萊葩翻譯評測模型包含三個主要指標:長度懲罰,位移懲罰,準確度和召回率。
萊葩修改BLEU的長度懲罰因子,對簡短和冗長句子都進行懲罰係數設置。基於前人研究工作的位移懲罰設置,萊葩加入n元詞對齊的語言學上下文考慮。準確率和召回率是反應翻譯質量輸出準確性和對原文忠實度的重要指標。

模型表現
萊葩模型在國際機器翻譯年度會議WMT的從屬比賽上取得優秀的表現 [https://www.aclweb.org/ ACL] ([http://www.sigmt.org/ ACL-WMT] ). 在年度比賽ACL-WMT 2013,中,萊葩對英語到其他語言的翻譯評測最接近人工評測,使用Pearson先關係數,取得五個語言對平均(英-法,英語-西班牙語,英語-捷克語,英語-德語,英語-俄語)相關分數排名第一。 在英語為目標語言的評測上另一個評測模型METEOR取得第一。
跟進的使用詞性標註信息的萊葩評測模型表現出更好的分數

相關鏈接
*Evaluation of machine translation
*Machine translation

注釋
參考文獻

軟件鏈接

评论 (0)

  • 还没有评论,来抢沙发吧。