结合关键词辨识可信度分数门槛值.pptVIP

  • 1
  • 0
  • 约9.53千字
  • 约 38页
  • 2019-05-31 发布于天津
  • 举报
中文文字/語音文件中 類專有名詞擷取 及其可能應用之初步研究 An Initial Study on Named Entity Extraction from Chinese Text/Spoken Documents and Its Potential Applications 指導教授:李琳山 博士 共同指導:陳信希 博士 研究生:劉禹吟 簡介 本論文處理的類專有名詞類別包含人名、地名與組織名。 類專有名詞辨識是希望在文件中標註出正確的類專有名詞邊界與類別。 語音文件中的類專有名詞辨識: 在有語音辨識錯誤的語音文件中找出類專有名詞出現處 有助於語音摘要、語音問答、和語音對話系統的處理 綱要 文字文件中類專有名詞辨識 語音文件中類專有名詞辨識 類專有名詞辨識衍生之應用 結論 文字文件中的類專有名詞辨識 類別語言模型法 派樹式規則法 文字文件中類專有名詞辨識 -類別語言模型法的概念 類別的種類: 人名類別、地名類別、組織名類別、辭典中詞彙每一個詞各自是一個類別 若辭典中有|V| 個詞彙,則總共的類別數有|V|+3個 基本概念:給定中文句子S,W為S的可切分詞串,C為W對應的類別,利用維特比搜尋找出滿足P(C,W)最大的最佳詞序列W*和W*對應的最佳類別序列C* 各種類別語言模型的機率估計 各種類別生成模型估計 人名類別 (字元二連語言模型) 中國人名、外國

文档评论(0)

1亿VIP精品文档

相关文档