一種雙語(yǔ)無(wú)監(jiān)督句法分析方法及系統(tǒng)

基本信息

申請(qǐng)?zhí)?/td> CN201410394850.4 申請(qǐng)日 -
公開(kāi)(公告)號(hào) CN104281564A 公開(kāi)(公告)日 2015-01-14
申請(qǐng)公布號(hào) CN104281564A 申請(qǐng)公布日 2015-01-14
分類號(hào) G06F17/27(2006.01)I 分類 計(jì)算;推算;計(jì)數(shù);
發(fā)明人 劉凱;姜文斌;劉群 申請(qǐng)(專利權(quán))人 橙譯中科信息技術(shù)(北京)有限公司
代理機(jī)構(gòu) 北京律誠(chéng)同業(yè)知識(shí)產(chǎn)權(quán)代理有限公司 代理人 中國(guó)科學(xué)院計(jì)算技術(shù)研究所;橙譯中科信息技術(shù)(北京)有限公司
地址 100190 北京市海淀區(qū)中關(guān)村科學(xué)院南路6號(hào)
法律狀態(tài) -

摘要

摘要 本發(fā)明公開(kāi)了一種雙語(yǔ)無(wú)監(jiān)督句法分析方法及系統(tǒng),該方法包括以下步驟:步驟1,在雙語(yǔ)語(yǔ)料源端和目標(biāo)端分別建立隨機(jī)句法分析樹(shù)庫(kù);步驟2,在該隨機(jī)句法分析樹(shù)庫(kù)上通過(guò)計(jì)算單語(yǔ)無(wú)監(jiān)督句法分析樹(shù)的概率來(lái)單獨(dú)訓(xùn)練單語(yǔ)無(wú)監(jiān)督句法分析模型;步驟3,通過(guò)計(jì)算松弛同構(gòu)相似度和雙語(yǔ)句法分析算法對(duì)該單語(yǔ)無(wú)監(jiān)督句法分析模型進(jìn)行雙語(yǔ)句法分析,得到最為滿足松弛同構(gòu)雙語(yǔ)句法分析目標(biāo)的雙語(yǔ)句法分析樹(shù)庫(kù),并用以替換該隨機(jī)句法分析樹(shù)庫(kù);步驟4,重復(fù)上述步驟1-步驟3,直至該單語(yǔ)無(wú)監(jiān)督句法分析模型收斂。由此,獲得更好的單語(yǔ)無(wú)監(jiān)督句法分析模型,以用于所有需要句法分析的下游應(yīng)用中。