數(shù)據(jù)標注方法、裝置、電子設備及計算機可讀存儲介質
基本信息
申請?zhí)?/td> | CN202110647704.8 | 申請日 | - |
公開(公告)號 | CN113239205A | 公開(公告)日 | 2021-08-10 |
申請公布號 | CN113239205A | 申請公布日 | 2021-08-10 |
分類號 | G06F16/35(2019.01)I;G06F16/45(2019.01)I;G06F40/30(2020.01)I;G06F16/215(2019.01)N;G06F16/25(2019.01)N | 分類 | 計算;推算;計數(shù); |
發(fā)明人 | 史祎凡;杜新凱;呂超;蔡巖松 | 申請(專利權)人 | 陽光保險集團股份有限公司 |
代理機構 | 北京超凡宏宇專利代理事務所(特殊普通合伙) | 代理人 | 余菲 |
地址 | 518000廣東省深圳市福田區(qū)紅荔西路7002號第一世界廣場A座17層 | ||
法律狀態(tài) | - |
摘要
摘要 | 本申請?zhí)峁┝艘环N數(shù)據(jù)標注方法、裝置、電子設備及計算機可讀存儲介質,該方法包括:獲取包含有至少一個文本數(shù)據(jù)及文本數(shù)據(jù)對應的第一標注結果的第一數(shù)據(jù)集;當?shù)谝粯俗⒔Y果的準確率大于第一閾值時,對第一數(shù)據(jù)集中的文本數(shù)據(jù)進行數(shù)據(jù)擴充得到第二數(shù)據(jù)集;針對第二數(shù)據(jù)集中的每個文本數(shù)據(jù),從該文本數(shù)據(jù)中提取出與預設的維護詞表中的關鍵詞相同的目標詞語,確定第二標注結果;當?shù)诙俗⒔Y果的準確率大于第二閾值時,將每個文本數(shù)據(jù)對應的第一標注結果和第二標注結果的樹狀關系確定為該文本數(shù)據(jù)的目標標注結果。本申請通過對文本數(shù)據(jù)標注第一標注結果和第二標注結果,并根據(jù)第一標注結果與第二標注結之間的樹狀關系,提高文本數(shù)據(jù)的區(qū)分度。 |
