- 6
- 0
- 约1.6万字
- 约 10页
- 2023-05-18 发布于四川
- 举报
本发明提供一种基于多模型融合的文本相似性度量方法,包括如下步骤:准备训练集和测试集;选择四个深度学习训练模型:Bert、Paddle、Xlnet和Tree‑LSTM;对于各训练模型,获取C个子模型;对于每个子模型,计算输入数据的相似度得分和损失函数;对各子模型进行评估;选取并固定各子模型的评估值最好的一组超参组合;对各子模型继续训练以使其损失函数收敛,并保存此时的4C个子模型;采用Boosting方案对4C个子模型进行融合,以将各子模型的相似性得分进行加权相加,得到相似性度量模型;利用测试集的数
(19)中华人民共和国国家知识产权局
(12)发明专利申请
(10)申请公布号 CN 112784587 A
(43)申请公布日 2021.05.11
(21)申请号 202110017778.3 (51)Int.Cl.
原创力文档

文档评论(0)