相似度计算方法与技术栈综述.pptxVIP

  • 1
  • 0
  • 约2.63千字
  • 约 33页
  • 2026-04-21 发布于北京
  • 举报

文本相似度————————VSM,embedding,deepmatchbrucehan2020-04-05

学习的哲学思考从公式、公理、定律、规范、制度等一系列上层设计出发,进行操作、执行、推理、演绎等基于实践、经验、教训等既定历史存在,总结规律、运用数理知识进行分析、归纳,得出最佳实践贝叶斯决策树SVM神经网络正则表达式自动机词典强化学习知识库体系结构

NLP技术栈文本分类信息检索信息抽取阅读理解问答系统多轮交互推荐系统自动摘要语义embedding机器学习机器翻译知识图谱语义相似性计算分词关系抽取词性标注句法分析命名体语言模型神经网络逻辑推理经验规则领域任务基础技术底层原理语音识别情感计算

Contents目录向量空间模型01语义表征02排序04深度匹配03

几个基本问题句子表示相似度计算(距离表示)对齐的字符序列非对齐的词向量平均句子级别的embedding编辑距离DICE系数、Jaccard系数欧式距离余弦距离a.b.cbcdf(I,j)=f(i-1,j-1).Ifa[i]==b[j]F(I,j)=min(f(i-1,j),f(I,j-1),f(i-1,j-1))

One-hot特点:稀疏表示、词表空间英文常见单词3w词向量book:(1,0,0,0,0,0,0,….)me

文档评论(0)

1亿VIP精品文档

相关文档