中文分词jieba库 (1)讲解.pptxVIP

  • 12
  • 0
  • 约1.47千字
  • 约 12页
  • 2024-08-08 发布于陕西
  • 举报

BYYUSHENPython中文分词jieba库主讲老师:任越美

jieba库在自然语言处理过程中,为了能更好地处理句子,需要把句子拆开分成一个一个的词语,这样能更好的分析句子的特性,这个过程叫做分词。pipinstalljieba安装:importjieba使用:

jieba库分词模式精确模式全模式搜索引擎模式任务一:使用jieba库精确模式对文本“河小青具有团队协作精神及创新能力”进行分词操作。

jieba库—精确模式是精确模式分词:试图将句子最精确地切开,适合文本分析。cut和lcutimportjiebas=河小青具有团队协作精神及创新能力words1=jieba.cut(s)#jieba.cut()返回的是一个可迭代类型words=jieba.lcut(s)#jieba.lcut()返回的是一个列表print(精确模式:+/.join(words1))print(精确模式:,words)运行结果:精确模式:河小青/具有/团队/协作/精神/及/创新能力精确模式:[‘河小青’,’具有’,’团队’,’协作’,’精神’,’及’,’创新能力’]

jieba库—全模式通过设置参数cut_all=true将中文文本进行全模式分词,找出所有的词语。cut和lcut区别1.精确模式是将句子最精确的切分,不存在冗余数据。2.全模式

文档评论(0)

1亿VIP精品文档

相关文档