Python利用Xpath对网页进行解析.pdfVIP

  • 9
  • 0
  • 约小于1千字
  • 约 1页
  • 2023-06-07 发布于上海
  • 举报
Python利⽤Xpath对⽹页进⾏解析 ⽤Python做⽹络爬⾍的时候,会对⽹页的信息进⾏提取,笔者接触的有正则表达式,BeautifulSoup,Xpath,前⾯两个都是在国内能够 使⽤的,⽽Xpath是Chrome的⼀个插件,因此需要“翻墙”就可以获取到。 笔者在这⾥提供了Xpath的⽂件。 ⼀、安装Xpath 下载下来后 打开扩展程序,将⽂件拖进去就可以了Crtl+Shift+X就可以打开Xpath ⼆、使⽤Xpath 导⼊lxml和etree 1 mytree = lxml.etree.HTML(content) 2 # 获取电影的基本信息: 3 name = mytree.xpath(*//div[@class=movie-brief-container]//h3[@class=name]//text()) 通过上述⽅法,就可以建⽴Xpath的查询。 三、Xpath的解析⽅法   在使⽤Xpath进⾏解析的时候,需要对它进⾏解析,这⾥附上⼀些解析的介绍,可以根据他的提⽰来写Xpath语句   基本解析⽅式都⼀样抓住要点。

文档评论(0)

1亿VIP精品文档

相关文档