- 9
- 0
- 约小于1千字
- 约 1页
- 2023-06-07 发布于上海
- 举报
Python利⽤Xpath对⽹页进⾏解析
⽤Python做⽹络爬⾍的时候,会对⽹页的信息进⾏提取,笔者接触的有正则表达式,BeautifulSoup,Xpath,前⾯两个都是在国内能够
使⽤的,⽽Xpath是Chrome的⼀个插件,因此需要“翻墙”就可以获取到。
笔者在这⾥提供了Xpath的⽂件。
⼀、安装Xpath
下载下来后
打开扩展程序,将⽂件拖进去就可以了Crtl+Shift+X就可以打开Xpath
⼆、使⽤Xpath
导⼊lxml和etree
1 mytree = lxml.etree.HTML(content)
2 # 获取电影的基本信息:
3 name = mytree.xpath(*//div[@class=movie-brief-container]//h3[@class=name]//text())
通过上述⽅法,就可以建⽴Xpath的查询。
三、Xpath的解析⽅法
在使⽤Xpath进⾏解析的时候,需要对它进⾏解析,这⾥附上⼀些解析的介绍,可以根据他的提⽰来写Xpath语句
基本解析⽅式都⼀样抓住要点。
您可能关注的文档
最近下载
- 2021-2025年高考地理试题知识点分类汇编之地球与地图.pdf VIP
- 九年级历史下册新教材解读课件(统编版新教材).pptx VIP
- 住宅物业服务规范.pdf VIP
- 地埋电缆施工技术方案.docx
- T∕CERS 0100-2025 电力信息系统入网安全测试技术要求.pdf VIP
- TCAIM 024-2021 肺癌(非小细胞型)中西医结合诊疗专家共识.pdf VIP
- T_CACM 1613—2024(非小细胞肺癌中西医结合诊疗指南).pdf VIP
- 火电厂化学主管岗位竞聘试题及详细答案.docx VIP
- 腾讯综合素质测评项目二逻辑推理题新增.pdf VIP
- 2026年哈三中高三下学期三模语文试卷及答案.docx VIP
原创力文档

文档评论(0)