《Python网络爬虫技术》项目2 爬虫基础知识准备.pptxVIP

  • 15
  • 0
  • 约9.2千字
  • 约 97页
  • 2025-08-06 发布于广东
  • 举报

《Python网络爬虫技术》项目2 爬虫基础知识准备.pptx

第二章爬虫基础知识准备;;网络爬虫就是按照一定的规则,自动地抓取万维网信息的程序或脚本。爬取通常是从网站的某个页面开始的,通过解析网页内容获取目标数据。

使用浏览器访问某企业网址/,借助浏览器开发者工具,查看网页源代码并分析页面的结构和常用标签作用,查找网页资源中是否传输XML和JSON类型的数据。

;根据网页源代码,分析网页结构和常用的标签作用。

根据网页源代码,明确各标签之间的嵌套关系。

能区分动态网页和静态网页。

能区分不同类型的数据。

;HTML主要通过HTML标签对网页中的文本、按钮、图片、声音等内容进行描述。

HTML提供了很多标签,如段落标签p、标题标签h1、超链接标签a、图片

文档评论(0)

1亿VIP精品文档

相关文档