爬虫数据抓取流程与urllib.request模块使用详解.pdf

爬虫数据抓取流程与urllib.request模块使用详解.pdf

DAY02

Day01回顾

爬虫爬取数据步骤

1、确定需要爬取的URL地址2、由请求模块向URL地址发出请求,并得到

的响应(网页的源码)3、从响应内容中提取所需数据1、所需数据,保存2、

页面中有其他需要继续跟进的URL地址,继续第2步去发请求,如此循环

爬虫请求模块request

模块名及导入

1、模块名:urllib.request2、导入方

式:1、importurllib.request2、

fromurllibimportrequest

常用方法详解

urllib.request.urlopen

文档评论(0)

1亿VIP精品文档

相关文档