- 16
- 0
- 约17.37万字
- 约 191页
- 2018-11-02 发布于安徽
- 举报
.
HYPERLINK /947.html Python爬虫入门三之Urllib库的基本使用
HYPERLINK /category/technique/python ?Python ? HYPERLINK /author/cqcre 崔庆才??5个月前 (02-12)??13660℃?? HYPERLINK /947.html \l comments 13评论
那么接下来,小伙伴们就一起和我真正迈向我们的爬虫之路吧。
1.分分钟扒一个网页下来
怎样扒网页呢?其实就是根据URL来获取它的网页信息,虽然我们在浏览器中看到的是一幅幅优美的画面,但是其实是由浏览器解释才呈现出来的,实质它是一段HTML代码,加 JS、CSS,如果把网页比作一个人,那么HTML便是他的骨架,JS便是他的肌肉,CSS便是它的衣服。所以最重要的部分是存在于HTML中的,下面我们就写个例子来扒一个网页下来。
1
2
3
4
import urllib2
?
response = urllib2.urlopen()
print response.read()
是的你没看错,真正的程序就两行,把它保存成 demo.py,进入该文件的目录,执行如下命令查看运行结果,感受一下。
1
HYPERLINK /cpro/ui/uijs.php?adclass=0app_id=0c=newscf=1001ch=0di
原创力文档

文档评论(0)