网络爬虫(ython实现).pptVIP

  • 7
  • 0
  • 约1.9千字
  • 约 10页
  • 2019-05-11 发布于浙江
  • 举报
Presentation 网络爬虫入门|以华师图书馆/豆瓣为例 (Python实现) @汪政 East China Normal University 2019年5月3日 CONTENTS 目录 1 什么是爬虫 2 背景意义 3 三步走 4 模拟登陆 5 豆瓣抓取 6 小结 2019年5月3日 East China Normal University 网络爬虫 网络爬虫:是一个功能很强的自动提取网页的程序/脚本,它为搜索引擎从万维网上下载网页,是搜索引擎的重要组成部分。 防爬虫:爬虫行为分为搜索引擎爬虫及扫描程序爬虫,可屏蔽特定的搜索引擎爬虫节省带宽和性能,也可屏蔽扫描程序爬虫,避免网站被恶意抓取页面。(网站洁癖) 2019年5月3日 East China Normal University 选题背景 三步走 Review 模拟登陆 豆瓣抓取 小结 在我们日常上网浏览网页的时候,经常会看到一些好看的图片,我们就希望把这些图片保存下载,或者用户用来做桌面壁纸,或者用来做设计的素材。   我们最常规的做法就是通过鼠标右键,选择另存为。但有些图片鼠标右键的时候并没有另存为选项,还有办法就通过就是通过截图工具截取下来,但这样就降低图片的清晰度。好吧~!其实你很厉害的,右键查看页面源代码。 我们再来看下知乎神贴~ 可以干哪些有趣的事情? 1 2019年5月

文档评论(0)

1亿VIP精品文档

相关文档