Python网络爬虫实习报告.docx

Python 网络爬虫实习报告 Python 网络爬虫实习(报告) Python 网络爬虫实习(报告) - - PAGE 1 - 目录 一、选题背景 - 2 - 二、爬虫原理 - 2 - 三、爬虫历史和分类 - 2 - 四、常用爬虫框架比较 - 2 - 五、数据爬取实战(豆瓣网爬取电影数据) - 3 - 1 分析网页 - 3 - 2 爬取数据 - 3 - 3 数据整理、转换 - 4 - 4 数据保存、展示 - 9 - 5 技术难点关键点 - 10 - 六、总结 - 13 - 一、选题背景二、爬虫原理 三、爬虫历史和分类 四、常用爬虫框架比较 Scrapy 框架:Scrapy 框架是一套比较成熟的Python 爬虫框架,是使用Python 开发的快速、高层次的信息爬取框架,可以高效的爬取web 页面并提取出结构化数据。Scrapy 应用范围很广,爬虫开发、数据挖掘、数据监测、自动化测试等。 Crawley 框架:Crawley 也是Python 开发出的爬虫框架,该框架致力于改变人们从互联网中提取数据的方式。 Portia 框架:Portia 框架是一款允许没有任何编程基础的用户可视化地爬取网页的爬虫框架。 newspaper 框架:newspaper 框架是一个用来提取新闻、文章以及内容分析的Python 爬虫框架。 Python-goose 框架:Python-goos

文档评论(0)

1亿VIP精品文档

相关文档