- 7
- 0
- 约3.45万字
- 约 44页
- 2026-04-09 发布于北京
- 举报
这篇文章主要讲述了使用python+sele新浪微博的热点话题
和评论信息。其中使用该爬虫的缺点是效率极低,傻瓜式的爬虫,不
能并行执行等,但是它的优点是采用分析DOM树结构分析网页源码并
进行信息爬取,同时它可以通过浏览器进行爬取中间过程的演示及验
证码的输入。这篇文章对爬虫的详细过程就不再论述了,主要是
可运行的代码和运行截图即可。希望文章对你有所帮助吧~
实现过程
运行截图如下所示,它通过调用Firefox浏览器,然后输入移动端,
自动登录。它会自动输入用户名及,但需要用户在设置
暂停20秒内输入。登录后,它会自动跳转到搜索页
面,当用户输入欢乐颂后,就会对返回信息及评论进
行爬取了,爬取过程中需要注意翻页即可。
这篇文章主要讲述了使用python+selenium爬取的热点话题
和评论信息。其中使用该爬虫的缺点是效率极低,傻瓜式的爬虫,不能
并行执行等,但是它的优点是采用分析DOM树结构分析网页源码
您可能关注的文档
最近下载
- 义务教育语文课程标准日常修订版2022年版2025年修订解读PPT课件.doc VIP
- 7-《智能锂电BMS技术演进:智驭大电芯,跃迁新场景》天邦达 研发中心总监 肖展伟.pdf
- 输变电工程施工质量验收统一表式(变电工程土建专业)-2024年版.pdf VIP
- 2025年留置看护辅警考试题库(含答案).docx
- 上海盛视天橙传媒股份有限公司股权转让说明书.pdf
- 革命历程中的红色故事PPT模板.pptx VIP
- 深信服超融合HCI用户手册_V6.8.0.pdf
- 林德E系列388中文故障码.docx
- 重症患者的容量管理.pptx VIP
- 2026长郡中学高一入学语文分班考试真题含答案.docx VIP
原创力文档

文档评论(0)