- 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
- 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
数据爬取js分析(⼀):Python爬⾍分析⽹页js加密解密
在前⼏天学习 Python 模拟登录知乎实例,其中关于涉及到了 fromdata 的加密处理,再学习的过程中,发现利⽤ chrome devtool调试
分析⽹页还是有很多技巧需要学习,因此⾃⼰找了⼀个简单的实例⽤来学习 js 加密。
⼀、实例⽹站
本实例的⽹站是,学习利⽤ chome 浏览器的 devtool ⼯具对 fromdata 进⾏加密处理。
⼆、分析页⾯逻辑
1.抓包分析
⽤ chrome 打开该⽹页,然后按 F12 打开开发者⼯具 devtool,点击切换到“network”标签页。为了⽅便查看,先清除之前的请求过
程,然后在⽹页上切换城市,即可看到新的 xhr 请求。
可以看到模拟登录 POST 的链接,我们最终的⽬标是构建 POST 请求所需的 headers 和 Form data 这两部分内容。
继续看 Requests Headers 信息,经过对不同城市的查询结果⽐对,发现 Headers 并未有什么独特的特征,因此我们仅先保留⼀部分必
要信息。
接着,我们就需要考虑如何构建 Form data 数据。
2.调试分析
3.加密分析
知道位置后,我们可以直接把这个加密的 js ⽅法都扣出来,放在⼀个 html ⽂件内执⾏就好。
var getParam = (function () {
function ObjectSort(obj) {
var newObject = {};
Object.keys(obj).sort().map(function (key) {
newObject[key] = obj[key]
});
return newObject
}
return function (method, obj) {
var appId = 1a45f75b824b2dc628d5955356b5ef18;
var clienttype = WEB;
var timestamp = new Date().getTime();
var param = {
appId: appId,
method: method,
timestamp: timestamp,
clienttype: clienttype,
object: obj,
secret: hex_md5(appId + method + timestamp + clienttype + JSON.stringify(ObjectSort(obj)))
};
param = BASE64.encrypt(JSON.stringify(param));
return AES.encrypt(param, aes_client_key, aes_client_iv)
}
})();
将该⽅法中涉及到的 js ⽅法⼀起提取出来,除了 jqury-1.8.0.min.js?v=1.2 ⽂件中的必需⽅法之外,我们还需要将 city_detail.html 中的
getAQIData ⽅法提取出来,将所有的 JavaScript 放⼊到⼀个 html ⽂件,放在 script 标签内即可。
记得将查询条件数据放⼊到⽅法中。
在 js 中执⾏ document.write(getAQIData()) ,页⾯输出正确。
三、Python 实现加密
使⽤ python 的 execjs 来执⾏ JavaScript 代码,除了需要安装 execjs 包,还要安装 node 环境。具体安装可以参考⽹上教程。
def encrypt(self, form_data):
对查询条件栏的数据,进⾏加密
:param form_data: 查询条件栏的数据,包括城市名称,开始结束时间等
:return:加密后的字符串
with open(encrypt.js,encoding=utf-8) as f:
js = pile(f.read())
return js.call(getAQIData,form_data)
在测试的过程中,如果遇到 execjs._exceptions.Pr
您可能关注的文档
最近下载
- 物业安全生产培训PPT课件.pptx VIP
- 1.2掌握广西壮族服饰元素及特点(课件)《广西壮族服饰文化与创意设计》.pptx VIP
- 交流电气装置的接地规范.pdf VIP
- 创伤(救治)理论知识考核试题及答案.pdf VIP
- 47_DLT 584-2017《3kV~110kV电网继电保护装置运行整定规程》.pdf VIP
- 基于FAP启动子的表达载体及心肌纤维化药物筛选方法.pdf VIP
- 建设工程项目管理规范材料.doc VIP
- 中国设施农业的减碳增汇效应分析——基于1828个县域面板数据的实证研究.pdf VIP
- 小学体育与健康沪教版(五四学制)(2024)二年级全一册《第四课 运动场上我最棒》教学设计 .pdf
- GB50270-2010 输送设备安装工程施工及验收规范.docx VIP
文档评论(0)