gpt4 book ai didi

Python爬虫如何应对Cloudflare邮箱加密

转载 作者:qq735679552 更新时间:2022-09-29 22:32:09 33 4
gpt4 key购买 nike

CFSDN坚持开源创造价值,我们致力于搭建一个资源共享平台,让每一个IT人在这里找到属于你的精彩世界.

这篇CFSDN的博客文章Python爬虫如何应对Cloudflare邮箱加密由作者收集整理,如果你对这篇文章有兴趣,记得点赞哟.

最近写一个小爬虫,需要拿到邮箱信息,发现拿不到,也不是ajax接口。最后查资料发现是被Cloudflare加密起来了,有加密肯定有解密.

参考大佬的原话搞起来就好:

柠之漠然:

这个解密方式就是从那段 js 代码转换过来的 。

其中最主要的一句话 。

for (e = ”, r = ‘0x' + a.substr(0, 2) | 0, n = 2; a.length – n; n += 2) e += ‘%' + (‘0' + (‘0x' + a.substr(n, 2) ^ r).toString(16)).slice( – 2),

前面的 2 位数字转化成 16 进制之后就是秘钥, 接下来的每两位字符跟秘钥异或操作之后转成16进制, 然后转换成字符 。

最后将所有解出来的字符拼成一起, 就得到邮箱 abc@abc.com 了 。

js 这边是用 urlencode 的方式 。

下面是复现的js解密代码:

?
1
2
3
function jiemi(val) {
   for (e = '' , r = '0x' + val.substr(0, 2) | 0, n = 2; val.length - n; n += 2) e += '%' + ( '0' + ( '0x' + val.substr(n, 2) ^ r).toString(16)).slice(-2); return decodeURIComponent(e)
}

然后通过python调用js完美搞定:

?
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
import execjs
 
def get_js():
   # f = open("./../js/my.js", 'r', encoding='utf-8') # 打开JS文件
   f = open ( "./jiemi.js" , 'r' , encoding = 'utf-8' ) # 打开JS文件
   line = f.readline()
   htmlstr = ''
   while line:
     htmlstr = htmlstr + line
     line = f.readline()
   return htmlstr
 
 
def get_des_psswd(e):
   js_str = get_js()
   ctx = execjs. compile (js_str) #加载JS文件
   return (ctx.call( 'jiemi' , e)) #调用js方法 第一个参数是JS的方法名,后面的data和key是js方法的参数
 
 
if __name__ = = '__main__' :
   print (get_des_psswd(e = '30515253705152531e535f5d' ))

以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持我.

原文链接:https://www.cnblogs.com/zy-mousai/p/13172350.html 。

最后此篇关于Python爬虫如何应对Cloudflare邮箱加密的文章就讲到这里了,如果你想了解更多关于Python爬虫如何应对Cloudflare邮箱加密的内容请搜索CFSDN的文章或继续浏览相关文章,希望大家以后支持我的博客! 。

33 4 0
Copyright 2021 - 2024 cfsdn All Rights Reserved 蜀ICP备2022000587号
广告合作:1813099741@qq.com 6ren.com