首页 > 编程语言 > 详细

python快手爬虫:解决粉丝数、 关注数等字体加密

时间:2020-09-29 23:16:19      阅读:74      评论:0      收藏:0      [点我收藏+]

技术分享图片技术分享图片?
想拿一下粉丝数 关注数 描述等

很多人学习python,不知道从何学起。
很多人学习python,掌握了基本语法过后,不知道在哪里寻找案例上手。
很多已经做案例的人,却不知道如何去学习更加高深的知识。
那么针对这三类人,我给大家提供一个好的学习平台,免费领取视频教程,电子书籍,以及课程的源代码!
QQ群:961562169


发现字体是加密的 elements是这样的
技术分享图片技术分享图片?
源代码里是这样的
技术分享图片技术分享图片?
找了找js 原来是用


技术分享图片

这些玩意 去
技术分享图片技术分享图片?
这个ttf里一一对应 然后用 js + css画出来的
找到问题所在,就fuck掉它
把js扣出来?用execjs去执行?太LOW了
既然做python 那就用python去重写
首先用re去拿这个ttf的url (因为每次都变)
技术分享图片技术分享图片?
先给这玩意下载下来 把这个ttf文件扔fonteditor里 然后去
http://fontstore.baidu.com/static/editor/index.html
瞅瞅
技术分享图片技术分享图片?
这个时候就发现了东西
技术分享图片技术分享图片?
技术分享图片技术分享图片?
不就是这玩意吗,找到对应关系了 那就ok了
TTF文件没办法直接搞啊 ?怎么办
保存成xml !
技术分享图片技术分享图片?然后就成了这玩意 ok对应关系也有了 python也能搞了

去写一下 整逻辑就是
先去拿 ttf文件 url 请求url 保存 然后转xml
然后 拿加密前的特殊字符

# 就是这玩意

技术分享图片

然后去切割 对应 OK完事
对应关系的代码
根据看到的 id : 0啥也不说
从1~15 就是这些东西
技术分享图片技术分享图片?
上代码

# 对应关系 

def kuaishou_un_font(soup, font_size):
	# soup 就是传的 ttf转码成xml的
    font_dict = {}
    for font_m in soup.glyphorder.children:
        if font_m != ‘\n‘ and ‘humans‘ not in font_m:
            id = font_m.get(‘id‘)
            name = font_m.get(‘name‘)
            if id != ‘0‘ and int(id) < 11:
                font_dict[name] = str(int(id)-1)
            elif id == ‘11‘:
                font_dict[name] = ‘.‘
            elif id == ‘12‘:
                font_dict[name] = ‘w‘
            elif id == ‘13‘:
                font_dict[name] = ‘k‘
            elif id == ‘14‘:
                font_dict[name] = ‘m‘
            elif id == ‘15‘:
                font_dict[name] = ‘+‘

    size_dict = {}
    for font_k in soup.cmap_format_4.children:
        if ‘map‘ in str(font_k):
            code = font_k.get(‘code‘)[-4:]
            name = font_k.get(‘name‘)
            size_dict[code] = name
    return font_dict[size_dict[font_size]]

技术分享图片

然后是拿TTF 文件然后转成xml

# TTF转XML
 font = TTFont(‘font_size.ttf‘)
  font.saveXML(‘font_size.xml‘)
技术分享图片

和split后list去一一解密

# font_url 自己去动态拿 每次都变动
font_url = ‘‘
font_res = requests.get(font_url)

  with open(‘font_size.ttf‘, ‘wb+‘) as f:
      f.write(font_res.content)

  font = TTFont(‘font_size.ttf‘)
  font.saveXML(‘font_size.xml‘)
  soup = BeautifulSoup(open(‘font_size.xml‘), ‘lxml‘)
  try:
      fan = user_data_json[‘obfuseData‘][‘fan‘][40:-8].split(‘;&#x‘)
      fans = ‘‘
      for f in fan:
          fans += kuaishou_un_font(soup, f)
  except:
      fans = ‘‘
技术分享图片

最后
技术分享图片技术分享图片?
OK~ 解码完成 全部代码没放 因为是根据需求写的 懒得改成大家都能用的了 主要是给个思路 思路有了就很简单 需要的找我

python快手爬虫:解决粉丝数、 关注数等字体加密

原文:https://www.cnblogs.com/41280a/p/13751716.html

(0)
(0)
   
举报
评论 一句话评论(0
关于我们 - 联系我们 - 留言反馈 - 联系我们:wmxa8@hotmail.com
© 2014 bubuko.com 版权所有
打开技术之扣,分享程序人生!