首页 > 其他 > 详细

fake-useragent库:值得花2分钟学习的库

时间:2021-01-05 10:47:41      阅读:28      评论:0      收藏:0      [点我收藏+]
前几天意外找到一个简单实用的库- fake-useragent,可以伪装生成headers请求头中的User Agent值。再也不用,重复做复制粘贴这种很Low的工作了。

安装

pip3 install fake-useragent

各浏览器的user-agent值


from fake_useragent import UserAgent

ua = UserAgent()

#ie浏览器的user agent

print(ua.ie)

Mozilla/5.0 (Windows; U; MSIE 9.0; Windows NT 9.0; en-US)

#opera浏览器

print(ua.opera)

Opera/9.80 (X11; Linux i686; U; ru) Presto/2.8.131 Version/11.11

#chrome浏览器

print(ua.chrome)

Mozilla/5.0 (Windows NT 6.1) AppleWebKit/537.2 (KHTML, like Gecko) Chrome/22.0.1216.0 Safari/537.2

#firefox浏览器

print(ua.firefox)

Mozilla/5.0 (Windows NT 6.2; Win64; x64; rv:16.0.1) Gecko/20121011 Firefox/16.0.1

#safri浏览器

print(ua.safari)

Mozilla/5.0 (iPad; CPU OS 6_0 like Mac OS X) AppleWebKit/536.26 (KHTML, like Gecko) Version/6.0 Mobile/10A5355d Safari/8536.25

最实用的
但我认为写爬虫最实用的是可以随意变换headers,一定要有随机性。在这里我写了三个随机生成user agent,三次打印都不一样,随机性很强,十分方便。大邓觉得这个库,只会这random方法就可以了。


from fake_useragent import UserAgent

ua = UserAgent()

print(ua.random)

print(ua.random)

print(ua.random)

Mozilla/5.0 (compatible; MSIE 10.0; Macintosh; Intel Mac OS X 10_7_3; Trident/6.0)

Mozilla/5.0 (Windows NT 6.1) AppleWebKit/537.2 (KHTML, like Gecko) Chrome/22.0.1216.0 Safari/537.2

Opera/9.80 (X11; Linux i686; U; ru) Presto/2.8.131 Version/11.11

爬虫中具体使用方法


import requests

from fake_useragent import UserAgent

ua = UserAgent()

headers = {‘User-Agent‘: ua.random}

url = ‘待爬网页的url‘

resp = requests.get(url, headers=headers)

#省略具体爬虫的解析代码,大家可以回去试试

...

fake-useragent库:值得花2分钟学习的库

原文:https://blog.51cto.com/15069487/2581972

(0)
(0)
   
举报
评论 一句话评论(0
关于我们 - 联系我们 - 留言反馈 - 联系我们:wmxa8@hotmail.com
© 2014 bubuko.com 版权所有
打开技术之扣,分享程序人生!