200字范文,内容丰富有趣,生活中的好帮手!
200字范文 > 爬虫伪装请求头-fake-useragent

爬虫伪装请求头-fake-useragent

时间:2021-04-20 02:49:28

相关推荐

爬虫伪装请求头-fake-useragent

前几天意外找到一个简单实用的库- fake-useragent,可以伪装生成headers请求头中的User Agent值。

fake-useragent官网主页/hellysmile/fake-useragent

安装

pip3 install fake-useragent

各浏览器的user-agent值

from fake_useragent import UserAgentua = UserAgent()#ie浏览器的user agentprint(ua.ie)

Mozilla/5.0 (Windows; U; MSIE 9.0; Windows NT 9.0; en-US)

#opera浏览器print(ua.opera)

Opera/9.80 (X11; Linux i686; U; ru) Presto/2.8.131 Version/11.11

#chrome浏览器print(ua.chrome)

Mozilla/5.0 (Windows NT 6.1) AppleWebKit/537.2 (KHTML, like Gecko) Chrome/22.0.1216.0 Safari/537.2

#firefox浏览器print(ua.firefox)

Mozilla/5.0 (Windows NT 6.2; Win64; x64; rv:16.0.1) Gecko/1011 Firefox/16.0.1

#safri浏览器print(ua.safari)

Mozilla/5.0 (iPad; CPU OS 6_0 like Mac OS X) AppleWebKit/536.26 (KHTML, like Gecko) Version/6.0 Mobile/10A5355d Safari/8536.25

最实用的

但我认为写爬虫最实用的是可以随意变换headers,一定要有随机性。在这里我写了三个随机生成user agent,三次打印都不一样,随机性很强,十分方便。

from fake_useragent import UserAgentua = UserAgent()print(ua.random)print(ua.random)print(ua.random)

Mozilla/5.0 (X11; Ubuntu; Linux i686; rv:15.0) Gecko/0101 Firefox/15.0.1Mozilla/5.0 (Windows NT 6.2; Win64; x64; rv:16.0.1) Gecko/1011 Firefox/16.0.1Opera/9.80 (X11; Linux i686; U; ru) Presto/2.8.131 Version/11.11

爬虫中具体使用方法

import requestsfrom fake_useragent import UserAgentua = UserAgent()headers = {'User-Agent': ua.random}url = '待爬网页的url'resp = requests.get(url, headers=headers)#省略具体爬虫的解析代码,大家可以回去试试...

本内容不代表本网观点和政治立场,如有侵犯你的权益请联系我们处理。
网友评论
网友评论仅供其表达个人看法,并不表明网站立场。