当前位置:   article > 正文

爬虫伪装请求头-fake-useragent_伪头部请求 400

伪头部请求 400

前几天意外找到一个简单实用的库- fake-useragent,可以伪装生成headers请求头中的User Agent值。
fake-useragent官网主页https://github.com/hellysmile/fake-useragent

安装

pip3 install fake-useragent
  • 1

各浏览器的user-agent值

from fake_useragent import UserAgent
ua = UserAgent()
#ie浏览器的user agent
print(ua.ie)
  • 1
  • 2
  • 3
  • 4
Mozilla/5.0 (Windows; U; MSIE 9.0; Windows NT 9.0; en-US)
  • 1
#opera浏览器
print(ua.opera)
  • 1
  • 2
Opera/9.80 (X11; Linux i686; U; ru) Presto/2.8.131 Version/11.11
  • 1
#chrome浏览器
print(ua.chrome)
  • 1
  • 2
Mozilla/5.0 (Windows NT 6.1) AppleWebKit/537.2 (KHTML, like Gecko) Chrome/22.0.1216.0 Safari/537.2
  • 1
#firefox浏览器
print(ua.firefox)
  • 1
  • 2
Mozilla/5.0 (Windows NT 6.2; Win64; x64; rv:16.0.1) Gecko/20121011 Firefox/16.0.1
  • 1
#safri浏览器
print(ua.safari)
  • 1
  • 2
Mozilla/5.0 (iPad; CPU OS 6_0 like Mac OS X) AppleWebKit/536.26 (KHTML, like Gecko) Version/6.0 Mobile/10A5355d Safari/8536.25
  • 1

最实用的

但我认为写爬虫最实用的是可以随意变换headers,一定要有随机性。在这里我写了三个随机生成user agent,三次打印都不一样,随机性很强,十分方便。

from fake_useragent import UserAgent
ua = UserAgent()
print(ua.random)
print(ua.random)
print(ua.random)
  • 1
  • 2
  • 3
  • 4
  • 5
Mozilla/5.0 (X11; Ubuntu; Linux i686; rv:15.0) Gecko/20100101 Firefox/15.0.1
Mozilla/5.0 (Windows NT 6.2; Win64; x64; rv:16.0.1) Gecko/20121011 Firefox/16.0.1
Opera/9.80 (X11; Linux i686; U; ru) Presto/2.8.131 Version/11.11

  • 1
  • 2
  • 3
  • 4

爬虫中具体使用方法

import requests
from fake_useragent import UserAgent
ua = UserAgent()
headers = {'User-Agent': ua.random}
url = '待爬网页的url'
resp = requests.get(url, headers=headers)
#省略具体爬虫的解析代码,大家可以回去试试
...
  • 1
  • 2
  • 3
  • 4
  • 5
  • 6
  • 7
  • 8

在这里插入图片描述

声明:本文内容由网友自发贡献,不代表【wpsshop博客】立场,版权归原作者所有,本站不承担相应法律责任。如您发现有侵权的内容,请联系我们。转载请注明出处:https://www.wpsshop.cn/w/盐析白兔/article/detail/716225
推荐阅读
相关标签
  

闽ICP备14008679号