Java学习者论坛

 找回密码
 立即注册

QQ登录

只需一步,快速开始

手机号码,快捷登录

恭喜Java学习者论坛(https://www.javaxxz.com)已经为数万Java学习者服务超过8年了!积累会员资料超过10000G+
成为本站VIP会员,下载本站10000G+会员资源,购买链接:点击进入购买VIP会员
JAVA高级面试进阶视频教程Java架构师系统进阶VIP课程

分布式高可用全栈开发微服务教程

Go语言视频零基础入门到精通

Java架构师3期(课件+源码)

Java开发全终端实战租房项目视频教程

SpringBoot2.X入门到高级使用教程

大数据培训第六期全套视频教程

深度学习(CNN RNN GAN)算法原理

Java亿级流量电商系统视频教程

互联网架构师视频教程

年薪50万Spark2.0从入门到精通

年薪50万!人工智能学习路线教程

年薪50万!大数据从入门到精通学习路线年薪50万!机器学习入门到精通视频教程
仿小米商城类app和小程序视频教程深度学习数据分析基础到实战最新黑马javaEE2.1就业课程从 0到JVM实战高手教程 MySQL入门到精通教程
查看: 378|回复: 0

[默认分类] fake-useragent,python爬虫伪装请求头

[复制链接]
  • TA的每日心情
    开心
    2021-12-13 21:45
  • 签到天数: 15 天

    [LV.4]偶尔看看III

    发表于 2018-6-1 10:10:10 | 显示全部楼层 |阅读模式

    在编写爬虫进行网页数据的时候,大多数情况下,需要在请求是增加请求头,下面介绍一个python下非常好用的伪装请求头的库:fake-useragent,具体使用说明如下:

      安装fake-useragent库
      
    pip install fake-useragent

      获取各浏览器的fake-useragent
      
    1. [code]from fake_useragent import UserAgent
    2. ua = UserAgent()
    3. #ie浏览器的user agent
    4. print(ua.ie)
    5. #opera浏览器
    6. print(ua.opera)
    7. #chrome浏览器
    8. print(ua.chrome)
    9. #firefox浏览器
    10. print(ua.firefox)
    11. #safri浏览器
    12. print(ua.safari)
    13. #最常用的方式
    14. #写爬虫最实用的是可以随意变换headers,一定要有随机性。支持随机生成请求头
    15. print(ua.random)
    16. print(ua.random)
    17. print(ua.random)
    复制代码
    [/code]
    示例代码
    1. [code]from fake_useragent import UserAgent
    2. import requests
    3. ua=UserAgent()
    4. #请求的网址
    5. url="http://www.baidu.com"
    6. #请求头
    7. headers={"User-Agent":ua.random}
    8. #请求网址
    9. response=requests.get(url=url,headers=headers)
    10. #响应体内容
    11. print(response.text)
    12. #响应状态信息
    13. print(response.status_code)
    14. #响应头信息
    15. print(response.headers)
    复制代码
    [/code]

    回复

    使用道具 举报

    您需要登录后才可以回帖 登录 | 立即注册

    本版积分规则

    QQ|手机版|Java学习者论坛 ( 声明:本站资料整理自互联网,用于Java学习者交流学习使用,对资料版权不负任何法律责任,若有侵权请及时联系客服屏蔽删除 )

    GMT+8, 2024-4-26 12:33 , Processed in 0.353384 second(s), 46 queries .

    Powered by Discuz! X3.4

    © 2001-2017 Comsenz Inc.

    快速回复 返回顶部 返回列表