注意: IP代理精灵仅提供国内ip网络节点,不提供境外网络节点,不能用于任何非法用途或访问境外封闭网站,不能跨境联网,只能用于合法的国内网络加速。

请登录 注册 实名验证

首页 > 新闻资讯 > selenium+python设置爬虫代理IP的方法

selenium+python设置爬虫代理IP的方法

来源:IP代理精灵 作者:admin 时间:2019-04-26 14:40:32

这篇文章主要介绍了selenium+python设置爬虫代理IP的方法,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧!

selenium+python设置爬虫代理IP的方法

1. 设置背景


在使用selenium浏览器渲染技术,当我们爬取某个网站的信息的时候,在一般情况下速度都不是特别的快。而且需要利用selenium浏览器渲染技术爬取的网站,反爬虫的应对技术都比较厉害,对IP访问频率有很高程度的限制。所以,如果想提升selenium抓取数据的速度,可以从两个方面出发:


第一方面, 抓取频率要提高,破解出现的验证信息,一般都是验证码或者是用户登陆 。


第二方面,使用多线程 + 代理IP, 这种方式,需要电脑有足够的内存和充足稳定的代理IP。


2. 为chrome设置代理IP


注意事项:


第一,选择稳定的固定的代理IP。不要选择动态代理IP。我们常用的爬虫IP代理通常都是具有高度保密性质的高匿名动态IP,是通过拨号动态产生的,时效性非常的短,一般都是在3分钟左右。对于scrapy这种并发度很高,又不需要登录的爬虫来说,非常合适,但是在浏览器渲染类爬虫中并不适用。


第二,选择速度较快的代理IP。因为selenium爬虫采用的是浏览器渲染技术,这种浏览器渲染技术速度就本身就很慢。如果选择的代理IP速度较慢,爬取的时间就会进一步增加。


第三,要有足够大的电脑内存。因为chrome占内存较大,在并发度很高的情况下,容易造成浏览器崩溃,也就是程序崩溃。


第四,在程序结束时,调用 browser.quit( ) 清除浏览器缓存。


最新资讯

推荐阅读

  1. 24

    2019-06

    什么是代理IP?代理IP有什么功能特点?

    作为一个互联网工作者,在工作中难免碰到一些这样的问题:如果你是一名淘宝店主,你可能会担心刷单太多被发现惨遭封店;如果你是一名网络推广员,你可能会担心发帖太多导致IP地址被屏

  2. 29

    2019-01

    如何查询IP地址?自己的IP地址怎么隐藏呢?

    IP地址是上网所必须的,若无IP地址,是无法进行上网活动的。我们在使用IP地址上网的过程中,稍不注意,别人就查到你的IP地址了,若是被查到IP地址,可能对我们本身有影响,这是如何查询IP

  3. 18

    2019-05

    挂机使用什么换IP软件好

    相信接触过网游的人都知道,游戏挂机。不论是怎么挂机,都是需要开着游戏,或者是多开许多账号。如果我想长时间挂机使用什么换IP软件好?ip代理精灵可以使用动态IP也可以使用静态IP支持

  4. 18

    2019-04

    换ip的作用是什么

    对于电脑来说,每台电脑都有一个唯一的IP地址,这个地址的作用就是用来确定这台电脑的位置。用ADSL等方式拨号上网的时候,每一次拨号获得的IP地址都是随即分配的,所谓换IP,就是断网重

  5. 09

    2019-10

    短效IP的应用场景

    短效IP的应用场景。代理ip中最常用的莫过于短效代理ip,短效又分普通短效ip和优质短效代理ip,普遍用的较多的基本是上是优质代理ip,像精灵HTTP代理(www.ipjldl.com)优质短效代理ip质量就非常适

  6. 13

    2019-06

    什么原因会导致代理IP速度慢

    代理IP是现代社会中很多人经常使用的上网方式,特别是对于一些专业的网络营销人员来说,代理IP资源是他们工作必不可少的工具之一。在选择使用代理IP时,除了IP稳定性和安全性以外,IP速