您的位置:首页 > 新闻资讯 >文章内容
单线程没效率?多线程效果更佳,常用的几种线程池
来源:互联网 作者:admin 时间:2019-03-09 14:50:40

  其实单线程远不能满足我们的需求,毕竟单线程的能力有限,不管怎么抓取,让其慢慢积累都是需要时间的,而我们需要的就是抢时间,以更短的时间获得信息。但是单线程的效率太慢了,还不如使用多线程。


  多线程虽然能解决单线程解决不了的事情,但是它也会给你带来额外的问题。比如成千上万甚至上百万的线程时候,你系统就会出现响应延迟、卡机、甚至直接卡死的情况。为什么会出现这样的原因呢?


  这是因为为每个请求创建一个新线程的开销很大:在创建和销毁线程上花费的时间和消耗的系统资源要比花在处理实际的用户请求的时间和资源更多。


单线程没效率?多线程效果更佳,常用的几种线程池


  除了创建和销毁线程的开销之外,活动的线程也消耗系统资源。机灵代理工程师表示,在一个JVM里创建太多的线程可能会导致系统由于过度消耗内存而用完内存或“切换过度”。所以为了防止资源不足,服务器应用程序需要一些办法来限制任何给定时刻处理的请求数目。而线程池为线程生命周期开销问题和资源不足问题提供了解决方案。常用的几种线程池:


  1.ScheduledThreadPool


  周期线程池,创建一个定长线程池,支持定时及周期性任务执行,通过过schedule方法可以设置任务的周期执行。


  2.newFixedThreadPool


  定长线程池,一个有指定的线程数的线程池,有核心的线程,里面有固定的线程数量,响应的速度快。正规的并发线程,多用于服务器。固定的线程数由系统资源设置。核心线程是没有超时机制的,队列大小没有限制,除非线程池关闭了核心线程才会被回收。


  3.newSingleThreadExecutor


  单任务线程池,创建一个单线程化的线程池,它只会用唯一的工作线程来执行任务,保证所有任务按照指定顺序(FIFO, LIFO, 优先级)执行,每次任务到来后都会进入阻塞队列,然后按指定顺序执行。


  4.newCachedThreadPool


  可缓冲线程池,只有非核心线程,最大线程数很大,每新来一个任务,当没有空余线程的时候就会重新创建一个线程,这边有一个超时机制,当空闲的线程超过60s内没有用到的话,就会被回收,它可以一定程序减少频繁创建/销毁线程,减少系统开销,适用于执行时间短并且数量多的任务场景。


  不同的线程池,是有效果的差别的,对于线程池的使用,若是需要抓取大量的数据,单个线程无法满足需求,那么使用多线程是必然的选择,而使用线程池能够起到优化的效果,让爬虫爬取变得更加的简单,配合代理IP使用,效果更佳。


相关文章内容简介
推荐阅读
  • 05 2020-02
    代理IP带来了很大的便利

    代理IP是通过第三方网络协议传输的加密软件,其实跟IP加速器的原理差不多,是一种特殊的网络服务,允许客户端通过这个服务器和服务器进行非直接的连接。

  • 24 2019-04
    找爬虫代理要关注IP数量、高并发、多终端

    找爬虫代理要关注IP数量、高并发、多终端,这三个方面,为什么呢?其实很多人购买爬虫代理时,都会把IP可用率作为购买第一参考因素。其实市面上的的IP资源基本都是租用代理拨号服务器,

  • 14 2019-03
    对于爬虫来说,代理IP是否能用是非常重要的

    对于爬虫来说,代理IP是否能用,这是非常重要的。有没有什么方法可以检测这些代理IP是否能用呢?有的,比如直接用浏览器访问自己的服务器来测试,同时也可以从服务器端下手,毕竟代理IP

  • 19 2019-03
    反反爬虫如何使用代理ip?

    反反爬虫为了应对网站的反爬虫,要浑身解数,找到漏洞,还要找到突破的方法,小编今天介绍个非常好用的工具,就是代理IP了。

  • 17 2020-01
    http代理如何选择

    国家经济日渐发展,人民生活水平逐渐提升,网络技术的逐渐提高和普及,促进了http代理业务的迅速发展。那么,在这个选择众多,真假难辨的社会里,选择一个优秀的http代理软件的重要性自

  • 15 2019-02
    java爬虫的HttpClient请求

    我们在获取网络资源的过程中,或许会一些限制,所以许多Java程序要使用HTTP协议来获取网络资源,今天我们来了解下java爬虫的HttpClient请求:

在线咨询
大客户经理
大客户经理
1829380381
13316264505

大客户经理微信

微信公众号

微信公众号

回到顶部