scrapy 2.3 增加Twisted IO线程池的最大大小
目前scrapy使用线程池以阻塞方式进行DNS解析。如果并发性级别更高,则爬行速度可能会变慢,甚至无法达到DNS解析程序超时。增加处理DNS查询的线程数的可能解决方案。将更快地处理DNS队列,从而加快建立连接和整体爬行。
要增加最大线程池大小,请使用:
REACTOR_THREADPOOL_MAXSIZE = 20
目前scrapy使用线程池以阻塞方式进行DNS解析。如果并发性级别更高,则爬行速度可能会变慢,甚至无法达到DNS解析程序超时。增加处理DNS查询的线程数的可能解决方案。将更快地处理DNS队列,从而加快建立连接和整体爬行。
要增加最大线程池大小,请使用:
REACTOR_THREADPOOL_MAXSIZE = 20