文章详情页
python - 为什么感觉 pyspider 爬取的速度好慢
问题描述
为什么感觉 pyspider 爬取的速度好慢(比自己直接用 requests 和 bs慢多了),是不是因为有些网页会 retry,不过成功率倒是比自己爬取的高多了。是不是我的使用方法不对?求解释
问题解答
回答1:这里可以设置 web ui 控制台上的 rate/burst 参数来调节速度,rate 是 每秒抓取的数量,burst 是并发的数量,默认是 1/3 所以比较慢,还是对这个工具了解不够呀
回答2:我没有用过框架来写爬虫,但是我在自己写爬虫的时候,并发写起来,模型越复杂(如线程控制,线程状态监控),效率是越低的。
相关文章:
1. 如何解决docker宿主机无法访问容器中的服务?2. vue.js - weex scroller搭配refresh在android平台上拉会触发refresh3. javascript - h5上的手机号默认没有识别4. javascript - 在html中写了个<video>视频,浏览器却是一片空白为什么呢?360浏览器?5. angular.js - ionic 弹窗样式6. 【加急】请问webarchive格式转换html怎么做7. css - div display: inline-block; 置中?8. css3 - Firefox 字号相对IE、Chrome更大,如何在CSS中统一?9. javascript - ajax中的 textStatus 报错为 parsererror?10. 如何解决Centos下Docker服务启动无响应,且输入docker命令无响应?
排行榜