文章详情页
python - 为什么感觉 pyspider 爬取的速度好慢
浏览:68日期:2022-08-08 09:43:03
问题描述
为什么感觉 pyspider 爬取的速度好慢(比自己直接用 requests 和 bs慢多了),是不是因为有些网页会 retry,不过成功率倒是比自己爬取的高多了。是不是我的使用方法不对?求解释
问题解答
回答1:这里可以设置 web ui 控制台上的 rate/burst 参数来调节速度,rate 是 每秒抓取的数量,burst 是并发的数量,默认是 1/3 所以比较慢,还是对这个工具了解不够呀
回答2:我没有用过框架来写爬虫,但是我在自己写爬虫的时候,并发写起来,模型越复杂(如线程控制,线程状态监控),效率是越低的。
相关文章:
1. javascript - js 多维数组的问题2. javascript - 请指条明路,angular的$event,在select中却是undefined?3. android - app 协议页面的设计4. angular.js - angular2 有什么cool的loading组件么?5. javascript - 使用 vuex-router-sync寄存路由信息,this.$router params 不能赋值?6. javascript - vue组件中使用百度分享初次加载失败?7. 冒昧问一下,我这php代码哪里出错了???8. 使用C#如何导入导出Excel文件?9. 如何更新/删除指定的两条或多条数据10. mysql 一个sql 返回多个总数
排行榜
