文章详情页
如何提高python查询速度?
浏览:79日期:2022-06-29 18:39:57
问题描述
最近在爬股票的相关新闻,一开始设想的是,当有新的新闻动态发布,程序通过邮件发送最新内容到邮箱。
所以我想把新闻标题,内容存到数据库里,当内容更新时,把新的内容和数据库的标题列表对比,看是不是已存在的,如果已存在,那就不发送,如果没有,那发送到邮箱。
但数量大了以后,列表查询速度就会变慢,请问各位还有什么方法可以传授下吗?
问题解答
回答1:爬虫任务去重
抓过的链接存到一个set中,检查新链接是否在集合中即可。
回答2:去重有很多方法,比如楼上的set或者布隆过滤器都可以有效的使用内存,提升效率
相关文章:
1. index.php错误,求指点2. html5 - 用h5本地存储是否安全?3. c++ - pycharm 4.5 的 python -> preferences 找不到4. 关于mysql unique的问题,如图所示5. mysql怎么保存一件游戏装备,一般游戏开发是否用mysql6. javascript - 可以DIY的页面是如何实现的?7. showpassword里的this 是什么意思?代表哪个元素8. javascript - ajax请求不返回,关闭页面时才返回。。。9. html5 - ajax post请求后如何渲染到页面上10. javascript - 使用 vuex-router-sync寄存路由信息,this.$router params 不能赋值?
排行榜