文章详情页
python - 爬取某网站时需要浏览器刷新一次才能返回真实的页面数据?
问题描述
请求所需参数全部带上了,并且已带上cookies,已修改header,拿到的数据是提示刷新的HTML,如图:原网页是动态加载的瀑布流,即往不断下拉就不断有内容呈现出来,静候大神,目前采用scrapy框架,暂时还不想上selenium+phantomjs,太重了
问题解答
回答1:动态加载的数据你应该找ajax api请求,而不是在网页找,工欲善其事必先利其器,善用 F12。
回答2:这种情况比抓取一个代理ip网页,使用cookie但是报错好解决多了==,你完全可以判断当前页面内容然后进行模拟刷新~ 重要的是保持会话。
如果还不行的话,可以加referer再试一试
相关文章:
1. nignx - docker内nginx 80端口被占用2. dockerfile - 我用docker build的时候出现下边问题 麻烦帮我看一下3. javascript - 正则表达式 答疑4. docker不显示端口映射呢?5. dockerfile - [docker build image失败- npm install]6. webstorm中的mongodb插件问题7. docker安装后出现Cannot connect to the Docker daemon.8. 电脑上装了wamp后,再装了mysql,wamp上的mysql就不能用了9. mysql - msql什么叫并发10. mysql增量恢复出错
排行榜