文章详情页
python - scrapy 再次请求的问题
浏览:243日期:2022-08-17 18:54:48
问题描述
如:item[’url’]=response.xpath(’a/@href’)分析出一个链接,然后想从这个链接里的网页再获取一些元素,放入item[’other’]。应该怎么写,谢谢。
问题解答
回答1:def parse_page1(self, response): for url in urls:item = MyItem()item[’url’] = urlrequest = scrapy.Request(url,callback=self.parse_page2)# request = scrapy.Request('http://www.example.com/some_page.html',dont_filter=True,callback=self.parse_page2)request.meta[’item’] = itemyield requestdef parse_page2(self, response): item = response.meta[’item’] item[’other’] = response.xpath(’/other’) yield item
最后附上官方文档https://doc.scrapy.org/en/lat...中文翻译版http://scrapy-chs.readthedocs...
相关文章:
1. node.js - npm run dev报错2. javascript - 如何将一个长为365的数组对象按月份切割成12组?3. css3 - 扩展本地项目中阿里的iconfont字体库,添加图标字体4. 无法为JSP编译类:无法解析类型java.util.Map $ Entry。从所需的.class文件间接引用它5. PC 手机兼容的 编辑器6. html - angularJS中switch切换开关按钮不能操作7. mysql - 仅仅只是把单引号与反斜杠转义不用prepare statement能否避免sql注入?8. 求救一下,用新版的phpstudy,数据库过段时间会消失是什么情况?9. node.js - npm安装模块时,在cmd上显示的是一条白线,白线前面是一天反斜线转圈圈,然后就出现npm ERR错误了,求帮助,谢谢10. css3不包括
排行榜

网公网安备