文章详情页

基于Python爬取fofa网页端数据过程解析

更多 QQ空间微信 QQ好友腾讯朋友复制链接

【字号：大中小】日期：2022-07-17 17:19:04浏览：4作者：猪猪

FOFA-网络空间安全搜索引擎是网络空间资产检索系统（FOFA）是世界上数据覆盖更完整的IT设备搜索引擎，拥有全球联网IT设备更全的DNA信息。探索全球互联网的资产信息，进行资产及漏洞影响范围分析、应用分布统计、应用流行度态势感知等。

安装环境：

pip install requestspip install lxmlpip install fire

使用命令：

python fofa.py -s=title='你的关键字' -o='结果输出文件' -c='你的cookie'

代码如下：

import requests,time,base64,firefrom lxml import etreedef fofasc(s,o,c): try: sbase64 = (base64.b64encode(s.encode(’utf-8’))).decode(’utf-8’) cookies = { '_fofapro_ars_session': c } headers = { ’User-Agent’: ’Mozilla/5.0 (Linux; Android 7.1.2; PCRT00 Build/N2G48H; wv) AppleWebKit/537.36 (KHTML, like Gecko) Version/4.0 Chrome/66.0.3359.158 Safari/537.36 fanwe_app_sdk sdk_type/android sdk_version_name/4.0.1 sdk_version/2020042901 screen_width/720 screen_height/1280’, } for i in range(1,1000): url = 'https://www.fofa.so/result?q='+s+'&qbase64='+sbase64+'&full=true&page='+str(i) r = requests.get(url, headers=headers, cookies=cookies) soup = etree.HTML(r.text) result = soup.xpath(’//*[@id='ajax_content']/div/div/div/a/text()’) print(result) if result != []:for rs in result: with open(o,mode='a+') as f: f.write(rs+'n') else:print('已经获取不到任何数据，爬取完毕！')break time.sleep(2) except KeyboardInterrupt: print(’用户退出’)if __name__ == ’__main__’: fire.Fire(fofasc)

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持好吧啦网。

Python 编程

上一条：python 安装移动复制第三方库操作下一条：python利用os模块编写文件复制功能——copy()函数用法

相关文章：

1. 三个不常见的 HTML5 实用新特性简介2. IE6/IE7/IE8/IE9中tbody的innerHTML不能赋值的完美解决方案3. Python unittest单元测试框架实现参数化4. SpringBoot+Shiro+Redis+Mybatis-plus 实战项目及问题小结5. Jsp中request的3个基础实践6. 如何用python 操作MongoDB数据库7. XML 轻松学习手册(比较不错)第1/3页8. 使用css实现全兼容tooltip提示框9. jsp实现textarea中的文字保存换行空格存到数据库的方法10. AJAX的跨域问题解决方案

排行榜

					
					Python unittest单元测试框架实现参数化
三个不常见的 HTML5 实用新特性简介
IE6/IE7/IE8/IE9中tbody的innerHTML不能赋值的完美解决方案
SpringBoot+Shiro+Redis+Mybatis-plus 实战项目及问题小结
Jsp中request的3个基础实践
如何用python 操作MongoDB数据库
使用css实现全兼容tooltip提示框
IDEA设置编码背景色的方法
JSP数据交互实现过程解析
XML 轻松学习手册(比较不错)第1/3页
JSP学习心得
				

热门标签