文章总结: 本文系统梳理Web安全测试信息收集全链路技术,涵盖操作系统识别、IP资产收集、端口扫描策略、Web架构指纹识别、源码泄漏利用、JS前端敏感信息提取及CDN绕过手法。详细介绍了各类工具如Nmap、Masscan、Wappalyzer、GitHack、JSFinder等的使用场景,并提供了从基础探测到进阶绕过的完整技术路径,强调多渠道验证与合法授权原则。 综合评分: 88 文章分类: WEB安全,渗透测试,代码审计,安全工具,实战经验
第21天-Web安全攻防:信息收集全链路技术指南
原创
萧瑶 萧瑶
AlphaNet
2026年2月10日 13:40 江苏
引言
在Web安全测试中,信息收集是决定后续测试深度与广度的关键第一步。全面且精准的信息收集能帮助安全人员快速定位攻击面,发现潜在漏洞。本文将系统梳理从基础信息收集到进阶技术研判的全链路方法,涵盖操作系统识别、资产发现、架构分析、源码泄漏、JS前端分析及CDN绕过等核心环节。
一、基础信息收集
1.1 操作系统识别
· Web大小写敏感测试:Linux系统通常区分大小写,Windows则不区分。
· 端口服务特征:特定服务常与固定端口绑定(如22/SSH、3389/RDP)。
· TTL值判断:通过响应包的TTL初始值初步判断操作系统(Linux≈64,Windows≈128)。
1.2 IP资产收集
· 归属地查询:判断服务器地理位置。
· 云厂商识别:确认是否部署在阿里云、腾讯云等平台。
· IP反查:通过IP反查域名、备案机构,扩展资产范围。
· C段扫描:针对同一IP段的资产进行探测,常能发现关联业务系统。
1.3 端口扫描策略
· 网络空间引擎:Fofa、Hunter、Quake等平台可查询历史扫描数据,快速发现资产。
· 在线扫描工具:适用于快速排查,但可能存在速率限制。
· 本地化工具:
· Nmap:准确性高,速度较慢。
· Masscan:速度快,适合大范围探测,可能存在误报。
· Fscan / KScan:内网渗透常用,集成多种识别功能。
· 注意事项:需考虑防火墙策略、内网环境及协议选择的影响。
二、Web架构分析与指纹识别
2.1 架构组成识别
· 开源CMS:如Discuz、WordPress。
· 前端框架:Vue、React、Bootstrap等。
· 后端语言:PHP、Java、Python、Go等。
· 中间件:Tomcat、Nginx、IIS、Weblogic。
· 数据库:MySQL、Redis、MongoDB等。
· 安全设备:WAF、蜜罐、CDN等。
2.2 指纹识别平台与工具
· 在线平台:云悉、TideFinger、数字观星等。
· 开源项目:
· Wappalyzer(浏览器插件)
· EHole、ObserverWard(集成化识别工具)
· CMSeeK(CMS专项识别)
· 图标识别:利用 favicon.ico 的MD5值进行匹配。
2.3 WAF与蜜罐识别
· WAF识别:通过响应头、拦截页面特征判断(如宝塔、创宇盾)。
· 工具:identYwaf、Wafw00f
· 蜜罐识别:
· 工具:Heimdallr、Quake蜜罐检测
· 人工特征:非常规开放端口、交互行为异常、设备指纹特殊等。
三、源码泄漏与获取方法
3.1 泄漏原因与常见类型
· 开发配置不当:.git、.svn、DS_Store 等目录或文件暴露。
· 备份文件残留:.zip、.tar、.bak 等压缩备份。
· 版本控制信息:Git/SVN 未隐藏,可通过工具还原。
· 打包文件泄漏:Webpack 打包后映射文件(.map)暴露源码。
3.2 源码获取途径
-
已知指纹匹配:通过识别CMS或框架,直接下载对应源码。
-
泄漏利用工具:
· GitHack:恢复 .git 泄漏项目
· SvnHack:提取 .svn 目录文件
· ds_store_exp:解析 .DS_Store 获取文件列表
-
WebPack打包还原:利用 .map 文件还原前端源码。
-
Github监控与搜索:
· 使用 in:name、in:readme、language: 等语法精准搜索。
· 结合 site:Github.com + 关键词 在谷歌中检索敏感信息。
- 第三方源码平台:如虎嗅、果核等站点可能存在目标系统源码。
四、JS前端分析与信息提取
4.1 为何关注JS文件?
· 相当于白盒测试:前端代码可见,易泄露接口、逻辑、配置。
· 敏感信息常见位置:API密钥、后端地址、加密算法、隐藏接口。
4.2 信息提取类型
· 接口URL:Ajax请求路径、API端点。
· 子域名/后端地址:常硬编码在JS中。
· 配置信息:数据库连接、第三方服务密钥。
· 代码逻辑:身份验证、参数加密方式。
4.3 工具推荐
· URL提取:JSFinder、URLFinder、LinkFinder
· 敏感信息标记:HaE(Burp插件)、FindSomething(浏览器插件)
· 自动化测试:Packer-Fuzzer(针对Webpack)、jjjjjjjjjjjjjs(接口Fuzz)
· 流量辅助:BurpAPIFinder(自动发现未授权接口)
五、CDN识别与绕过手法
5.1 CDN识别方法
· 多地Ping测试:使用 17ce、Chinaz 等超级Ping,若返回多个IP很可能使用CDN。
· DNS历史记录查询:查看使用CDN前的解析记录。
· 证书与子域名查询:CDN可能只覆盖主域名,子域名或暴露真实IP。
5.2 常见绕过思路
-
查询历史DNS:通过DNSDB、ViewDNS 等查找历史A记录。
-
子域名探测:很多CDN只加速 www 或主域,其他子域可能直连真实服务器。
-
邮件服务器追踪:
· 注册/找回密码等流程,系统发送的邮件头可能包含真实IP。
· RSS订阅、通知邮件也是重要来源。
- 漏洞利用:
· SSRF:让服务器主动向外发起连接,从而暴露IP。
· 文件读取:如 phpinfo 页面可能泄漏内网IP或主机信息。
- 全网扫描+特征匹配:
· 通过 Favicon 哈希、特定标题、端口组合在 Shodan/Fofa 中搜索。
· 利用 Zmap、Masscan 对CDN厂商IP段扫描,匹配业务特征。
- 国外节点请求:部分CDN未覆盖海外节点,通过国外代理或VPS访问可能获取真实IP。
5.3 实用资源
· CDN识别:cdn.chinaz.com、tools.ipip.net/cdn.php
· 全网扫描工具:fuckcdn、w8fuckcdn、Bypass_cdn
· IP信息库:纯真IP库(cz88.net)
结语
信息收集绝非简单“扫描一下”,而是需要结合被动查询、主动探测、逻辑推理的综合过程。从一枚域名开始,到完整绘制出目标网络架构、业务逻辑、潜在脆弱点,每一步都考验着安全人员的技术细腻度与思维发散能力。
牢记原则:多渠道验证、避免单一依赖;持续跟踪更新、注意信息时效;合法授权前提下开展测试。
免责声明:
本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。
任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。
本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。
本文转载自:AlphaNet 萧瑶 萧瑶《第21天-Web安全攻防:信息收集全链路技术指南》
版权声明
本站仅做备份收录,仅供研究与教学参考之用。
读者将信息用于其他用途的,全部法律及连带责任由读者自行承担,本站不承担任何责任。








评论