Google Hacking:搜索引擎语法的信息收集技巧
前言
Google Hacking 指用搜索引擎的高级语法发现互联网上意外暴露的敏感信息——登录页、密码表格、备份文件、目录列表。对渗透测试者它是信息收集的第一步;对运维和开发,它的价值在于自查:用同样的语法搜自己域名,看看有没有不该暴露的东西。
一、常用操作符
| 操作符 | 作用 | 示例 |
|---|---|---|
site: |
限定站点 | site:example.com admin |
filetype: / ext: |
限定文件类型 | filetype:xls 密码 |
intitle: |
标题包含关键词 | intitle:"index of" |
inurl: |
URL 包含关键词 | inurl:admin login |
allinurl: |
URL 包含全部关键词 | allinurl:auth_user_file.txt |
intext: |
正文包含关键词 | intext:"password" |
"" |
精确短语 | "Login:" "password=" |
- |
排除 | filetype:xls -site:example.com |
二、典型用法
搜暴露的账号密码文件:
|
|
搜服务器上的敏感文件:
|
|
搜暴露的登录入口:
|
|
三、用法背后的思路
三条主线:文件类型(filetype 定向找 xls/txt/log)、目录列表(intitle:“index of” 找配错索引的目录)、特征字符串(报错信息、软件默认页面、导出文件头)。实际组合时把目标域名、公司名、系统特征词与这三类操作符交叉,命中率远高于裸搜。
四、自查建议
拿这些语法搜自己的域名(site:yourcompany.com + 上述特征),重点排查:
- 有没有可被搜索引擎索引的备份文件、导出的 xls、日志文件
- 测试环境/管理后台是否暴露在公网且可被索引
- Web 服务器是否开启了目录列表(Directory Index)
- 敏感目录加认证 +
robots.txt并不够——真正有效的是不要把敏感文件放在 Web 根目录,必要时加X-Robots-Tag响应头
搜索引擎只是「收录了已经暴露的东西」——Google Hacking 挖出的每个结果,本质都是一个低级但真实的配置失误。
总结
语法本身不难,难在组合的想象力。渗透前用十几分钟做一轮 Google Hacking,经常比扫端口更快拿到入口;反过来,定期用同样的语法自查自家域名,是最便宜的安全巡检。
- 原文作者:Anttu
- 原文链接:https://anTtutu.github.io/post/2021-12-19-google-hack-syntax/
- 版权声明:本作品采用知识共享署名-非商业性使用-禁止演绎 4.0 国际许可协议进行许可,非商业转载请注明出处(作者,原文链接),商业转载请联系作者获得授权。