一次查询 1000+ 社交平台用户档案:Social Analyzer 实战
2026/9/5 18:51:03 网站建设 项目流程

一次查询 1000+ 社交平台用户档案:Social Analyzer 实战

【免费下载链接】social-analyzerAPI, CLI, and Web App for analyzing and finding a person's profile in 1000 social media \ websites项目地址: https://gitcode.com/GitHub_Trending/so/social-analyzer

当你需要确认某个用户名注册在哪些平台、或收集网络调查中的档案线索时,逐个打开网站检查并不可行。Social Analyzer 可批量检索 1000+ 社交媒体与网站的用户档案,每条结果附带 0-100 的可信度评分,并提供 Web、CLI、Python 三种使用形态。

项目概览

Social Analyzer 是一个 OSINT(开源情报)分析项目:它根据给定用户名匹配各站点已知的档案 URL 模式,判断对应档案是否存在,并对每个检测给出 0-100 的评分(No / Maybe / Yes),以减少误报。项目提供三种入口:Node.js 网页应用(默认端口 9005)、Node 命令行,以及可 pip 安装的 Python 包(也可直接运行 app.py 或以对象方式导入)。典型任务包括:批量初筛用户名、排查骚扰或营销账号、为关联账号收集元数据。检测逻辑按扫描策略分为几个模块,分别覆盖通用站点、动态站点和 Facebook、Gmail 等需要专属逻辑的平台。

从零跑通

  1. 安装系统依赖:深度扫描需要 Firefox,Debian/Ubuntu 下执行sudo apt-get install -y firefox-esr tesseract-ocr git nodejs npm即可。
  2. 克隆仓库并启动网页应用:
git clone https://gitcode.com/GitHub_Trending/so/social-analyzer cd social-analyzer npm install npm start

启动后浏览器打开http://localhost:9005/app.html,输入用户名、勾选扫描方式即可运行第一次检测。

  1. 习惯命令行可以用这条命令直接初筛:
nodejs app.js --username "johndoe,janedoe" --top 100 --filter good

多个用户名用逗号分隔;--top 100将范围限制在 Alexa 排名前 100 的站点,--filter good只输出高置信结果。

功能实战讲解

用快速扫描做全量初筛

快速扫描基于 HTTP 库(modules/fast-scan.js)向每个站点的档案 URL 发请求,根据页面标题和内容判定档案是否存在,速度最快,可覆盖全部站点。用例:nodejs app.js --username "johndoe"查看哪些站点返回高评分。适用时机:任何调查的第一步,先圈定范围再决定是否深入验证。

用深度扫描验证可疑结果

对动态渲染的页面,快速扫描容易误判。深度扫描通过 Selenium WebDriver 驱动 Firefox 完整加载页面后再判定,准确性最高,但速度明显更慢(modules/slow-scan.js)。用例:对初筛中评为 Maybe 的几个站点,在网页应用里勾选 FindUserProfilesSlow 复测。适用时机:快速扫描给出 Maybe、且该结果会影响结论时。

用特殊扫描查 Facebook 与 Gmail

部分平台无法用通用 URL 模式判定:Facebook 支持按手机号、姓名或 profile 名称查询,Gmail 和 Google 则直接按邮箱地址查询,这部分逻辑在 modules/special-scan.js 中。用例:线索是一个邮箱地址而非用户名时,在网页应用启用 FindUserProfilesSpecial。适用时机:已知目标邮箱或电话、不知道其用户名时。

提取元数据并生成账号关系图谱

对已检测的档案追加--metadata可提取公开元数据;提取完成后在网页应用启用 NetworkGraph,public/graph.html 会以力导向图展示元数据关联,用于观察多个账号之间的共性。用例:收集到多个疑似关联账号的档案后,用图谱确认它们是否属于同一批。适用时机:调查后段、需要呈现账号间关系时。

个性化与提效

  • 缩小范围--top 50(按 Alexa 排名前 50)、--websites "youtube tiktok"--countries "us uk"(空格分隔)、--type "adult"按类型筛选,四者按需取其一。
  • 控制粒度--filter "good,maybe"按置信度过滤,--method "find|get|all"在"仅检出/全部/两者结合"间切换。
  • 集成输出--output json输出结构化结果供其他脚本消费,--silent屏蔽屏幕输出。
  • 扩展平台列表:在 data/sites.json 中可按同样格式添加自定义站点的检测规则,重启后生效。
  • 推荐流程:fast-scan 初筛 → slow-scan 复核 → 元数据与图谱分析,三层模块各司其职。

常见问题

  • CLI 加--mode slow没有反应?Node CLI 目前只执行快速扫描,深度与特殊扫描请在网页应用中启用对应选项。
  • 全量扫描耗时太长?--top 50--websites先限定范围,配合--timeout调整请求间隔。
  • 误报太多?保持默认--filter good只输出高置信结果,--method find采用严格判定,剩余 Maybe 结果交给深度扫描复核。
  • 想确认支持哪些平台?运行nodejs app.js --list列出当前全部可用站点。

许可与合规

项目采用 AGPL-3.0 许可证。请仅用于本地合法研究场景,确保调查对象为自有账号或已获得授权,遵守目标平台服务条款,不用于对他人进行未授权监控或骚扰。

可以先用一个已知用户名跑通快速扫描,核对评分与真实档案是否一致,再逐步加上--top--filter等参数缩小范围。

【免费下载链接】social-analyzerAPI, CLI, and Web App for analyzing and finding a person's profile in 1000 social media \ websites项目地址: https://gitcode.com/GitHub_Trending/so/social-analyzer

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询