📌 项目地址soxoj/maigret | ⭐ 29,289 颗星 | 🔧 Python | 📜 未标注

这个工具做的事很直接

项目地址:soxoj/maigret,Python,29,289 star。

输入一个用户名,它去 3000 多个网站上查有没有同名账号,从匹配到的页面里提取所有能拿到的信息,包括这个账号主页上指向其他平台的链接。不需要任何 API key。

名字来自西默农小说里的梅格雷探长。

pip install maigret
maigret YOUR_USERNAME

两行命令出结果,要求 Python 3.10 以上。不想装的话,README 给了两条零安装路径:社区 Telegram bot,或者 Cloud Shell。想要图形界面,项目自带 web UI,结果以关系图展示,所有格式的报告都能在同一个页面下载。

第一步:搜自己

我建议每个新用户第一次都跑自己常用的用户名。你会发现一些忘了的账号还挂在某个网站上,也会开始理解什么样的匹配可靠、什么样的需要怀疑。这是后面判断别人数据的基础。

默认 500,全量 3000,怎么选

默认运行只扫流量排名前 500 的站点。控制范围有两个参数:

  • -a:扫全部 3000+ 站点
  • --tags:按分类或国家过滤

慎用 -a。全量耗时数倍,多出来的匹配大多是小站上的低价值结果。--tags 反而更实用——定向扫某一类网站,速度快,噪声少。

状态码不等于事实

报告要逐条点开看。两种常见坑:

  1. 有些平台对不存在的用户名也返回正常页面,这是防用户名枚举的手段,机器会误报
  2. 注销账号的残留页面,头像还在,内容没了

提取出的链接也要人工核。有些解析结果是相对路径,离开原站点就还原不出完整 URL。机器输出当草稿,归档前自己确认。

真正的杀手锏是递归

单点匹配不算什么,Maigret 能从匹配页面里解析出其他用户名和 ID,拿新线索再跑一轮。对换过网名的人,这个功能尤其有效——旧账号主页里指向其他平台的链接,可能就是新旧身份之间的桥。几轮下来,十几个网站上的账号能串成一条线。

信息提取基于同一作者的另一个项目 socid_extractor,数据来源是个人主页和站点 API。

几个工程细节

  • 站点数据库每次运行自动从 GitHub 拉取更新,24 小时内只拉一次;断网时回退到内置版本
  • 能检测并部分绕过封锁、审查和验证码
  • 支持 Tor 和 I2P 网站,也能检查域名
  • import maigret 可以作为库嵌进自己的 Python 项目

README 提到 AI profiling,标注是 demo。参考可以,别当结论。

边界

Maigret 只收集公开数据,不绕过隐私设置。但“公开”的范围比多数人以为的大——你十年前随手注册的账号也是公开数据,而且现在能被一条命令批量翻出来。

最后一句:同名不等于同人。工具给线索,判断靠人。

这篇文章对你有帮助吗?

发表回复