G

GH05TCREW

web-scrapingsecurity-and-iamother

362 查看 · 2026-07-07 更新

Waybackurls MCP

Waybackurls MCP 是一个桥梁,它将用于从 Wayback Machine 检索历史 URL 的工具 Waybackurls 与 Model Context Protocol (MCP) 生态系统连接起来。

概述

Waybackurls MCP 使无缝集成 Waybackurls 发现历史端点的能力成为可能,适用于兼容 MCP 的应用程序和基于 AI 的工作流系统。这个桥梁允许您利用 Internet Archive 的 Wayback Machine 来通过标准化协议找到被遗忘的 API 路径、旧端点以及潜在易受攻击的 URL,从而更容易地将其纳入自动化安全测试管道或 AI 助手功能中。

特性

  • 与 Waybackurls 集成,从 Wayback Machine 获取历史 URL
  • 可选择在搜索中包含或排除子域名
  • 简单的配置和设置
  • 易于与其他兼容 MCP 的工具和系统集成
  • 标准化的输入/输出处理

安装

前提条件

  • Node.js (v16 或更高版本)
  • 在您的系统上安装了 Waybackurls

安装

bash

全局安装

npm install -g gc-waybackurls-mcp

或者直接运行而不安装

npx gc-waybackurls-mcp

配置

此服务器需要通过 WAYBACKURLS_PATH 环境变量设置 Waybackurls 可执行文件的路径。

示例: bash

Linux/macOS

export WAYBACKURLS_PATH=/usr/local/bin/waybackurls

Windows

set WAYBACKURLS_PATH=C:\path\to\waybackurls\waybackurls.exe

使用

命令行

bash

设置 WAYBACKURLS_PATH 环境变量后

npx gc-waybackurls-mcp

与 Claude Desktop 一起使用

添加到您的 claude_desktop_config.json 文件中:

json { "mcpServers": { "waybackurls": { "command": "npx", "args": ["-y", "gc-waybackurls-mcp"], "env": { "WAYBACKURLS_PATH": "C:\path\to\waybackurls\waybackurls.exe" } } } }

与其他 MCP 客户端一起使用

对于其他 MCP 客户端,您可以配置它们以使用此服务器:

WAYBACKURLS_PATH=/path/to/waybackurls npx gc-waybackurls-mcp

运行 Waybackurls

配置完成后,您可以通过 MCP 接口使用 do-waybackurls 工具来运行 Waybackurls:

javascript // 通过 MCP 为包括子域名的域调用 Waybackurls 的示例 const result = await mcp.tools.invoke("do-waybackurls", { target: "example.com", noSub: false });

// 通过 MCP 为不包括子域名的域调用 Waybackurls 的示例 const resultNoSubs = await mcp.tools.invoke("do-waybackurls", { target: "example.com", noSub: true });

参数

Waybackurls MCP 支持以下参数:

  • target: 要检索历史 URL 的域名(必需)
  • noSub: 布尔标志,控制是否应包含子域名(默认:false)

示例

收集所有历史 URL

javascript const result = await mcp.tools.invoke("do-waybackurls", { target: "example.com", noSub: false });

仅收集主域名的历史 URL

javascript const result = await mcp.tools.invoke("do-waybackurls", { target: "example.com", noSub: true });

处理结果以进行进一步分析

javascript const result = await mcp.tools.invoke("do-waybackurls", { target: "example.com" });

// 将结果拆分为单独的 URL const urls = result.content[0].text.trim().split("\n");

// 筛选特定文件类型或模式 const jsFiles = urls.filter(url => url.endsWith(".js")); const apiEndpoints = urls.filter(url => url.includes("/api/"));

与 AI 助手集成

Waybackurls MCP 设计为可以与支持 Model Context Protocol 的 AI 助手无缝协作,从而实现自然语言交互来进行安全测试和侦察任务。

与 AI 助手的示例对话:

用户:查找 example.com 的历史 URL AI:我将使用 Wayback Machine 为 example.com 检索历史 URL。

[AI 使用 Waybackurls MCP 获取 URL 并返回结果]

我找到了以下 example.com 的有趣历史端点:

  • 几个旧的 API 端点:/api/v1/users, /api/v2/products

  • 以前可访问的管理页面:/admin/dashboard, /admin/users

  • 备份文件:/backup/db.sql, /backup/config.old ...## 安全注意事项

  • 本工具仅用于合法的安全研究和测试

  • 在扫描网站之前,务必获得适当的授权

  • 负责任且合乎道德地使用

  • 该工具仅检索由 Internet Archive 公开存档的信息

故障排除

如果您遇到问题:

  1. 确认 Waybackurls 已正确安装并可访问
  2. 检查配置中 Waybackurls 可执行文件的路径
  3. 确保已设置正确的执行权限
  4. 查看服务器日志以获取详细的错误信息
  5. 某些域名在 Wayback Machine 中可能有有限的历史记录或没有历史记录

使用技巧

  • 将 Waybackurls 的结果与其他侦察工具结合使用,以获取更全面的目标信息
  • 过滤结果,专注于特定文件类型或感兴趣的目录
  • 寻找历史 URL 中的模式,这些模式可能表明废弃的功能或测试端点
  • 利用结果来指导您的安全测试或漏洞赏金狩猎

许可证

Apache-2.0

致谢

来源