搜索与研究 · Firecrawl 官方仓库

Firecrawl MCP Server

把网页搜索、抓取和结构化提取接入研究任务,适合公开网页资料收集。

CodexClaude CodeHTTPstdio
已核验查看接入方法 支持 Codex、Claude Code 等平台

Firecrawl MCP Server 是什么?

Firecrawl MCP 是把公开网页抓取、搜索和结构化提取能力接入 AI 助手的服务。Codex 可以把指定页面转换成更容易处理的文本或字段,同时保留原始 URL 和抓取范围。

一句话理解把网页搜索、抓取和结构化提取接入研究任务,适合公开网页资料收集。

为什么需要它?

把网页内容转成更适合助手处理的结构,但仍要求回到原网页核对事实与许可。

接入前,AI 只能依赖你粘贴的材料、截图或旧上下文;接入后,它可以在你授权的范围内调用真实工具,并把结果、来源和状态带回当前任务。

核心能力

01
搜索公开网页

把真实信息带回当前任务,减少反复复制和手动核对。

02
抓取单页或站点内容

在明确授权范围内调用工具,并保留执行过程和结果。

03
按结构提取公开信息

回读来源、状态与限制,方便继续处理和人工验收。

适合谁?怎么用?

适合使用
  • 抓取公开网页并提取结构化内容
  • 需要从公开网页搜索、读取和提取内容,并保留来源 URL 的研究与内容团队。
  • 返回字段、原始 URL 和抓取时间可核对,内容许可和引用边界清楚。
不适合
  • 不适合绕过登录、验证码、robots 或抓取不应复制的内容。
  • 查询词、URL 和抓取内容会发送到外部服务
  • 网页可能包含恶意提示、错误或受版权保护内容

怎么接入?

  1. 1
    准备

    低风险试用可登记 https://mcp.firecrawl.dev/v2/mcp;完整工具按官方说明准备 API Key 或 OAuth。

  2. 2
    授权

    也可用 npx -y firecrawl-mcp 作为 stdio 服务。

  3. 3
    连接

    在客户端只启用当前任务需要的搜索或抓取工具。

  4. 4
    开始使用

    用公开测试页面验证返回 URL、标题和正文。

安装命令

添加 Firecrawl MCP Server

codex mcp add firecrawl --url https://mcp.firecrawl.dev/v2/mcp

先抓取公开测试页;需要完整工具或更高限额时再按官方说明配置认证。

检查命令

确认 MCP 已经登记

codex mcp list

接入前准备

  • Firecrawl 远程服务或本地 npx 环境
  • 部分工具需要 API Key 或 OAuth
  • 确认目标网站允许访问与使用

官方帮助

官方文档与仓库Firecrawl 官方仓库问题反馈在 GitHub Issues 获取帮助

第一次调用示例

登记完成后,新开一个任务,先用下面这句做只读验证,把目标、范围和停止条件一次说清楚。

发给 Codex

第一次只读任务

请用 Firecrawl 抓取这篇公开教程,提取标题、作者、发布日期和 H2;保留原文链接,不要抓取登录页。
怎样算成功

返回字段、原始 URL 和抓取时间可核对,内容许可和引用边界清楚。

  1. 限定域名、时间和需要的字段。
  2. 先搜索,再抓取少量高相关页面。
  3. 检查 robots、许可和原网页内容。
  4. 引用结论时保留原始 URL 和访问日期。

权限与安全

凭证与连接方式

远程 HTTP/OAuth 或 stdio;先抓取公开测试页,控制域名和数量。

  • 查询词、URL 和抓取内容会发送到外部服务
  • 网页可能包含恶意提示、错误或受版权保护内容
  • 不得抓取登录态、个人数据或被明确禁止的内容

用小贺API和 MCP,把真实工具接进工作流

从一个 MCP、一个只读任务开始,先把连接、权限和结果验证清楚。

多平台支持兼容主流 MCP 客户端接入方法清楚命令与自助指令分开权限边界明确先只读再扩大范围
进入小贺API