Firecrawl MCP Server 是什么?
Firecrawl MCP 是把公开网页抓取、搜索和结构化提取能力接入 AI 助手的服务。Codex 可以把指定页面转换成更容易处理的文本或字段,同时保留原始 URL 和抓取范围。
一句话理解把网页搜索、抓取和结构化提取接入研究任务,适合公开网页资料收集。
为什么需要它?
把网页内容转成更适合助手处理的结构,但仍要求回到原网页核对事实与许可。
接入前,AI 只能依赖你粘贴的材料、截图或旧上下文;接入后,它可以在你授权的范围内调用真实工具,并把结果、来源和状态带回当前任务。
核心能力
搜索公开网页
把真实信息带回当前任务,减少反复复制和手动核对。
抓取单页或站点内容
在明确授权范围内调用工具,并保留执行过程和结果。
按结构提取公开信息
回读来源、状态与限制,方便继续处理和人工验收。
适合谁?怎么用?
- 抓取公开网页并提取结构化内容
- 需要从公开网页搜索、读取和提取内容,并保留来源 URL 的研究与内容团队。
- 返回字段、原始 URL 和抓取时间可核对,内容许可和引用边界清楚。
- 不适合绕过登录、验证码、robots 或抓取不应复制的内容。
- 查询词、URL 和抓取内容会发送到外部服务
- 网页可能包含恶意提示、错误或受版权保护内容
怎么接入?
- 1准备
低风险试用可登记
https://mcp.firecrawl.dev/v2/mcp;完整工具按官方说明准备 API Key 或 OAuth。 - 2授权
也可用
npx -y firecrawl-mcp作为 stdio 服务。 - 3连接
在客户端只启用当前任务需要的搜索或抓取工具。
- 4开始使用
用公开测试页面验证返回 URL、标题和正文。
安装命令
添加 Firecrawl MCP Server
codex mcp add firecrawl --url https://mcp.firecrawl.dev/v2/mcp先抓取公开测试页;需要完整工具或更高限额时再按官方说明配置认证。
检查命令
确认 MCP 已经登记
codex mcp list不想自己操作终端时,把下面整段发给 Codex。它会先核对官方说明和前置条件,遇到凭证或占位符会停下来询问。
发给 Codex
自助接入 Firecrawl MCP Server
请帮我在当前电脑上接入并验证 Firecrawl MCP Server。
官方来源:https://github.com/firecrawl/firecrawl-mcp-server
目标接入命令:codex mcp add firecrawl --url https://mcp.firecrawl.dev/v2/mcp
请按以下步骤执行:
1. 先阅读官方 README,核对当前推荐接入方式与上述命令。如果官方说明已经变化,先告诉我差异,不要盲目执行旧命令。
2. 检查运行环境、登录状态、Token、项目 ID、允许访问路径等前置条件。不要在输出中显示任何凭证,也不要把凭证写入仓库。
3. 如果命令中有需要替换的占位符,先列出需要我提供的值并停下来,不要自行猜测。
4. 条件满足后执行接入命令,再运行 codex mcp list,确认 Firecrawl MCP Server 已登记,并回报实际服务名、传输方式和检查结果。
5. 用下面这个只读任务验证连接:请用 Firecrawl 抓取这篇公开教程,提取标题、作者、发布日期和 H2;保留原文链接,不要抓取登录页。
6. 不要创建、修改、删除、发送内容,也不要连接生产环境;需要写权限或更高权限时先征求我确认。- 复制完整指令,发给一个有终端和当前项目访问权限的 Codex 任务。
- Codex 会先核对官方来源和本机环境;遇到 Token、项目 ID、路径或其他占位符时,应停下来向你确认。
- 接入后运行
codex mcp list,再用 Firecrawl MCP Server 的只读首测任务回读结果。
第一次调用示例
登记完成后,新开一个任务,先用下面这句做只读验证,把目标、范围和停止条件一次说清楚。
发给 Codex
第一次只读任务
请用 Firecrawl 抓取这篇公开教程,提取标题、作者、发布日期和 H2;保留原文链接,不要抓取登录页。怎样算成功
返回字段、原始 URL 和抓取时间可核对,内容许可和引用边界清楚。
- 限定域名、时间和需要的字段。
- 先搜索,再抓取少量高相关页面。
- 检查 robots、许可和原网页内容。
- 引用结论时保留原始 URL 和访问日期。
权限与安全
凭证与连接方式
远程 HTTP/OAuth 或 stdio;先抓取公开测试页,控制域名和数量。
- 查询词、URL 和抓取内容会发送到外部服务
- 网页可能包含恶意提示、错误或受版权保护内容
- 不得抓取登录态、个人数据或被明确禁止的内容
