工具可用性
请先阅读 开始使用,然后选择面向代理或面向用户。某些可选工具可通过环境配置或团队策略禁用。
选择工具
原有的 提取 MCP 工具已弃用,不属于当前工具集的一部分。对于已知页面,请使用 JSON 格式的 抓取;当 Firecrawl 必须发现来源时,请使用 代理。请参见选择数据提取器了解完整对比。
重要行为
解析本地文件
解析本地文件
连接到自托管 Firecrawl API 的本地 MCP 服务器可直接读取
filePath。托管服务器无法读取您本机上的文件,因此需要通过两次调用完成交接:- 使用
filePath调用firecrawl_parse,获取上传命令和uploadRef。 - 在可读取该文件的机器上运行上传命令。
- 使用返回的
uploadRef再次调用firecrawl_parse。
firecrawl_scrape。检查正在运行的爬取任务
检查正在运行的爬取任务
firecrawl_crawl 通常会启动爬取,并在返回前轮询至终态。如果等待超时,请使用 firecrawl_check_crawl_status 和爬取 ID 恢复该任务。对于在当前 MCP 调用之外创建的爬取,也请使用相同的状态工具。firecrawl_agent 是异步的:它会返回任务标识符,firecrawl_agent_status 会检查该任务,直到其完成或失败。关闭交互会话
关闭交互会话
使用
url 启动会话,或复用之前抓取调用中的 scrapeId。工作流完成后,使用 scrapeId 调用 firecrawl_interact_stop 以释放会话。安全管理监控
安全管理监控
firecrawl_monitor_* 系列工具可创建、列出、更新、运行和检查定期监控。firecrawl_monitor_delete 会永久删除监控,只有在用户明确要求删除时才应调用。使用 Alexandria 数据工具
使用 Alexandria 数据工具
Alexandria 工具需要经过身份验证的会话。免密钥会话无法使用 Alexandria 工具。
- 发现。 经过身份验证的
firecrawl_search默认使用sources: ["web", "alexandria"],并在data.tools中返回匹配的工具。使用sources: ["alexandria"]可仅返回工具,使用sources: ["web"]则跳过语义化工具发现。 - 查看。 不带参数调用
firecrawl_find_tools,可依次浏览类别、提供商和工具。使用query或urls查找适用于某项任务或某个网站的工具。使用capabilities读取工具的完整契约。按照返回的nextTool执行下一步。 - 运行。 调用
firecrawl_scrape时传入alexandria: {provider, capability, options},而不是url。发送最多包含 10 个调用的数组,即可一次性同时运行。data.alexandria中的每个结果都包含data或error。
THIRD_PARTY_DATA_TERMS_REQUIRED 以及 requiresAction.url。请将该 URL 提供给组织管理员,由其在 Firecrawl Dashboard 中接受条款。代理不得自行接受条款。管理员确认后,再次发送相同的调用即可。启用可选反馈工具
启用可选反馈工具
设置
FIRECRAWL_NO_SEARCH_FEEDBACK=1 可阻止注册 firecrawl_search_feedback。设置 FIRECRAWL_NO_ENDPOINT_FEEDBACK=1 可阻止注册 firecrawl_feedback。功能指南
抓取
从单个 URL 提取内容或结构化字段。
搜索
查找相关的网页、新闻、图片和开发者资源。
研究索引
搜索论文、阅读段落并追踪引用。
开发者索引
根据 issue、PR、README 和文档回答编程问题。
爬取
遍历并提取整个网站或其中的某个部分。
解析
将文件转换为可供 LLM 使用的输出。
交互
在实时浏览器会话中操作动态页面。
代理
运行自主的多源研究。
监控
跟踪页面变更并接收通知。
Alexandria
查找并运行第三方提供商的数据工具。

