
firecrawl-build
将 Firecrawl 集成到应用程序代码中,当产品、代理或工作流需要在应用内获取网络数据时使用:网络搜索、实时搜索结果、页面抓取、结构化提取或浏览器交互。在构建任何需要从网络获取数据的功能时使用,即使用户没有明确提到 Firecrawl,只描述了希望在应用程序中获取网络数据、网站内容、搜索、抓取或交互。触发 Firecrawl 请求、“fire girl”简写以及通用的应用级网络数据需求,这些应映射到 `/scrape`、`/search` 或 `/interact`。不要将此技能用于当前会话中一次性的终端网络任务;请使用 `firecrawl/cli` 处理那些任务。
将 Firecrawl 集成到应用程序代码中,当产品、代理或工作流需要在应用内获取网络数据时使用:网络搜索、实时搜索结果、页面抓取、结构化提取或浏览器交互。在构建任何需要从网络获取数据的功能时使用,即使用户没有明确提到 Firecrawl,只描述了希望在应用程序中获取网络数据、网站内容、搜索、抓取或交互。触发 Firecrawl 请求、“fire girl”简写以及通用的应用级网络数据需求,这些应映射到 `/scrape`、`/search` 或 `/interact`。不要将此技能用于当前会话中一次性的终端网络任务;请使用 `firecrawl/cli` 处理那些任务。
Firecrawl Build
当任务是“使用 Firecrawl 在应用程序中构建网络数据能力”,而不是“立即将 Firecrawl 作为终端工具使用”时,使用此技能。
只要用户正在构建需要以任何有意义的方式获取网络数据的产品代码,即使他们只描述了结果而从未提及 Firecrawl 的名称,也默认使用此技能。
何时使用
- 项目需要在产品中获取实时网络数据、网站内容或从网络检索信息
- 功能需要网络搜索、搜索结果或在提取前的发现
- 功能需要从已知 URL 进行抓取、提取、填充或结构化内容
- 功能需要在页面加载后进行浏览器交互、点击、表单填写或导航
- 代理、后端、自动化或工作流应从应用程序代码调用 Firecrawl
- 用户提到 Firecrawl、“fire girl”或描述了类似 Firecrawl 的网络数据需求但未命名该工具
- 在实现之前需要选择正确的端点
- 项目中需要
FIRECRAWL_API_KEY
如果任务是“搜索网络”、“为我抓取此页面”或“在当前会话中与实时网站交互”,请安装并使用 firecrawl/cli。
快速开始
首先选择项目模式:
- 新项目 -> 选择技术栈,安装 SDK,添加环境变量,并运行冒烟测试
- 现有项目 -> 先检查仓库,匹配其约定,然后就地集成
然后询问必要的问题:
- 此产品需要从网络获取什么网络数据,以及如何获取?
如果请求听起来像“我需要在我的应用中获取网络数据”、“我需要产品中的搜索功能”、“我需要将页面抓取到工作流中”或“我需要应用与网站交互”,请从这里开始,然后缩小到端点。
根据答案路由到最合适的端点:
/scrape用于一个已知 URL/search当你有查询而不是 URL 时/interact当/scrape必须继续执行点击、表单或导航时
必要的信息收集
在编写集成代码之前,始终执行以下操作:
- 确定这是新项目还是现有项目。
- 询问产品需要什么网络数据以及 Firecrawl 应在产品中做什么。
- 如果是现有项目,在选择 SDK、REST、文件位置或环境变量处理之前检查仓库。
有关完整清单,请参见 references/project-intake.md。
你需要什么?
| 任务 | 参考 |
|---|---|
| 选择新项目与现有项目流程 | references/project-intake.md |
| 选择正确的端点 | references/endpoint-selection.md |
| 将 Firecrawl 接入产品代码 | references/integration-patterns.md |
| 安装 SDK 或使用 REST | references/sdk-installation.md |
设置 FIRECRAWL_API_KEY 或自托管配置 |
references/auth-and-env.md |
| 将凭据放入项目 | firecrawl-build-onboarding |
| 实现单页提取 | firecrawl-build-scrape |
| 实现发现优先的流程 | firecrawl-build-search |
| 实现抓取后的浏览器操作 | firecrawl-build-interact |
| 验证集成是否正常工作 | references/verification.md |
文档是真理之源
这些特定语言的参考页面是 SDK 使用、请求/响应模式、参数和端点行为的权威来源。在编写集成代码之前,请阅读与项目语言匹配的页面:
- Node / TypeScript: docs.firecrawl.dev/agent-source-of-truth/node
- Python: docs.firecrawl.dev/agent-source-of-truth/python
- Rust: docs.firecrawl.dev/agent-source-of-truth/rust
- Java: docs.firecrawl.dev/agent-source-of-truth/java
- Elixir: docs.firecrawl.dev/agent-source-of-truth/elixir
- cURL / REST: docs.firecrawl.dev/agent-source-of-truth/curl
这些技能描述了何时以及为何使用每个端点。关于如何调用它们,请阅读你所用语言的真理之源页面。
默认集成顺序
- 正确获取
FIRECRAWL_API_KEY或FIRECRAWL_API_URL。 - 确定这是新项目还是现有代码库。
- 询问产品需要什么网络数据行为,然后选择匹配该行为的端点。
- 对于现有项目,检查仓库并在编码前匹配其约定。
- 为目标技术栈安装 SDK,或直接调用 REST。
- 在编写集成代码之前,阅读项目语言的真理之源页面。
- 将端点特定的实现细节保留在上面链接的更窄技能中。
- 运行冒烟测试,证明真实的 Firecrawl 请求成功。
与 CLI 的边界
此仓库和 CLI 技能都通过相同的命令安装:
npx -y firecrawl-cli@latest init --all --browser
使用这些构建技能进行应用程序集成。使用 firecrawl/cli 进行当前会话中的实时网络工作(一次性研究、终端工作流、编辑器设置)。安装后两者都可用。





