firecrawl-crawl

firecrawl-crawl

热门

从整个网站或网站部分批量提取内容。当用户想要爬取网站、提取文档部分的所有页面、批量抓取跟随链接的多个页面,或提到“爬取”、“获取所有页面”、“提取 /docs 下的所有内容”、“批量提取”,或需要同一网站上的多个页面内容时,使用此技能。处理深度限制、路径过滤和并发提取。

473Star
72Fork
更新于 2026/6/19
SKILL.md
readonly只读
name
firecrawl-crawl
description

从整个网站或网站部分批量提取内容。当用户想要爬取网站、提取文档部分的所有页面、批量抓取跟随链接的多个页面,或提到“爬取”、“获取所有页面”、“提取 /docs 下的所有内容”、“批量提取”,或需要同一网站上的多个页面内容时,使用此技能。处理深度限制、路径过滤和并发提取。

firecrawl crawl

从网站批量提取内容。爬取页面,跟随链接直到达到深度/限制。

何时使用

  • 你需要网站上的多个页面内容(例如,所有 /docs/
  • 你想提取整个网站部分
  • 工作流升级模式中的第4步:搜索 → 抓取 → 映射 → 爬取 → 交互

快速开始

# 爬取文档部分
firecrawl crawl "<url>" --include-paths /docs --limit 50 --wait -o .firecrawl/crawl.json

# 带深度限制的完整爬取
firecrawl crawl "<url>" --max-depth 3 --wait --progress -o .firecrawl/crawl.json

# 检查正在运行的爬取状态
firecrawl crawl <job-id>

选项

选项 描述
--wait 等待爬取完成后再返回
--progress 等待时显示进度
--limit <n> 最大爬取页面数
--max-depth <n> 最大链接深度
--include-paths <paths> 仅爬取匹配这些路径的URL
--exclude-paths <paths> 跳过匹配这些路径的URL
--delay <ms> 请求之间的延迟
--max-concurrency <n> 最大并行爬取工作线程数
--pretty 美化打印JSON输出
-o, --output <path> 输出文件路径

提示

  • 当你需要立即获得结果时,始终使用 --wait。没有它,爬取会返回一个作业ID用于异步轮询。
  • 使用 --include-paths 限定爬取范围——当你只需要一个部分时,不要爬取整个网站。
  • 爬取按页面消耗积分。在进行大规模爬取前,检查 firecrawl credit-usage

另请参阅