firecrawl-company-directories

firecrawl-company-directories

使用 Firecrawl 从目录中提取结构化公司列表。适用于抓取 YC、Crunchbase、Product Hunt、G2、初创公司目录、分类目录或自定义公司数据库,输出为 JSON、CSV、CRM 就绪列表或研究表格。

53Star
12Fork
更新于 2026/6/25
SKILL.md
只读
名称
firecrawl-company-directories
描述

使用 Firecrawl 从目录中提取结构化公司列表。适用于抓取 YC、Crunchbase、Product Hunt、G2、初创公司目录、分类目录或自定义公司数据库,输出为 JSON、CSV、CRM 就绪列表或研究表格。

Firecrawl 公司目录

使用此工具将初创公司或公司目录转换为结构化列表。

入职访谈

根据上下文推断目录、筛选条件、结果数量和输出格式。如果来源明确,请立即执行。

仅在遇到障碍时提出最多 1-3 个简洁问题,例如目录 URL/名称、所需筛选条件或目标结果数量。

Firecrawl 采集计划

当目录需要筛选、分页、无限滚动或点击个人资料时,使用 Firecrawl 浏览器。当列表是公开且静态时,使用 scrape/map。

建议的来源包括 YC 公司、Crunchbase、Product Hunt、G2 类别或任何自定义目录 URL。

提取字段

捕获可见的字段:

  • 名称
  • 描述
  • 行业/类别
  • 阶段/成立时间/地点/团队规模/融资(如果可见)
  • 标签
  • 目录个人资料 URL
  • 公司网站 URL

不可用的字段留空。不要推断。

最终交付物

# 公司目录导出:[来源]

## 摘要
[筛选条件、提取数量、限制]

## 公司列表
[表格或 JSON/CSV 链接]

## 来源
[使用的目录页面和个人资料]

## 重新运行输入
workflow: firecrawl-company-directories
directory: [来源]
filters: [条件]
max_results: [数量]
output: [json/csv/markdown]

JSON 结构

使用 sourcefiltersextractedAttotalResultscompanies[],其中包含 nameurldescriptionindustrystagefoundedlocationteamSizefundingtagsprofileUrlwebsiteUrl

质量标准

  • 去重公司。
  • 跟踪分页进度。
  • 记录速率限制、登录墙或 CAPTCHA 拦截。