SKILL.md
只读
名称
firecrawl-company-directories
描述
使用 Firecrawl 从目录中提取结构化公司列表。适用于抓取 YC、Crunchbase、Product Hunt、G2、初创公司目录、分类目录或自定义公司数据库,输出为 JSON、CSV、CRM 就绪列表或研究表格。
Firecrawl 公司目录
使用此工具将初创公司或公司目录转换为结构化列表。
入职访谈
根据上下文推断目录、筛选条件、结果数量和输出格式。如果来源明确,请立即执行。
仅在遇到障碍时提出最多 1-3 个简洁问题,例如目录 URL/名称、所需筛选条件或目标结果数量。
Firecrawl 采集计划
当目录需要筛选、分页、无限滚动或点击个人资料时,使用 Firecrawl 浏览器。当列表是公开且静态时,使用 scrape/map。
建议的来源包括 YC 公司、Crunchbase、Product Hunt、G2 类别或任何自定义目录 URL。
提取字段
捕获可见的字段:
- 名称
- 描述
- 行业/类别
- 阶段/成立时间/地点/团队规模/融资(如果可见)
- 标签
- 目录个人资料 URL
- 公司网站 URL
不可用的字段留空。不要推断。
最终交付物
# 公司目录导出:[来源]
## 摘要
[筛选条件、提取数量、限制]
## 公司列表
[表格或 JSON/CSV 链接]
## 来源
[使用的目录页面和个人资料]
## 重新运行输入
workflow: firecrawl-company-directories
directory: [来源]
filters: [条件]
max_results: [数量]
output: [json/csv/markdown]
JSON 结构
使用 source、filters、extractedAt、totalResults 和 companies[],其中包含 name、url、description、industry、stage、founded、location、teamSize、funding、tags、profileUrl 和 websiteUrl。
质量标准
- 去重公司。
- 跟踪分页进度。
- 记录速率限制、登录墙或 CAPTCHA 拦截。






