Firecrawl 是一款网页抓取 API,可以搜索网页、抓取单个页面或整个网站,并操作页面,返回 AI 应用可直接使用的干净 Markdown 或结构化 JSON。公司将它概括为:用一个 API 把网站变成干净、可供 LLM 使用的数据。
该服务由 SideGuide Technologies, Inc. 运营,这是一家以 Firecrawl 名义经营的特拉华州公司。独立科技媒体称它是面向开发者和 AI 智能体的热门开源网页爬虫,并通过 API 销售有商业支持的版本。
开源代码与托管服务之间的这种划分,左右着大多数采购决策。开源仓库主要采用 AGPL-3.0 许可,SDK 和部分 UI 组件则采用 MIT 许可。托管版运行在 Fire-engine 上,公司称之为自家用于代理、渲染等用途的专有基础设施。Firecrawl 在官网称,有超过 125 万名开发者和 150,000+ 家公司在用它构建产品,其中包括 Apple、Canva 和 Lovable 的团队(2026 年 9 月 28 日记录)。三位联合创始人于 2022 年创办了公司。2026 年 9 月 22 日,Firecrawl 宣布完成由 Smash Capital 领投的 7,500 万美元 B 轮融资。
抓取上限默认为 10000 页,因此除非修改上限,大型网站的抓取会在达到该数量时停止。
Scrape 的输出包括 Markdown、摘要、清理后的 HTML、原始 HTML、截图、链接、JSON、图片 URL、品牌信息、商品记录、来自受支持视频 URL 的音频或视频,以及自然语言查询格式。向 /scrape 传入 JSON schema,就会返回完全符合该结构的数据,例如商品列表、价格表或联系方式,无需另行解析。JavaScript 会自动渲染,因此单页应用和动态加载的网站能返回完整内容。除 HTML 外,该服务还能解析 PDF 和 DOCX 文件。
默认情况下,只要存在两天内的副本(maxAge 为 172,800,000 毫秒),Firecrawl 就从缓存返回结果。把 maxAge 设为 0 会强制重新获取,文档称这样耗时更长,也更容易失败。
Firecrawl 称,在其自有的 1,000 个 URL 基准数据集上(2026 年 1 月 13 日运行)覆盖率为 96%,同一数据集上的 P95 延迟为 3,387 毫秒。这些是公司自行运行并发布的测量,并非独立测试。
首次跑通的路径很短,每一步都会解锁更多 API 能力:
公司列出的常见用途包括深度研究智能体、RAG 管道、线索补全、竞争情报、内容生成和价格监控。其公开的客户案例把这些类别对应到具体团队:
这四个示例都来自 Firecrawl 自己的网站,展示的是各团队的用法模式,而非实测效果。
Firecrawl 自己的指南围绕“由谁运行基础设施”来划分选择。它的建议是先用 Firecrawl Cloud,除非获得源码或掌控基础设施值得付出相应的运维工作。
Firecrawl 可通过 REST API、官方 SDK、CLI 和 MCP 服务器使用,也可以自托管。
| 决策项 | 开源版 | Firecrawl Cloud |
|---|---|---|
| 核心 scrape、crawl、map 和 search API | 包含 | 包含并托管 |
| 基于 LLM 的提取与格式 | 接入兼容 OpenAI 的服务商或 Ollama | 托管的服务商路径 |
| Agent、Browser、Interact、控制台、企业管控 | 不在默认技术栈中 | 视产品和套餐而定 |
| 用量与计费 | 你的基础设施和服务商成本 | 套餐与积分模式 |
自托管默认技术栈还有一处缺口:截图和页面操作不可用,因为两者都需要 Fire-engine。
Firecrawl 价格按积分(credits)计算,无论账单地址在哪里,所有发票均以美元结算。下表把同时显示两种计费周期的套餐列表与套餐对比合在一起。
| 套餐 | 每月积分 | 按月付费 | 按年付费 | 并发浏览器 | /scrape、/map、/search 速率限制 |
|---|---|---|---|---|---|
| Free | 1,000 | $0,无需绑卡 | 不提供 | 2 | 10 次/分钟 |
| Hobby | 5,000 | $19/月 | $16/月 | 5 | 100 次/分钟 |
| Standard | 100,000 | $99/月 | $83/月 | 25 | 500 次/分钟 |
| Growth | 500,000 | $399/月 | $333/月 | 50 | 5,000 次/分钟 |
| Scale | 1,000,000 | $749/月 | $599/月 | 100 | 10,000 次/分钟 |
| Enterprise | 定制 | 定制 | 定制 | 定制 | 定制 |
年付套餐每年扣款一次,但积分仍按虚拟的每月续期日逐月重置。/crawl 和 /agent 端点另有一套更低的限制,从 Free 的每分钟 2 次请求到 Scale 的 2,000 次。批量抓取端点与 crawl 共用限额。付款经由 Stripe 处理,支持大多数主流信用卡、借记卡以及 PayPal。
Scrape、Crawl、Map 和 Monitor 按每页 1 积分计价,Search 每 10 条结果 2 积分。Search 按每 10 条结果向上取整,因此 11 条结果花 4 积分。Scrape 选项在基础费率上叠加:JSON 提取每页另加 4 积分,同时使用 JSON 格式和零数据保留(Zero Data Retention)抓取的页面花 6 积分。Agent 处于预览阶段,每天有 5 次免费运行,之后按动态价格计费。
有两项单价在不同页面上并不一致。价格页列出 Interact 为每浏览器分钟 2 积分;计费文档则称使用提示词的会话按每浏览器分钟 7 积分计费,纯代码会话按 2 积分。计费文档还把 Map 列为每次调用 1 积分,而不是每页。
各官方页面对结转规则的说法相互冲突。价格页称 Scale 可将未用积分结转一个月,Enterprise 的结转量为定制,Hobby、Standard 和 Growth 不结转。计费文档则称年付 Scale 套餐的未用套餐积分结转 1 个月,年付 Enterprise 套餐结转 2 个月。
在开发者社区的讨论中,Firecrawl 与 Tavily、Exa、Perplexity 和 Linkup 一同被提及,都是供智能体搜索网页的工具。
Firecrawl 发布了与其中许多工具的对比页,但这些页面由 Firecrawl 撰写,是在为自家产品说话。
零数据保留(Zero Data Retention)在请求结束后不保留任何页面内容或提取数据,仅在 Enterprise 套餐提供,每页另加 1 积分。ZDR 模式下无法截图。在 ZDR 之外,把 storeInCache 设为 false 可让 Firecrawl 不缓存该请求的结果。所有套餐都列有 SOC 2 Type II、渗透测试、多因素认证和 PII 脱敏。数据处理协议从 Standard 套餐起列出。隐私政策称,个人信息会一直保留到你书面请求删除为止。在所查阅的隐私政策和条款中,未找到关于将客户数据用于模型训练的说明。
可以,但有限制。Free 套餐每月提供 1,000 积分,无需绑卡;无密钥访问可在每 IP 每日上限内使用 search、scrape 和 interact。付费套餐起价每月 $19,按年付费为每月 $16。
默认遵守。忽略 robots.txt 是仅限 Enterprise 的选项,而且该项目把遵守各网站政策的责任放在用户身上。
默认自托管技术栈不含 Agent、Browser、Interact、控制台、企业管控、截图或页面操作。基于 LLM 的提取需要你自己的兼容 OpenAI 的服务商或 Ollama。
Free 账户会收到 HTTP 402 错误,直到每月重置。付费套餐开启按量付费时,Firecrawl 会自动购买更多积分,直至你的每月上限;未开启时,请求同样返回 402。