Firecrawlは、Webを検索し、単一ページやサイト全体をスクレイピングし、ページを操作して、AIアプリがそのまま使えるクリーンなMarkdownや構造化JSONを返すWebスクレイピングAPIです。同社はこれを、Webサイトをクリーンな LLM 向けデータに変える一つのAPIと要約しています。
サービスの運営元は SideGuide Technologies, Inc. で、Firecrawl の名称で事業を行うデラウェア州法人です。独立系テックメディアは、開発者とAIエージェント向けの人気のオープンソースのWebクローラーであり、商用サポート付きの版をAPIとして販売していると説明しています。
オープンなコードとホスト型サービスのこの切り分けが、多くの導入判断を左右します。オープンソースのリポジトリは主に AGPL-3.0 でライセンスされ、SDKと一部のUIコンポーネントは MIT License を採用しています。ホスト版は、同社がプロキシやレンダリングなどのための自社独自インフラと呼ぶ Fire-engine 上で動作します。Firecrawlはサイト上で、125万人超の開発者と150,000社以上の企業がこれを使って開発しており、Apple、Canva、Lovable のチームも含まれるとしています(2026年9月28日時点)。3人の共同創業者が2022年に設立しました。2026年9月22日、Firecrawlは Smash Capital 主導の7,500万ドルのシリーズBを発表しました。
クロールの上限はデフォルトで10000ページなので、上限を変えない限り、大規模サイトのクロールはその件数で止まります。
Scrape の出力には、Markdown、要約、クリーンなHTML、生のHTML、スクリーンショット、リンク、JSON、画像URL、ブランディング、商品レコード、対応する動画URLからの音声または動画、自然言語クエリ形式があります。/scrape にJSONスキーマを渡すと、商品一覧、料金表、連絡先情報などをまさにその形のデータで返し、別途パースは不要です。JavaScriptは自動でレンダリングされるため、シングルページアプリや動的に読み込まれるサイトも全内容を返します。HTML以外に、PDFとDOCXファイルも解析します。
2日より新しいコピー(maxAge 172,800,000ms)があれば、デフォルトでキャッシュから結果を返します。maxAge を0にすると新規取得が強制されますが、ドキュメントによれば時間が長くかかり、失敗もしやすくなります。
同社は、2026年1月13日に実行した自社の1,000 URLベンチマークデータセットでカバー率96%、同データセットでP95レイテンシ3,387msだったと報告しています。これは同社が実施・公表した計測であり、独立したテストではありません。
最初に動く構成までの手順は短く、各ステップで使えるAPIが広がります。
同社は、ディープリサーチエージェント、RAGパイプライン、リード情報拡充、競合インテリジェンス、コンテンツ生成、価格モニタリングを一般的な用途に挙げています。公開の顧客事例は、これらのカテゴリーを実名のチームに結び付けています。
4つの例はいずれもFirecrawl自身のサイト由来です。示すのは各チームの使い方のパターンで、計測された成果ではありません。
Firecrawl自身のガイドは、誰がインフラを運用するかを軸に選択を整理しています。ソースへのアクセスやインフラ管理が運用の手間に見合わない限り、Firecrawl Cloud から始めるよう同社は勧めています。
Firecrawlは REST API、公式SDK、CLI、MCPサーバーから利用でき、セルフホスティングも可能です。
| 判断項目 | オープンソース | Firecrawl Cloud |
|---|---|---|
| コアの scrape、crawl、map、search API | 含まれる | 含まれ、マネージド |
| LLMベースの抽出と形式 | OpenAI互換プロバイダーまたは Ollama を接続 | マネージドのプロバイダー経路 |
| Agent、Browser、Interact、ダッシュボード、エンタープライズ管理機能 | デフォルトのスタックにはない | 製品とプランによる |
| 利用量と課金 | 自社インフラとプロバイダーの費用 | プランとクレジットのモデル |
セルフホストのデフォルトのスタックにはさらに欠落があり、スクリーンショットとページ操作はどちらも Fire-engine が必要なため使えません。
Firecrawlの料金はクレジット制で、請求先住所にかかわらず、すべての請求書はUSDで請求されます。下表は、両方の請求期間を示すプラン一覧とプラン比較をまとめたものです。
| プラン | 月間クレジット | 月払い | 年払い | 同時ブラウザ数 | /scrape、/map、/search のレート制限 |
|---|---|---|---|---|---|
| Free | 1,000 | $0、カード不要 | 提供なし | 2 | 毎分10回 |
| Hobby | 5,000 | 月$19 | 月$16 | 5 | 毎分100回 |
| Standard | 100,000 | 月$99 | 月$83 | 25 | 毎分500回 |
| Growth | 500,000 | 月$399 | 月$333 | 50 | 毎分5,000回 |
| Scale | 1,000,000 | 月$749 | 月$599 | 100 | 毎分10,000回 |
| Enterprise | 個別設定 | 個別設定 | 個別設定 | 個別設定 | 個別設定 |
年間プランは年1回の請求ですが、クレジットは仮想の月次更新日に毎月リセットされます。/crawl と /agent エンドポイントには別の低い上限があり、Free の毎分2リクエストから Scale の2,000までです。batch scrape エンドポイントは crawl の上限を共有します。支払いは Stripe 経由で、主要なクレジットカード・デビットカードの大半と PayPal が使えます。
Scrape、Crawl、Map、Monitor は1ページあたり1クレジット、Search は結果10件あたり2クレジットです。Search は10件単位で切り上げるため、結果11件は4クレジットです。Scrape のオプションは基本料金に上乗せされます。JSON抽出は1ページあたり4クレジット加算され、JSON形式と Zero Data Retention を併用してスクレイピングしたページは6クレジットです。Agent はプレビュー段階で、1日5回の無料実行があり、その後は動的な料金になります。
2つの単価はページによって異なります。料金ページは Interact をブラウザ1分あたり2クレジットとし、課金ドキュメントは、プロンプトを使うセッションはブラウザ1分あたり7クレジット、コードのみのセッションは2クレジットで課金されるとしています。課金ドキュメントはさらに、Map をページ単位ではなく1呼び出しあたり1クレジットとしています。
繰り越しのルールは公式ページ間で食い違っています。料金ページは、Scale は未使用クレジットを1か月繰り越し、Enterprise は個別設定の量を繰り越し、Hobby、Standard、Growth は繰り越しなしとしています。一方、課金ドキュメントは、年間の Scale プランは未使用のプランクレジットを1か月、年間の Enterprise プランは2か月繰り越すとしています。
開発者コミュニティの議論では、Firecrawlは Tavily、Exa、Perplexity、Linkup と並んで、エージェントがWebを検索するためのツールとして名前が挙がります。
Firecrawlはこれらの多くのツールとの比較ページを公開していますが、同社自身が書いたもので自社製品を推す内容です。
Zero Data Retention は、リクエスト終了後にページ内容や抽出データを一切保持せず、Enterprise プランでのみ提供され、1ページあたり1クレジットが加算されます。ZDRモードではスクリーンショットを使えません。ZDR以外では、storeInCache を false にすると、そのリクエストの結果はキャッシュされなくなります。すべてのプランに SOC 2 Type II、ペネトレーションテスト、多要素認証、PIIの秘匿化が記載されています。データ処理契約は Standard プラン以上に記載されています。プライバシーポリシーによれば、個人情報は書面で削除を求めるまで保持されます。確認したプライバシーポリシーと規約では、顧客データのモデル学習への利用に関する記述は見つかりませんでした。
はい、上限内で使えます。Free プランはカード不要で毎月1,000クレジットが付き、キーなしのアクセスではIPごとの1日の上限内で search、scrape、interact を使えます。有料プランは月$19から、年払いなら月$16です。
デフォルトでは守ります。robots.txt の無視は Enterprise 限定のオプションで、各Webサイトのポリシーを守る責任はユーザーにあるとプロジェクトは位置づけています。
デフォルトのセルフホスト構成には、Agent、Browser、Interact、ダッシュボード、エンタープライズ管理機能、スクリーンショット、ページ操作が含まれません。LLMベースの抽出には、自前のOpenAI互換プロバイダーか Ollama が必要です。
Free アカウントは月次リセットまで HTTP 402 エラーになります。有料プランで従量課金をオンにしていれば、月間上限までクレジットが自動で追加購入され、オフの場合はリクエストがやはり402を返します。