Hast du dieses Tool genutzt? Bewerte es
Hast du dieses Tool genutzt? Bewerte es
Firecrawl ist eine Web-Scraping-API, die das Web durchsucht, einzelne Seiten oder ganze Websites scrapt und Seiten bedient und dabei sauberes Markdown oder strukturiertes JSON liefert, das KI-Anwendungen direkt verarbeiten können. Das Unternehmen fasst es als eine einzige API zusammen, die Websites in saubere, LLM-taugliche Daten verwandelt.
Betrieben wird der Dienst von SideGuide Technologies, Inc., einer Delaware-Gesellschaft, die unter dem Namen Firecrawl auftritt. Unabhängige Tech-Medien beschreiben es als beliebten Open-Source-Webcrawler für Entwickler und KI-Agenten, dessen kommerziell unterstützte Version über eine API verkauft wird.
Diese Trennung zwischen offenem Code und gehostetem Dienst prägt die meisten Kaufentscheidungen. Das Open-Source-Repository steht überwiegend unter AGPL-3.0, während die SDKs und einige UI-Komponenten die MIT-Lizenz nutzen. Die gehostete Version läuft auf Fire-engine, das das Unternehmen als seine proprietäre Infrastruktur für Proxys, Rendering und mehr bezeichnet. Auf seiner Website gibt Firecrawl an, dass über 1,25 Mio. Entwickler und mehr als 150.000 Unternehmen damit bauen, darunter Teams von Apple, Canva und Lovable (Stand der Erfassung: 28. September 2026). Die drei Mitgründer starteten das Unternehmen 2022. Am 22. September 2026 gab Firecrawl eine von Smash Capital angeführte Series-B-Finanzierung über 75 Mio. US-Dollar bekannt.
Das Crawl-Limit liegt standardmäßig bei 10000 Seiten; ein Crawl einer großen Website stoppt also bei dieser Zahl, sofern das Limit nicht geändert wird.
Scrape-Ausgaben umfassen Markdown, Zusammenfassung, bereinigtes HTML, Roh-HTML, Screenshots, Links, JSON, Bild-URLs, Branding, Produktdatensätze, Audio oder Video von unterstützten Video-URLs sowie ein Abfrageformat in natürlicher Sprache. Wer /scrape ein JSON-Schema übergibt, erhält Daten in genau dieser Form, etwa Produktlisten, Preistabellen oder Kontaktdaten, ohne separates Parsen. JavaScript wird automatisch gerendert, sodass Single-Page-Apps und dynamisch geladene Websites ihren vollständigen Inhalt liefern. Über HTML hinaus parst der Dienst PDF- und DOCX-Dateien.
Standardmäßig liefert Firecrawl Ergebnisse aus dem Cache, wenn eine Kopie existiert, die jünger als zwei Tage ist (ein maxAge von 172.800.000 ms). Wird maxAge auf 0 gesetzt, erzwingt das einen frischen Abruf, der laut Dokumentation länger dauert und eher fehlschlägt.
Firecrawl meldet 96 % Abdeckung auf seinem eigenen Benchmark-Datensatz mit 1.000 URLs, ausgeführt am 13. Januar 2026, bei einer P95-Latenz von 3.387 ms auf demselben Datensatz. Es handelt sich um Messungen, die das Unternehmen selbst durchgeführt und veröffentlicht hat, nicht um unabhängige Tests.
Ein erstes funktionierendes Setup folgt einem kurzen Weg, und jeder Schritt schaltet mehr von der API frei:
Das Unternehmen nennt Deep-Research-Agenten, RAG-Pipelines, Lead-Anreicherung, Wettbewerbsanalyse, Content-Erstellung und Preisüberwachung als gängige Einsatzzwecke. Die veröffentlichten Kundengeschichten ordnen diese Kategorien namentlich genannten Teams zu:
Alle vier Beispiele stammen von Firecrawls eigener Website. Sie zeigen das Muster, das jedes Team nutzt, keine gemessenen Ergebnisse.
Firecrawls eigene Empfehlungen ordnen die Wahl danach, wer die Infrastruktur betreibt. Empfohlen wird, mit Firecrawl Cloud zu beginnen, es sei denn, Quellcodezugang oder Infrastrukturkontrolle sind den Betriebsaufwand wert.
Firecrawl ist über eine REST-API, offizielle SDKs, eine CLI und einen MCP-Server erreichbar oder lässt sich selbst hosten.
| Entscheidung | Open Source | Firecrawl Cloud |
|---|---|---|
| Kern-APIs scrape, crawl, map und search | Enthalten | Enthalten und verwaltet |
| LLM-gestützte Extraktion und Formate | OpenAI-kompatiblen Anbieter oder Ollama anbinden | Verwalteter Anbieterpfad |
| Agent, Browser, Interact, Dashboard, Enterprise-Kontrollen | Nicht im Standard-Stack | Je nach Produkt und Plan |
| Nutzung und Abrechnung | Eigene Infrastruktur- und Anbieterkosten | Plan- und Credit-Modell |
Der selbst gehostete Standard-Stack hat eine weitere Lücke: Screenshots und Seitenaktionen sind nicht verfügbar, weil beide Fire-engine benötigen.
Die Firecrawl-Preise basieren auf Credits, und alle Rechnungen werden unabhängig von der Rechnungsadresse in USD gestellt. Die Tabelle kombiniert die Planliste, die beide Abrechnungszeiträume zeigt, mit dem Planvergleich.
| Plan | Credits pro Monat | Monatliche Zahlung | Jährliche Zahlung | Gleichzeitige Browser | Rate-Limit /scrape, /map, /search |
|---|---|---|---|---|---|
| Free | 1.000 | 0 $, ohne Karte | Nicht angeboten | 2 | 10 / Min. |
| Hobby | 5.000 | 19 $/Monat | 16 $/Monat | 5 | 100 / Min. |
| Standard | 100.000 | 99 $/Monat | 83 $/Monat | 25 | 500 / Min. |
| Growth | 500.000 | 399 $/Monat | 333 $/Monat | 50 | 5.000 / Min. |
| Scale | 1.000.000 | 749 $/Monat | 599 $/Monat | 100 | 10.000 / Min. |
| Enterprise | Individuell | Individuell | Individuell | Individuell | Individuell |
Jahrespläne werden einmal jährlich abgerechnet, die Credits werden aber trotzdem monatlich an einem virtuellen monatlichen Verlängerungsdatum zurückgesetzt. Die Endpunkte /crawl und /agent haben ein separates, niedrigeres Limit, von 2 Anfragen pro Minute bei Free bis 2.000 bei Scale. Batch-Scrape-Endpunkte teilen sich das Crawl-Limit. Die Zahlung läuft über Stripe, das die meisten gängigen Kredit- und Debitkarten sowie PayPal akzeptiert.
Scrape, Crawl, Map und Monitor kosten 1 Credit pro Seite, Search kostet 2 Credits pro 10 Ergebnisse. Search rundet pro 10 Ergebnisse auf, 11 Ergebnisse kosten also 4 Credits. Scrape-Optionen kommen zum Grundpreis hinzu: JSON-Extraktion kostet 4 Credits pro Seite zusätzlich, und eine Seite, die sowohl im JSON-Format als auch mit Zero Data Retention gescrapt wird, kostet 6 Credits. Agent ist in der Vorschau mit 5 kostenlosen Durchläufen pro Tag und danach dynamischen Preisen.
Zwei Einheitspreise unterscheiden sich zwischen den Seiten. Die Preisseite nennt für Interact 2 Credits pro Browser-Minute. Die Abrechnungsdokumentation gibt an, dass Sitzungen mit Prompt 7 Credits pro Browser-Minute kosten und reine Code-Sitzungen 2. Außerdem führt die Abrechnungsdokumentation Map mit 1 Credit pro Aufruf statt pro Seite.
Die Übertragungsregeln widersprechen sich auf den offiziellen Seiten. Die Preisseite sagt, dass Scale ungenutzte Credits einen Monat überträgt und Enterprise eine individuelle Menge, ohne Übertrag bei Hobby, Standard oder Growth. Die Abrechnungsdokumentation sagt dagegen, dass jährliche Scale-Pläne ungenutzte Plan-Credits 1 Monat und jährliche Enterprise-Pläne 2 Monate übertragen.
In Diskussionen der Entwickler-Community wird Firecrawl neben Tavily, Exa, Perplexity und Linkup als Tool genannt, mit dem Agenten im Web suchen.
Firecrawl veröffentlicht Vergleichsseiten zu vielen dieser Tools, doch sie sind von Firecrawl geschrieben und argumentieren für das eigene Produkt.
Zero Data Retention, das über die Dauer der Anfrage hinaus keine Seiteninhalte oder extrahierten Daten aufbewahrt, gibt es nur in Enterprise-Plänen, und es kostet 1 Credit pro Seite zusätzlich. Screenshots sind im ZDR-Modus nicht verfügbar. Außerhalb von ZDR verhindert storeInCache auf false, dass Firecrawl die Ergebnisse einer Anfrage cacht. Jeder Plan führt SOC 2 Type II, Penetrationstests, Multi-Faktor-Authentifizierung und PII-Schwärzung auf. Ein Auftragsverarbeitungsvertrag ist ab dem Standard-Plan aufgeführt. Laut Datenschutzerklärung werden personenbezogene Daten gespeichert, bis man schriftlich die Löschung verlangt. In der geprüften Datenschutzerklärung und den Bedingungen fand sich keine Aussage zur Nutzung von Kundendaten für das Modelltraining.
Ja, innerhalb von Grenzen. Der Free-Plan bietet 1.000 Credits im Monat ohne Karte, und der Zugang ohne Schlüssel funktioniert für search, scrape und interact unter täglichen Obergrenzen pro IP. Bezahlte Pläne beginnen bei 19 $ im Monat bzw. 16 $ im Monat bei jährlicher Abrechnung.
Standardmäßig ja. robots.txt zu ignorieren ist eine reine Enterprise-Option, und das Projekt legt die Verantwortung für die Einhaltung der Richtlinien jeder Website in die Hände der Nutzer.
Der standardmäßige selbst gehostete Stack enthält weder Agent, Browser, Interact, das Dashboard, Enterprise-Kontrollen, Screenshots noch Seitenaktionen. LLM-gestützte Extraktion braucht einen eigenen OpenAI-kompatiblen Anbieter oder Ollama.
Free-Konten erhalten bis zum monatlichen Reset HTTP-402-Fehler. In bezahlten Plänen mit aktiviertem Pay-as-you-go kauft Firecrawl automatisch weitere Credits bis zu Ihrem Monatslimit; ist es deaktiviert, geben Anfragen ebenfalls 402 zurück.