
Firecrawl transforme résultats de recherche, pages isolées et sites entiers en Markdown propre ou en JSON structuré selon un schéma pour les agents d’IA et les pipelines RAG, avec un cœur open source sous licence AGPL et un cloud géré qui ajoute l’interaction navigateur et des contrôles entreprise.
Vous avez utilisé cet outil ? Notez-le
Vous avez utilisé cet outil ? Notez-le
Firecrawl est une API de web scraping qui cherche sur le web, extrait une page ou un site entier et manipule des pages, puis renvoie du Markdown propre ou du JSON structuré exploitable par les applications d’IA. L’entreprise la résume comme une seule API pour transformer des sites web en données propres, prêtes pour les LLM.
Le service est exploité par SideGuide Technologies, Inc., une société du Delaware qui opère sous le nom de Firecrawl. La presse tech indépendante le décrit comme un crawler web open source populaire pour les développeurs et les agents d’IA, avec une version à support commercial vendue via une API.
Ce partage entre code ouvert et service hébergé oriente la plupart des décisions d’achat. Le dépôt open source est principalement sous licence AGPL-3.0, tandis que les SDK et certains composants d’interface utilisent la licence MIT. La version hébergée tourne sur Fire-engine, que l’entreprise présente comme son infrastructure propriétaire pour les proxys, le rendu et plus encore. Sur son site, Firecrawl affirme que plus de 1,25 million de développeurs et plus de 150 000 entreprises construisent avec l’outil, dont des équipes d’Apple, de Canva et de Lovable (relevé du 28 septembre 2026). Ses trois cofondateurs ont créé l’entreprise en 2022. Le 22 septembre 2026, Firecrawl a annoncé une levée de série B de 75 millions de dollars menée par Smash Capital.
La limite de crawl est de 10000 pages par défaut : le crawl d’un grand site s’arrête donc à ce nombre, sauf si la limite est modifiée.
Les sorties de Scrape comprennent Markdown, résumé, HTML nettoyé, HTML brut, captures d’écran, liens, JSON, URL d’images, éléments de marque, fiches produits, audio ou vidéo provenant d’URL vidéo prises en charge, ainsi qu’un format de requête en langage naturel. Transmettre un schéma JSON à /scrape renvoie des données exactement sous cette forme, par exemple des listes de produits, des grilles tarifaires ou des coordonnées, sans analyse séparée. Le JavaScript est rendu automatiquement, de sorte que les applications monopages et les sites chargés dynamiquement renvoient leur contenu complet. Au-delà du HTML, le service analyse les fichiers PDF et DOCX.
Par défaut, Firecrawl sert les résultats depuis le cache dès qu’il existe une copie de moins de deux jours (un maxAge de 172 800 000 ms). Régler maxAge sur 0 force une nouvelle récupération, ce qui, selon la documentation, prend plus de temps et risque davantage d’échouer.
Firecrawl annonce une couverture de 96 % sur son propre jeu de test de 1 000 URL, exécuté le 13 janvier 2026, avec une latence P95 de 3 387 ms sur ce même ensemble. Ce sont des mesures réalisées et publiées par l’entreprise, pas des tests indépendants.
Une première mise en route suit un chemin court, et chaque étape ouvre davantage l’API :
L’entreprise cite comme usages courants les agents de recherche approfondie, les pipelines RAG, l’enrichissement de leads, la veille concurrentielle, la génération de contenu et le suivi des prix. Ses témoignages clients publiés associent ces catégories à des équipes nommées :
Ces quatre exemples proviennent tous du site de Firecrawl. Ils montrent le schéma d’usage de chaque équipe, pas des résultats mesurés.
Les recommandations de Firecrawl organisent le choix autour de qui exploite l’infrastructure. Elles conseillent de commencer par Firecrawl Cloud, sauf si l’accès au code source ou le contrôle de l’infrastructure justifie la charge d’exploitation.
Firecrawl s’utilise via une API REST, des SDK officiels, une CLI et un serveur MCP, ou peut être auto-hébergé.
| Décision | Open source | Firecrawl Cloud |
|---|---|---|
| API principales scrape, crawl, map et search | Incluses | Incluses et gérées |
| Extraction et formats reposant sur un LLM | Brancher un fournisseur compatible OpenAI ou Ollama | Chemin fournisseur géré |
| Agent, Browser, Interact, tableau de bord, contrôles entreprise | Absents de la pile par défaut | Selon le produit et l’offre |
| Usage et facturation | Coûts de votre infrastructure et de vos fournisseurs | Modèle d’offres et de crédits |
La pile auto-hébergée par défaut présente un autre manque : captures d’écran et actions sur la page sont indisponibles, car toutes deux nécessitent Fire-engine.
Les tarifs de Firecrawl reposent sur des crédits, et toutes les factures sont émises en USD quelle que soit l’adresse de facturation. Le tableau combine la liste des offres, qui affiche les deux modes de facturation, et le comparatif des offres.
| Offre | Crédits par mois | Facturation mensuelle | Facturation annuelle | Navigateurs simultanés | Limite de débit /scrape, /map, /search |
|---|---|---|---|---|---|
| Free | 1 000 | 0 $, sans carte | Non proposée | 2 | 10 / min |
| Hobby | 5 000 | 19 $/mois | 16 $/mois | 5 | 100 / min |
| Standard | 100 000 | 99 $/mois | 83 $/mois | 25 | 500 / min |
| Growth | 500 000 | 399 $/mois | 333 $/mois | 50 | 5 000 / min |
| Scale | 1 000 000 | 749 $/mois | 599 $/mois | 100 | 10 000 / min |
| Enterprise | Sur mesure | Sur mesure | Sur mesure | Sur mesure | Sur mesure |
Les offres annuelles sont facturées une fois par an, mais les crédits se réinitialisent quand même chaque mois à une date de renouvellement mensuelle virtuelle. Les endpoints /crawl et /agent ont une limite distincte et plus basse, de 2 requêtes par minute sur Free à 2 000 sur Scale. Les endpoints de batch scrape partagent la limite de crawl. Le paiement passe par Stripe, qui accepte la plupart des grandes cartes de crédit et de débit ainsi que PayPal.
Scrape, Crawl, Map et Monitor coûtent 1 crédit par page, et Search 2 crédits pour 10 résultats. Search arrondit au multiple de 10 résultats supérieur : 11 résultats coûtent donc 4 crédits. Les options de Scrape s’additionnent au tarif de base : l’extraction JSON ajoute 4 crédits par page, et une page extraite à la fois au format JSON et avec Zero Data Retention coûte 6 crédits. Agent est en préversion, avec 5 exécutions gratuites par jour, puis une tarification dynamique.
Deux tarifs unitaires diffèrent d’une page à l’autre. La page de tarifs indique Interact à 2 crédits par minute de navigateur. La documentation de facturation précise que les sessions utilisant un prompt sont facturées 7 crédits par minute de navigateur, et les sessions uniquement en code 2. Elle indique aussi Map à 1 crédit par appel plutôt que par page.
Les règles de report se contredisent selon les pages officielles. La page de tarifs indique que Scale reporte les crédits inutilisés pendant un mois et qu’Enterprise reporte un volume sur mesure, sans report sur Hobby, Standard ni Growth. La documentation de facturation indique au contraire que les offres Scale annuelles reportent les crédits d’offre inutilisés sur 1 mois et les offres Enterprise annuelles sur 2 mois.
Dans les discussions de la communauté des développeurs, Firecrawl est cité aux côtés de Tavily, Exa, Perplexity et Linkup comme outil de recherche web pour les agents.
Firecrawl publie des pages comparatives face à nombre de ces outils, mais elles sont rédigées par Firecrawl et plaident pour son propre produit.
Zero Data Retention, qui ne conserve aucun contenu de page ni aucune donnée extraite au-delà de la durée de la requête, n’est disponible que sur les offres Enterprise et ajoute 1 crédit par page. Les captures d’écran ne sont pas disponibles en mode ZDR. En dehors de ZDR, régler storeInCache sur false empêche Firecrawl de mettre en cache les résultats d’une requête. Toutes les offres mentionnent SOC 2 Type II, des tests d’intrusion, l’authentification multifacteur et le masquage des PII. Un accord de traitement des données figure à partir de l’offre Standard. La politique de confidentialité indique que les informations personnelles sont conservées jusqu’à ce que vous en demandiez la suppression par écrit. Dans la politique de confidentialité et les conditions examinées, aucune mention de l’utilisation des données clients pour entraîner des modèles n’a été trouvée.
Oui, dans certaines limites. L’offre Free donne 1 000 crédits par mois sans carte, et l’accès sans clé fonctionne pour search, scrape et interact sous des plafonds quotidiens par IP. Les offres payantes commencent à 19 $ par mois, ou 16 $ par mois en facturation annuelle.
Oui, par défaut. Ignorer le robots.txt est une option réservée à Enterprise, et le projet fait peser sur l’utilisateur la responsabilité de respecter les politiques de chaque site.
La pile auto-hébergée par défaut n’inclut pas Agent, Browser, Interact, le tableau de bord, les contrôles entreprise, les captures d’écran ni les actions sur la page. L’extraction reposant sur un LLM nécessite votre propre fournisseur compatible OpenAI ou Ollama.
Les comptes Free reçoivent des erreurs HTTP 402 jusqu’à la réinitialisation mensuelle. Sur les offres payantes avec le paiement à l’usage activé, Firecrawl achète automatiquement des crédits supplémentaires jusqu’à votre limite mensuelle ; s’il est désactivé, les requêtes renvoient aussi 402.