Toolso.AI
Toolso.AI
OutilsCatégoriesTendancesNouveautésTarifsBlog
Toolso.AI
Toolso.AI

💌Abonnez-vous à AI Tools Weekly

Sélection hebdomadaire des derniers et meilleurs outils IA et tendances, livrés dans votre boîte mail S'abonner

Toolso.AI
Toolso.AI

Découvrez les meilleurs outils IA pour booster votre productivité

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

Catégories populaires

  • Écriture IA
  • Image IA
  • Vidéo IA
  • Codage IA
  • Plus de catégories

Explorer

  • Derniers outils
  • Outils populaires
  • Plus d'outils
  • Soumettre un outil
  • Tarifs

À propos

  • À propos de nous
  • Contact
  • Blog
  • Journal des modifications

Légal

  • Politique des cookies
  • Politique de confidentialité
  • Conditions d'utilisation
  • Politique de remboursement
© 2026 Toolso.AI Tous droits réservés
Offre limitéeOffre limitéeMise en avantExamen sous 24 h · Sans backlink · 30 jours en vedette$29.90puis $59.90Passe à $59.90 après le 31 oct.Fin dans--:--:--Soumettre
  1. Accueil
  2. Tous les outils
  3. Outils de développement
  4. Firecrawl
Aperçu de l’interface de Firecrawl
Logo de Firecrawl

Firecrawl

Firecrawl transforme résultats de recherche, pages isolées et sites entiers en Markdown propre ou en JSON structuré selon un schéma pour les agents d’IA et les pipelines RAG, avec un cœur open source sous licence AGPL et un cloud géré qui ajoute l’interaction navigateur et des contrôles entreprise.

Outils de développementAgent IA#Open source#API#Web scraping
Essayer gratuitement
Favoris
Visites
Vues
Tarif
Gratuit
Publié le
28 sept. 2026
Domaine
firecrawl.dev
Note des utilisateurs

Vous avez utilisé cet outil ? Notez-le

Noter cet outil

Informations produit Firecrawl

Essayer gratuitement
Informations sur l'outil
Favoris
Visites
Vues
Tarif
Gratuit
Publié le
28 sept. 2026
Domaine
firecrawl.dev
Note des utilisateurs

Vous avez utilisé cet outil ? Notez-le

Noter cet outil

Outils en vedette

Outils associés

Essayer gratuitement

Firecrawl, qu’est-ce que c’est ?

Firecrawl est une API de web scraping qui cherche sur le web, extrait une page ou un site entier et manipule des pages, puis renvoie du Markdown propre ou du JSON structuré exploitable par les applications d’IA. L’entreprise la résume comme une seule API pour transformer des sites web en données propres, prêtes pour les LLM.

Le service est exploité par SideGuide Technologies, Inc., une société du Delaware qui opère sous le nom de Firecrawl. La presse tech indépendante le décrit comme un crawler web open source populaire pour les développeurs et les agents d’IA, avec une version à support commercial vendue via une API.

Ce partage entre code ouvert et service hébergé oriente la plupart des décisions d’achat. Le dépôt open source est principalement sous licence AGPL-3.0, tandis que les SDK et certains composants d’interface utilisent la licence MIT. La version hébergée tourne sur Fire-engine, que l’entreprise présente comme son infrastructure propriétaire pour les proxys, le rendu et plus encore. Sur son site, Firecrawl affirme que plus de 1,25 million de développeurs et plus de 150 000 entreprises construisent avec l’outil, dont des équipes d’Apple, de Canva et de Lovable (relevé du 28 septembre 2026). Ses trois cofondateurs ont créé l’entreprise en 2022. Le 22 septembre 2026, Firecrawl a annoncé une levée de série B de 75 millions de dollars menée par Smash Capital.

Fonctionnalités principales

Endpoints

  • Search : envoyez une requête et recevez des résultats web qui incluent déjà le Markdown de la page entière, si bien qu’une question n’exige pas d’étape séparée de recherche puis d’extraction.
  • Sources de recherche : un seul appel peut mélanger résultats web, actualités et images, et le paramètre limit s’applique alors à chaque type de source plutôt qu’à la liste combinée.
  • Catégories de recherche : un filtre categories peut limiter les résultats aux sites universitaires et de recherche, aux PDF, ou à un index pour développeurs composé d’issues, de pull requests fusionnées et de README issus de dépôts de code publics. La catégorie research doit passer à un index d’articles scientifiques le 16 novembre 2026.
  • Scrape : donnez une URL à Firecrawl et il renvoie du Markdown, du HTML, des captures d’écran, des métadonnées ou des données extraites au moyen d’un schéma.
  • Crawl : à partir d’une URL, il découvre et extrait récursivement toutes les sous-pages accessibles, repérées via le sitemap et le parcours des liens.
  • Map : découvre les URL d’un site sans en extraire le contenu, utile pour délimiter un crawl.
  • Interact : clique sur des boutons, remplit des formulaires et parcourt des flux en plusieurs étapes, pour des données situées derrière une connexion, une pagination ou une suite d’actions qu’une extraction simple n’atteint pas.

La limite de crawl est de 10000 pages par défaut : le crawl d’un grand site s’arrête donc à ce nombre, sauf si la limite est modifiée.

Formats de sortie et extraction

Les sorties de Scrape comprennent Markdown, résumé, HTML nettoyé, HTML brut, captures d’écran, liens, JSON, URL d’images, éléments de marque, fiches produits, audio ou vidéo provenant d’URL vidéo prises en charge, ainsi qu’un format de requête en langage naturel. Transmettre un schéma JSON à /scrape renvoie des données exactement sous cette forme, par exemple des listes de produits, des grilles tarifaires ou des coordonnées, sans analyse séparée. Le JavaScript est rendu automatiquement, de sorte que les applications monopages et les sites chargés dynamiquement renvoient leur contenu complet. Au-delà du HTML, le service analyse les fichiers PDF et DOCX.

Cache et fraîcheur

Par défaut, Firecrawl sert les résultats depuis le cache dès qu’il existe une copie de moins de deux jours (un maxAge de 172 800 000 ms). Régler maxAge sur 0 force une nouvelle récupération, ce qui, selon la documentation, prend plus de temps et risque davantage d’échouer.

Performances déclarées par l’éditeur

Firecrawl annonce une couverture de 96 % sur son propre jeu de test de 1 000 URL, exécuté le 13 janvier 2026, avec une latence P95 de 3 387 ms sur ce même ensemble. Ce sont des mesures réalisées et publiées par l’entreprise, pas des tests indépendants.

Guide

Une première mise en route suit un chemin court, et chaque étape ouvre davantage l’API :

  1. Commencez sans clé. L’usage sans clé est gratuit mais plafonné par adresse IP et par jour, par une limite de requêtes et une limite de crédits ; les opérations plus lourdes, comme Interact ou l’extraction JSON, atteignent plus vite le plafond de crédits.
  2. Ajoutez une clé API dès que vous avez besoin de crawl, map, batch scrape ou extract, car aucun autre endpoint (crawl, extract, map, batch scrape, etc.) n’est disponible sans clé.
  3. Connectez un agent de codage en une commande : npx -y firecrawl-cli@latest init --all --browser. Le site indique que cela donne leurs outils web à Cursor, Claude Code, Windsurf et d’autres.
  4. Récupérez la sortie du crawl via l’API : les résultats d’une tâche restent disponibles via l’API pendant 24 heures après la fin, puis l’historique des crawls reste visible dans les journaux d’activité du tableau de bord.
  5. Consultez l’endpoint crawl errors pour repérer les manques : robotsBlocked y liste les URL tentées mais bloquées par le robots.txt du site.

Cas d’usage et exemples de Firecrawl

L’entreprise cite comme usages courants les agents de recherche approfondie, les pipelines RAG, l’enrichissement de leads, la veille concurrentielle, la génération de contenu et le suivi des prix. Ses témoignages clients publiés associent ces catégories à des équipes nommées :

  • Bases de connaissances pour le chat : Sierra utilise Firecrawl pour ingérer des données web dans des bases de connaissances qui alimentent des applications de chat IA.
  • Enrichissement de leads : Cognism enrichit des profils de leads à partir de tout le web avec Firecrawl.
  • Onboarding produit : Gamma permet aux utilisateurs de créer des contenus à partir de données web avec Firecrawl pendant l’onboarding.
  • Recherche par agent : Aemon alimente la recherche web de son agent de R&D en IA avec la recherche et l’extraction de Firecrawl.

Ces quatre exemples proviennent tous du site de Firecrawl. Ils montrent le schéma d’usage de chaque équipe, pas des résultats mesurés.

Pour qui

Les recommandations de Firecrawl organisent le choix autour de qui exploite l’infrastructure. Elles conseillent de commencer par Firecrawl Cloud, sauf si l’accès au code source ou le contrôle de l’infrastructure justifie la charge d’exploitation.

  • Développeurs IA et RAG qui veulent un service géré : Cloud regroupe clés API, crédits, limites et support opérationnel dans un seul compte, et c’est le seul endroit où sont fournis Agent, Browser, les tableaux de bord gérés, les chemins de proxy renforcés et les contrôles entreprise.
  • Équipes qui ont besoin de contrôler le code ou l’infrastructure : l’auto-hébergement permet d’inspecter le code et de choisir où tourne la pile, mais votre équipe prend en charge l’authentification, le TLS, la persistance, la supervision, la capacité, les mises à niveau et la reprise.
  • Organisations réglementées ou sensibles à la sécurité : l’authentification unique et le provisionnement SCIM sont réservés à Enterprise. Les restrictions de clés API, les restrictions IP des clés API et les IP de sortie statiques sont aussi limitées à Enterprise.
  • Projets personnels : l’offre Hobby vise les projets personnels et les petits outils, avec 5 requêtes simultanées.

Plateformes

Firecrawl s’utilise via une API REST, des SDK officiels, une CLI et un serveur MCP, ou peut être auto-hébergé.

  • SDK : les bibliothèques officielles couvrent Python (synchrone et asynchrone), Node.js et TypeScript, Go, Java, Ruby, Rust, .NET, PHP et Elixir, ainsi qu’un outil en ligne de commande.
  • MCP et outils pour agents : un serveur MCP officiel permet aux agents de Cursor, Claude, Windsurf et d’autres outils compatibles MCP de rechercher, d’extraire et d’interagir directement, et des compétences d’agent pour Claude Code et Codex se chargent de la configuration.
  • Options de connexion MCP : le chemin MCP sans clé propose Search, Scrape et Parse dans des limites quotidiennes, sans compte ni clé, tandis que la connexion par navigateur et les clés API donnent accès à l’ensemble des outils selon l’offre de votre équipe.
  • Auto-hébergement : un guide Docker Compose mène d’une version figée à une extraction vérifiée.
DécisionOpen sourceFirecrawl Cloud
API principales scrape, crawl, map et searchInclusesIncluses et gérées
Extraction et formats reposant sur un LLMBrancher un fournisseur compatible OpenAI ou OllamaChemin fournisseur géré
Agent, Browser, Interact, tableau de bord, contrôles entrepriseAbsents de la pile par défautSelon le produit et l’offre
Usage et facturationCoûts de votre infrastructure et de vos fournisseursModèle d’offres et de crédits

La pile auto-hébergée par défaut présente un autre manque : captures d’écran et actions sur la page sont indisponibles, car toutes deux nécessitent Fire-engine.

Tarification

Les tarifs de Firecrawl reposent sur des crédits, et toutes les factures sont émises en USD quelle que soit l’adresse de facturation. Le tableau combine la liste des offres, qui affiche les deux modes de facturation, et le comparatif des offres.

OffreCrédits par moisFacturation mensuelleFacturation annuelleNavigateurs simultanésLimite de débit /scrape, /map, /search
Free1 0000 $, sans carteNon proposée210 / min
Hobby5 00019 $/mois16 $/mois5100 / min
Standard100 00099 $/mois83 $/mois25500 / min
Growth500 000399 $/mois333 $/mois505 000 / min
Scale1 000 000749 $/mois599 $/mois10010 000 / min
EnterpriseSur mesureSur mesureSur mesureSur mesureSur mesure

Les offres annuelles sont facturées une fois par an, mais les crédits se réinitialisent quand même chaque mois à une date de renouvellement mensuelle virtuelle. Les endpoints /crawl et /agent ont une limite distincte et plus basse, de 2 requêtes par minute sur Free à 2 000 sur Scale. Les endpoints de batch scrape partagent la limite de crawl. Le paiement passe par Stripe, qui accepte la plupart des grandes cartes de crédit et de débit ainsi que PayPal.

Ce qu’achète un crédit

Scrape, Crawl, Map et Monitor coûtent 1 crédit par page, et Search 2 crédits pour 10 résultats. Search arrondit au multiple de 10 résultats supérieur : 11 résultats coûtent donc 4 crédits. Les options de Scrape s’additionnent au tarif de base : l’extraction JSON ajoute 4 crédits par page, et une page extraite à la fois au format JSON et avec Zero Data Retention coûte 6 crédits. Agent est en préversion, avec 5 exécutions gratuites par jour, puis une tarification dynamique.

Deux tarifs unitaires diffèrent d’une page à l’autre. La page de tarifs indique Interact à 2 crédits par minute de navigateur. La documentation de facturation précise que les sessions utilisant un prompt sont facturées 7 crédits par minute de navigateur, et les sessions uniquement en code 2. Elle indique aussi Map à 1 crédit par appel plutôt que par page.

Recharges, report et remboursements

  • Paiement à l’usage : sur les offres payantes, chaque recharge automatique coûte 5 USD et ajoute 1 000 crédits sur Hobby, 2 000 sur Standard, 2 500 sur Growth ou 5 000 sur Scale, jusqu’à une limite mensuelle que vous fixez.
  • Tolérance de dépassement : tant que le paiement à l’usage est activé, les requêtes continuent brièvement au-delà de zéro grâce à une marge de 1 500 crédits sur Hobby, 30 000 sur Standard, 150 000 sur Growth et 600 000 sur Scale, après quoi elles renvoient une erreur HTTP 402.
  • Crédits achetés : les crédits achetés restent disponibles jusqu’à leur utilisation, mais expirent si vous résiliez votre abonnement.
  • Épuisement : sur Free, les requêtes qui consomment des crédits renvoient HTTP 402 jusqu’à la réinitialisation mensuelle.
  • Requêtes en échec : une extraction qui ne renvoie aucun résultat n’est pas facturée, mais une page qui répond par une erreur comme 403 ou 404 coûte tout de même 1 crédit.
  • Changements d’offre : les montées en gamme facturent immédiatement le prix complet de la nouvelle offre, sans prorata.
  • Rétrogradations : elles attendent le prochain renouvellement, et le temps non utilisé n’est ni crédité ni remboursé.
  • Remboursements : les conditions d’utilisation indiquent que Firecrawl n’accorde aucun remboursement, pour quelque raison que ce soit, mais vous pouvez résilier à tout moment et stopper les prélèvements futurs.

Les règles de report se contredisent selon les pages officielles. La page de tarifs indique que Scale reporte les crédits inutilisés pendant un mois et qu’Enterprise reporte un volume sur mesure, sans report sur Hobby, Standard ni Growth. La documentation de facturation indique au contraire que les offres Scale annuelles reportent les crédits d’offre inutilisés sur 1 mois et les offres Enterprise annuelles sur 2 mois.

Alternatives à Firecrawl

Dans les discussions de la communauté des développeurs, Firecrawl est cité aux côtés de Tavily, Exa, Perplexity et Linkup comme outil de recherche web pour les agents.

  • Crawl4AI : ses mainteneurs expliquent que l’on peut faire tourner soi-même ce crawler open source gratuitement pour toujours, ou l’utiliser en version hébergée avec une seule clé. Le projet est publié sous Apache License 2.0, une alternative permissive au cœur de Firecrawl sous licence AGPL.
  • Tavily : l’entreprise décrit Tavily comme un moteur de recherche en temps réel pour les agents d’IA, avec des API de recherche web et d’extraction de contenu. Il convient aux charges de travail qui partent d’une question plutôt que d’URL connues.
  • Apify : l’entreprise affirme proposer des milliers d’outils pour obtenir des données web en temps réel, suivre ses concurrents, générer des leads et intégrer des applications et des agents d’IA. Cela en fait un catalogue d’automatisation plus large qu’une simple API de scraping.
  • Firecrawl auto-hébergé : les mêmes API principales, payées via votre propre infrastructure et vos coûts de fournisseurs plutôt qu’en crédits, sans les fonctionnalités réservées à Cloud.

Firecrawl publie des pages comparatives face à nombre de ces outils, mais elles sont rédigées par Firecrawl et plaident pour son propre produit.

Limitations

Règles de scraping et responsabilité

  • robots.txt : le robots.txt est respecté sauf si ignoreRobotsTxt est activé, et ce contournement est réservé à Enterprise.
  • Identité du crawler : l’endpoint crawl respecte aussi les règles robots.txt définies pour la directive 'FirecrawlAgent'.
  • Responsabilité de l’utilisateur : le README du projet indique qu’il incombe aux seuls utilisateurs finaux de respecter les politiques des sites web lors du scraping.
  • Sources payantes : l’entreprise dit rémunérer déjà des fournisseurs de données officiels dans le cadre d’accords individuels, notamment Wikimedia Enterprise.
  • Usages interdits : les conditions excluent les vérifications d’antécédents approfondies, la décision d’éligibilité à une licence délivrée par l’État et toute finalité interdite par les lois sur la protection des données, dont le RGPD ou le CCPA.

Limites opérationnelles

  • Limites de débit et files d’attente : les limites de débit comme les limites de concurrence sont fixées par offre, et dépasser l’une ou l’autre renvoie une réponse 429.
  • Compteurs partagés : les limites de débit s’appliquent par équipe, si bien que toutes les clés API d’une même équipe puisent dans les mêmes compteurs.
  • Fichiers éphémères : les URL des captures d’écran expirent au bout de 24 heures.
  • Démarrage rapide auto-hébergé : le démarrage rapide documenté pour réseau de confiance désactive l’authentification de l’API et ne constitue pas une architecture de production.

Confidentialité et traitement des données

Zero Data Retention, qui ne conserve aucun contenu de page ni aucune donnée extraite au-delà de la durée de la requête, n’est disponible que sur les offres Enterprise et ajoute 1 crédit par page. Les captures d’écran ne sont pas disponibles en mode ZDR. En dehors de ZDR, régler storeInCache sur false empêche Firecrawl de mettre en cache les résultats d’une requête. Toutes les offres mentionnent SOC 2 Type II, des tests d’intrusion, l’authentification multifacteur et le masquage des PII. Un accord de traitement des données figure à partir de l’offre Standard. La politique de confidentialité indique que les informations personnelles sont conservées jusqu’à ce que vous en demandiez la suppression par écrit. Dans la politique de confidentialité et les conditions examinées, aucune mention de l’utilisation des données clients pour entraîner des modèles n’a été trouvée.

FAQ

Q1. Firecrawl est-il gratuit ?

Oui, dans certaines limites. L’offre Free donne 1 000 crédits par mois sans carte, et l’accès sans clé fonctionne pour search, scrape et interact sous des plafonds quotidiens par IP. Les offres payantes commencent à 19 $ par mois, ou 16 $ par mois en facturation annuelle.

Q2. Firecrawl respecte-t-il le robots.txt ?

Oui, par défaut. Ignorer le robots.txt est une option réservée à Enterprise, et le projet fait peser sur l’utilisateur la responsabilité de respecter les politiques de chaque site.

Q3. Que laisse de côté la version open source ?

La pile auto-hébergée par défaut n’inclut pas Agent, Browser, Interact, le tableau de bord, les contrôles entreprise, les captures d’écran ni les actions sur la page. L’extraction reposant sur un LLM nécessite votre propre fournisseur compatible OpenAI ou Ollama.

Q4. Que se passe-t-il quand mes crédits sont épuisés ?

Les comptes Free reçoivent des erreurs HTTP 402 jusqu’à la réinitialisation mensuelle. Sur les offres payantes avec le paiement à l’usage activé, Firecrawl achète automatiquement des crédits supplémentaires jusqu’à votre limite mensuelle ; s’il est désactivé, les requêtes renvoient aussi 402.

Connaissez-vous un outil similaire ?
Si vous connaissez d'autres excellents outils IA, n'hésitez pas à nous les soumettre