
Firecrawl convierte resultados de búsqueda, páginas sueltas y sitios completos en Markdown limpio o JSON con la forma de un esquema para agentes de IA y canalizaciones RAG, con un núcleo de código abierto bajo AGPL y una nube gestionada que añade interacción con el navegador y controles empresariales.
¿Has usado esta herramienta? Valórala
¿Has usado esta herramienta? Valórala
Firecrawl es una API de web scraping que busca en la web, extrae páginas sueltas o sitios completos y opera páginas, y devuelve Markdown limpio o JSON estructurado que las aplicaciones de IA pueden consumir. La empresa lo resume como una sola API para convertir sitios web en datos limpios y listos para LLM.
El servicio lo opera SideGuide Technologies, Inc., una sociedad de Delaware que opera con el nombre comercial Firecrawl. La prensa tecnológica independiente lo describe como un rastreador web de código abierto popular entre desarrolladores y agentes de IA, con una versión con soporte comercial vendida mediante una API.
Esa división entre código abierto y servicio alojado condiciona la mayoría de las decisiones de compra. El repositorio de código abierto tiene licencia principalmente AGPL-3.0, mientras que los SDK y algunos componentes de interfaz usan la licencia MIT. La versión alojada funciona sobre Fire-engine, que la empresa llama su infraestructura propietaria para proxies, renderizado y más. En su sitio, Firecrawl afirma que más de 1,25 millones de desarrolladores y más de 150.000 empresas construyen con él, entre ellos equipos de Apple, Canva y Lovable (captura del 28 de septiembre de 2026). Sus tres cofundadores crearon la empresa en 2022. El 22 de septiembre de 2026, Firecrawl anunció una Serie B de 75 millones de dólares liderada por Smash Capital.
El límite de rastreo es de 10000 páginas por defecto, así que el rastreo de un sitio grande se detiene en esa cifra salvo que se cambie el límite.
Las salidas de Scrape incluyen Markdown, resumen, HTML limpio, HTML sin procesar, capturas de pantalla, enlaces, JSON, URL de imágenes, elementos de marca, fichas de producto, audio o vídeo de URL de vídeo compatibles y un formato de consulta en lenguaje natural. Al pasar un esquema JSON a /scrape, los datos vuelven exactamente con esa forma, como listados de productos, tablas de precios o datos de contacto, sin un análisis aparte. JavaScript se renderiza automáticamente, así que las aplicaciones de una sola página y los sitios con carga dinámica devuelven su contenido completo. Además de HTML, el servicio analiza archivos PDF y DOCX.
Por defecto, Firecrawl sirve los resultados desde la caché cuando existe una copia de menos de dos días (un maxAge de 172.800.000 ms). Poner maxAge en 0 fuerza una obtención nueva, que según la documentación tarda más y falla con más probabilidad.
Firecrawl informa de una cobertura del 96 % en su propio conjunto de referencia de 1.000 URL, ejecutado el 13 de enero de 2026, con una latencia P95 de 3.387 ms en el mismo conjunto. Son mediciones realizadas y publicadas por la empresa, no pruebas independientes.
La primera puesta en marcha sigue un camino corto, y cada paso desbloquea más de la API:
La empresa cita como usos habituales agentes de investigación profunda, canalizaciones RAG, enriquecimiento de leads, inteligencia competitiva, generación de contenido y seguimiento de precios. Sus casos de clientes publicados vinculan esas categorías con equipos concretos:
Los cuatro ejemplos proceden del propio sitio de Firecrawl. Muestran el patrón que usa cada equipo, no resultados medidos.
La propia guía de Firecrawl plantea la elección en torno a quién gestiona la infraestructura. Recomienda empezar con Firecrawl Cloud, salvo que el acceso al código fuente o el control de la infraestructura compensen el trabajo operativo.
A Firecrawl se accede mediante una API REST, SDK oficiales, una CLI y un servidor MCP, o bien se puede autoalojar.
| Decisión | Código abierto | Firecrawl Cloud |
|---|---|---|
| API principales de scrape, crawl, map y search | Incluidas | Incluidas y gestionadas |
| Extracción y formatos basados en LLM | Conectar un proveedor compatible con OpenAI u Ollama | Ruta de proveedor gestionada |
| Agent, Browser, Interact, panel, controles empresariales | No están en la pila predeterminada | Según producto y plan |
| Uso y facturación | Costes de tu infraestructura y de tus proveedores | Modelo de planes y créditos |
La pila autoalojada predeterminada tiene otra carencia: las capturas de pantalla y las acciones de página no están disponibles, porque ambas requieren Fire-engine.
Los precios de Firecrawl se basan en créditos, y todas las facturas se emiten en USD sea cual sea la dirección de facturación. La tabla combina la lista de planes, que muestra ambas modalidades de facturación, con la comparativa de planes.
| Plan | Créditos al mes | Facturación mensual | Facturación anual | Navegadores simultáneos | Límite de /scrape, /map, /search |
|---|---|---|---|---|---|
| Free | 1.000 | 0 $, sin tarjeta | No disponible | 2 | 10 / min |
| Hobby | 5.000 | 19 $/mes | 16 $/mes | 5 | 100 / min |
| Standard | 100.000 | 99 $/mes | 83 $/mes | 25 | 500 / min |
| Growth | 500.000 | 399 $/mes | 333 $/mes | 50 | 5.000 / min |
| Scale | 1.000.000 | 749 $/mes | 599 $/mes | 100 | 10.000 / min |
| Enterprise | A medida | A medida | A medida | A medida | A medida |
Los planes anuales se facturan una vez al año, pero los créditos se siguen restableciendo cada mes en una fecha de renovación mensual virtual. Los endpoints /crawl y /agent tienen un límite aparte y más bajo, desde 2 solicitudes por minuto en Free hasta 2.000 en Scale. Los endpoints de batch scrape comparten el límite de crawl. El pago se procesa con Stripe, que acepta la mayoría de las principales tarjetas de crédito y débito y PayPal.
Scrape, Crawl, Map y Monitor cuestan 1 crédito por página, y Search cuesta 2 créditos por cada 10 resultados. Search redondea hacia arriba por cada 10 resultados, así que 11 resultados cuestan 4 créditos. Las opciones de Scrape se suman a la tarifa base: la extracción JSON añade 4 créditos por página, y una página extraída con formato JSON y Zero Data Retention a la vez cuesta 6 créditos. Agent está en versión preliminar con 5 ejecuciones gratuitas al día y precios dinámicos después.
Dos tarifas unitarias difieren entre páginas. La página de precios indica Interact a 2 créditos por minuto de navegador. La documentación de facturación dice que las sesiones que usan un prompt se cobran a 7 créditos por minuto de navegador y las sesiones solo de código a 2. También indica Map a 1 crédito por llamada y no por página.
Las reglas de traspaso entran en conflicto entre páginas oficiales. La página de precios dice que Scale traspasa los créditos no usados durante un mes y Enterprise una cantidad a medida, sin traspaso en Hobby, Standard ni Growth. La documentación de facturación dice en cambio que los planes Scale anuales traspasan los créditos del plan no usados 1 mes y los planes Enterprise anuales 2 meses.
En debates de la comunidad de desarrolladores, Firecrawl se menciona junto a Tavily, Exa, Perplexity y Linkup como herramienta para que los agentes busquen en la web.
Firecrawl publica páginas comparativas frente a muchas de estas herramientas, pero las escribe Firecrawl y defienden su propio producto.
Zero Data Retention, que no conserva contenido de página ni datos extraídos más allá de la duración de la solicitud, solo está disponible en los planes Enterprise y añade 1 crédito por página. Las capturas de pantalla no están disponibles en modo ZDR. Fuera de ZDR, poner storeInCache en false impide que Firecrawl almacene en caché los resultados de una solicitud. Todos los planes indican SOC 2 Type II, pruebas de penetración, autenticación multifactor y ocultación de PII. Un acuerdo de tratamiento de datos figura a partir del plan Standard. La política de privacidad dice que la información personal se conserva hasta que solicites su eliminación por escrito. En la política de privacidad y los términos revisados no se encontró ninguna declaración sobre el uso de datos de clientes para entrenar modelos.
Sí, dentro de unos límites. El plan Free da 1.000 créditos al mes sin tarjeta, y el acceso sin clave funciona para search, scrape e interact con topes diarios por IP. Los planes de pago empiezan en 19 $ al mes, o 16 $ al mes con facturación anual.
Por defecto, sí. Ignorar el robots.txt es una opción exclusiva de Enterprise, y el proyecto deja en manos del usuario la responsabilidad de cumplir las políticas de cada sitio web.
La pila autoalojada predeterminada no incluye Agent, Browser, Interact, panel, controles empresariales, capturas de pantalla ni acciones de página. La extracción basada en LLM requiere tu propio proveedor compatible con OpenAI u Ollama.
Las cuentas Free reciben errores HTTP 402 hasta el restablecimiento mensual. En los planes de pago con el pago por uso activado, Firecrawl compra más créditos automáticamente hasta tu límite mensual; si está desactivado, las solicitudes también devuelven 402.