Toolso.AI
Toolso.AI
HerramientasCategoríasTendenciasNovedadesPreciosBlog
Toolso.AI
Toolso.AI

💌Suscríbete a AI Tools Weekly

Selección semanal curada de las últimas y más populares herramientas de IA y tendencias, entregadas en tu bandeja de entrada Suscribirse

Toolso.AI
Toolso.AI

Descubre las mejores herramientas de IA para aumentar tu productividad

GitHubGitHubTwitterX (Twitter)YouTubeYouTubeTikTokEmail

Categorías populares

  • Escritura con IA
  • Imágenes con IA
  • Video con IA
  • Programación con IA
  • Más categorías

Explorar

  • Herramientas más recientes
  • Herramientas populares
  • Más herramientas
  • Enviar herramienta
  • Precios

Acerca de

  • Acerca de nosotros
  • Contacto
  • Blog
  • Registro de cambios

Legal

  • Política de cookies
  • Política de privacidad
  • Términos de servicio
  • Política de reembolso
© 2026 Toolso.AI Todos los derechos reservados
Oferta limitadaOferta por tiempo limitadoListado destacadoRevisión en 24 h · Sin backlink · 30 días destacado$29.90luego $59.90Sube a $59.90 después del 31 octTermina en--:--:--Enviar ahora
  1. Inicio
  2. Todas las herramientas
  3. Herramientas de desarrollo
  4. Firecrawl
Vista previa de la interfaz de Firecrawl
Logotipo de Firecrawl

Firecrawl

Firecrawl convierte resultados de búsqueda, páginas sueltas y sitios completos en Markdown limpio o JSON con la forma de un esquema para agentes de IA y canalizaciones RAG, con un núcleo de código abierto bajo AGPL y una nube gestionada que añade interacción con el navegador y controles empresariales.

Herramientas de desarrolloAgente de IA#Código abierto#API#Web scraping
Probar gratis
Guardados
Visitas
Vistas
Precio
Gratis
Publicado
28 sept 2026
Dominio
firecrawl.dev
Valoración de usuarios

¿Has usado esta herramienta? Valórala

Valorar esta herramienta

Información del producto Firecrawl

Probar gratis
Información de la herramienta
Guardados
Visitas
Vistas
Precio
Gratis
Publicado
28 sept 2026
Dominio
firecrawl.dev
Valoración de usuarios

¿Has usado esta herramienta? Valórala

Valorar esta herramienta

Herramientas destacadas

Herramientas relacionadas

Probar gratis

¿Qué es Firecrawl?

Firecrawl es una API de web scraping que busca en la web, extrae páginas sueltas o sitios completos y opera páginas, y devuelve Markdown limpio o JSON estructurado que las aplicaciones de IA pueden consumir. La empresa lo resume como una sola API para convertir sitios web en datos limpios y listos para LLM.

El servicio lo opera SideGuide Technologies, Inc., una sociedad de Delaware que opera con el nombre comercial Firecrawl. La prensa tecnológica independiente lo describe como un rastreador web de código abierto popular entre desarrolladores y agentes de IA, con una versión con soporte comercial vendida mediante una API.

Esa división entre código abierto y servicio alojado condiciona la mayoría de las decisiones de compra. El repositorio de código abierto tiene licencia principalmente AGPL-3.0, mientras que los SDK y algunos componentes de interfaz usan la licencia MIT. La versión alojada funciona sobre Fire-engine, que la empresa llama su infraestructura propietaria para proxies, renderizado y más. En su sitio, Firecrawl afirma que más de 1,25 millones de desarrolladores y más de 150.000 empresas construyen con él, entre ellos equipos de Apple, Canva y Lovable (captura del 28 de septiembre de 2026). Sus tres cofundadores crearon la empresa en 2022. El 22 de septiembre de 2026, Firecrawl anunció una Serie B de 75 millones de dólares liderada por Smash Capital.

Funciones principales

Endpoints

  • Search: envías una consulta y recibes resultados web que ya incluyen el Markdown de la página completa, y así una pregunta no requiere un paso aparte de buscar y luego extraer.
  • Fuentes de búsqueda: una sola llamada puede mezclar resultados web, de noticias y de imágenes, y el parámetro limit se aplica entonces por tipo de fuente y no a la lista combinada.
  • Categorías de búsqueda: un filtro categories puede restringir los resultados a sitios académicos y de investigación, a PDF o a un índice para desarrolladores con issues, pull requests fusionados y README de repositorios de código públicos. Está previsto que la categoría research pase a un índice de artículos académicos el 16 de noviembre de 2026.
  • Scrape: das una URL a Firecrawl y devuelve Markdown, HTML, capturas de pantalla, metadatos o datos extraídos mediante un esquema.
  • Crawl: a partir de una URL, descubre y extrae recursivamente todas las subpáginas accesibles, localizadas mediante el sitemap y el recorrido de enlaces.
  • Map: descubre las URL de un sitio sin extraer su contenido, algo útil para acotar un rastreo.
  • Interact: hace clic en botones, rellena formularios y recorre flujos de varios pasos, para datos tras un inicio de sesión, una paginación o una secuencia de acciones a la que una extracción simple no llega.

El límite de rastreo es de 10000 páginas por defecto, así que el rastreo de un sitio grande se detiene en esa cifra salvo que se cambie el límite.

Formatos de salida y extracción

Las salidas de Scrape incluyen Markdown, resumen, HTML limpio, HTML sin procesar, capturas de pantalla, enlaces, JSON, URL de imágenes, elementos de marca, fichas de producto, audio o vídeo de URL de vídeo compatibles y un formato de consulta en lenguaje natural. Al pasar un esquema JSON a /scrape, los datos vuelven exactamente con esa forma, como listados de productos, tablas de precios o datos de contacto, sin un análisis aparte. JavaScript se renderiza automáticamente, así que las aplicaciones de una sola página y los sitios con carga dinámica devuelven su contenido completo. Además de HTML, el servicio analiza archivos PDF y DOCX.

Caché y actualidad

Por defecto, Firecrawl sirve los resultados desde la caché cuando existe una copia de menos de dos días (un maxAge de 172.800.000 ms). Poner maxAge en 0 fuerza una obtención nueva, que según la documentación tarda más y falla con más probabilidad.

Rendimiento declarado por el proveedor

Firecrawl informa de una cobertura del 96 % en su propio conjunto de referencia de 1.000 URL, ejecutado el 13 de enero de 2026, con una latencia P95 de 3.387 ms en el mismo conjunto. Son mediciones realizadas y publicadas por la empresa, no pruebas independientes.

Guía

La primera puesta en marcha sigue un camino corto, y cada paso desbloquea más de la API:

  1. Empieza sin clave. El uso sin clave es gratuito, pero está limitado por dirección IP y por día con un límite de solicitudes y un límite de créditos, y las operaciones más pesadas, como Interact o la extracción JSON, alcanzan antes el tope de créditos.
  2. Añade una clave de API cuando necesites crawl, map, batch scrape o extract, ya que sin clave no hay ningún otro endpoint disponible (crawl, extract, map, batch scrape, etc.).
  3. Conecta un agente de programación con un solo comando: npx -y firecrawl-cli@latest init --all --browser. El sitio dice que así Cursor, Claude Code, Windsurf y otros obtienen sus herramientas web.
  4. Recupera la salida del rastreo mediante la API: los resultados de un trabajo están disponibles por API durante 24 horas tras terminar, y luego el historial de rastreos sigue visible en los registros de actividad del panel.
  5. Revisa el endpoint crawl errors para detectar huecos: ahí robotsBlocked enumera las URL que se intentaron pero que bloqueó el robots.txt del sitio.

Casos de uso y ejemplos de Firecrawl

La empresa cita como usos habituales agentes de investigación profunda, canalizaciones RAG, enriquecimiento de leads, inteligencia competitiva, generación de contenido y seguimiento de precios. Sus casos de clientes publicados vinculan esas categorías con equipos concretos:

  • Bases de conocimiento para chat: Sierra usa Firecrawl para incorporar datos web a bases de conocimiento que impulsan aplicaciones de chat con IA.
  • Enriquecimiento de leads: Cognism enriquece perfiles de leads con información de toda la web mediante Firecrawl.
  • Onboarding de producto: Gamma permite a los usuarios crear contenidos a partir de datos web con Firecrawl durante el onboarding.
  • Investigación de agentes: Aemon impulsa la investigación web de su agente de I+D con IA con la búsqueda y la extracción de Firecrawl.

Los cuatro ejemplos proceden del propio sitio de Firecrawl. Muestran el patrón que usa cada equipo, no resultados medidos.

Para quién es

La propia guía de Firecrawl plantea la elección en torno a quién gestiona la infraestructura. Recomienda empezar con Firecrawl Cloud, salvo que el acceso al código fuente o el control de la infraestructura compensen el trabajo operativo.

  • Desarrolladores de IA y RAG que quieren un servicio gestionado: Cloud reúne claves de API, créditos, límites y soporte operativo en una sola cuenta, y es el único lugar donde se ofrecen Agent, Browser, paneles gestionados, rutas de proxy mejoradas y controles empresariales.
  • Equipos que necesitan controlar el código o la infraestructura: el autoalojamiento permite inspeccionar el código y elegir dónde se ejecuta la pila, pero tu equipo asume autenticación, TLS, persistencia, monitorización, capacidad, actualizaciones y recuperación.
  • Organizaciones reguladas o sensibles a la seguridad: el inicio de sesión único y el aprovisionamiento SCIM son exclusivos de Enterprise. Las restricciones de claves de API, las restricciones de IP de las claves de API y las IP de salida estáticas también se limitan a Enterprise.
  • Proyectos personales: el plan Hobby está pensado para proyectos personales y herramientas pequeñas, con 5 solicitudes simultáneas.

Plataformas

A Firecrawl se accede mediante una API REST, SDK oficiales, una CLI y un servidor MCP, o bien se puede autoalojar.

  • SDK: las bibliotecas oficiales cubren Python (síncrono y asíncrono), Node.js y TypeScript, Go, Java, Ruby, Rust, .NET, PHP y Elixir, además de una herramienta de línea de comandos.
  • MCP y herramientas para agentes: un servidor MCP oficial permite que los agentes de Cursor, Claude, Windsurf y otras herramientas compatibles con MCP busquen, extraigan e interactúen directamente, y las habilidades de agente para Claude Code y Codex se encargan de la configuración.
  • Opciones de acceso a MCP: la ruta MCP sin clave ofrece Search, Scrape y Parse dentro de límites diarios sin cuenta ni clave, y el inicio de sesión en el navegador y las claves de API dan acceso a todas las herramientas según el plan de tu equipo.
  • Autoalojamiento: una guía de Docker Compose lleva de una versión fijada a una extracción verificada.
DecisiónCódigo abiertoFirecrawl Cloud
API principales de scrape, crawl, map y searchIncluidasIncluidas y gestionadas
Extracción y formatos basados en LLMConectar un proveedor compatible con OpenAI u OllamaRuta de proveedor gestionada
Agent, Browser, Interact, panel, controles empresarialesNo están en la pila predeterminadaSegún producto y plan
Uso y facturaciónCostes de tu infraestructura y de tus proveedoresModelo de planes y créditos

La pila autoalojada predeterminada tiene otra carencia: las capturas de pantalla y las acciones de página no están disponibles, porque ambas requieren Fire-engine.

Precios

Los precios de Firecrawl se basan en créditos, y todas las facturas se emiten en USD sea cual sea la dirección de facturación. La tabla combina la lista de planes, que muestra ambas modalidades de facturación, con la comparativa de planes.

PlanCréditos al mesFacturación mensualFacturación anualNavegadores simultáneosLímite de /scrape, /map, /search
Free1.0000 $, sin tarjetaNo disponible210 / min
Hobby5.00019 $/mes16 $/mes5100 / min
Standard100.00099 $/mes83 $/mes25500 / min
Growth500.000399 $/mes333 $/mes505.000 / min
Scale1.000.000749 $/mes599 $/mes10010.000 / min
EnterpriseA medidaA medidaA medidaA medidaA medida

Los planes anuales se facturan una vez al año, pero los créditos se siguen restableciendo cada mes en una fecha de renovación mensual virtual. Los endpoints /crawl y /agent tienen un límite aparte y más bajo, desde 2 solicitudes por minuto en Free hasta 2.000 en Scale. Los endpoints de batch scrape comparten el límite de crawl. El pago se procesa con Stripe, que acepta la mayoría de las principales tarjetas de crédito y débito y PayPal.

Qué compra un crédito

Scrape, Crawl, Map y Monitor cuestan 1 crédito por página, y Search cuesta 2 créditos por cada 10 resultados. Search redondea hacia arriba por cada 10 resultados, así que 11 resultados cuestan 4 créditos. Las opciones de Scrape se suman a la tarifa base: la extracción JSON añade 4 créditos por página, y una página extraída con formato JSON y Zero Data Retention a la vez cuesta 6 créditos. Agent está en versión preliminar con 5 ejecuciones gratuitas al día y precios dinámicos después.

Dos tarifas unitarias difieren entre páginas. La página de precios indica Interact a 2 créditos por minuto de navegador. La documentación de facturación dice que las sesiones que usan un prompt se cobran a 7 créditos por minuto de navegador y las sesiones solo de código a 2. También indica Map a 1 crédito por llamada y no por página.

Recargas, traspaso y reembolsos

  • Pago por uso: en los planes de pago, cada recarga automática cuesta 5 USD y añade 1.000 créditos en Hobby, 2.000 en Standard, 2.500 en Growth o 5.000 en Scale, hasta un límite mensual que tú fijas.
  • Margen de excedente: mientras el pago por uso está activado, las solicitudes siguen funcionando brevemente por debajo de cero con un margen de 1.500 créditos en Hobby, 30.000 en Standard, 150.000 en Growth y 600.000 en Scale, tras lo cual devuelven HTTP 402.
  • Créditos comprados: los créditos comprados se mantienen hasta usarse, pero caducan si cancelas la suscripción.
  • Al agotarse: en Free, las solicitudes que consumen créditos devuelven HTTP 402 hasta el restablecimiento mensual.
  • Solicitudes fallidas: una extracción que no devuelve resultado no se cobra, pero una página que responde con un error como 403 o 404 sigue costando 1 crédito.
  • Cambios de plan: las mejoras cobran de inmediato el precio completo del nuevo plan, sin prorrateo.
  • Bajadas de plan: esperan a la siguiente renovación, y el tiempo no usado no se abona ni se reembolsa.
  • Reembolsos: los términos del servicio dicen que Firecrawl no ofrece reembolsos por ningún motivo, aunque puedes cancelar en cualquier momento y detener los cargos futuros.

Las reglas de traspaso entran en conflicto entre páginas oficiales. La página de precios dice que Scale traspasa los créditos no usados durante un mes y Enterprise una cantidad a medida, sin traspaso en Hobby, Standard ni Growth. La documentación de facturación dice en cambio que los planes Scale anuales traspasan los créditos del plan no usados 1 mes y los planes Enterprise anuales 2 meses.

Alternativas a Firecrawl

En debates de la comunidad de desarrolladores, Firecrawl se menciona junto a Tavily, Exa, Perplexity y Linkup como herramienta para que los agentes busquen en la web.

  • Crawl4AI: sus mantenedores dicen que puedes ejecutar tú mismo este rastreador de código abierto gratis para siempre, o usarlo alojado con una sola clave. El proyecto tiene licencia Apache License 2.0, una alternativa permisiva al núcleo de Firecrawl con licencia AGPL.
  • Tavily: la empresa describe Tavily como un motor de búsqueda en tiempo real para agentes de IA con API de búsqueda web y extracción de contenido. Encaja con cargas de trabajo que parten de una pregunta y no de URL conocidas.
  • Apify: la empresa dice ofrecer miles de herramientas para obtener datos web en tiempo real, seguir a competidores, generar leads e integrar aplicaciones y agentes de IA. Eso lo convierte en un catálogo de automatización más amplio que una sola API de scraping.
  • Firecrawl autoalojado: las mismas API principales, pagadas con tu propia infraestructura y costes de proveedores en lugar de créditos, sin las funciones exclusivas de Cloud.

Firecrawl publica páginas comparativas frente a muchas de estas herramientas, pero las escribe Firecrawl y defienden su propio producto.

Limitaciones

Reglas de scraping y responsabilidad

  • robots.txt: se respeta el robots.txt salvo que se active ignoreRobotsTxt, y esa anulación es exclusiva de Enterprise.
  • Identidad del rastreador: el endpoint crawl también respeta las reglas de robots.txt definidas para la directiva 'FirecrawlAgent'.
  • Responsabilidad del usuario: el README del proyecto afirma que respetar las políticas de los sitios web al hacer scraping es responsabilidad exclusiva de los usuarios finales.
  • Fuentes de pago: la empresa dice que ya paga a proveedores de datos oficiales mediante acuerdos individuales, sobre todo Wikimedia Enterprise.
  • Usos prohibidos: los términos excluyen las verificaciones de antecedentes estrictas, decidir la elegibilidad para una licencia gubernamental y cualquier fin prohibido por las leyes de privacidad de datos, incluidos el GDPR o la CCPA.

Límites operativos

  • Límites de velocidad y colas: tanto los límites de velocidad como los de concurrencia dependen del plan, y superar cualquiera de ellos devuelve una respuesta 429.
  • Contadores compartidos: los límites de velocidad se aplican por equipo, así que todas las claves de API del mismo equipo consumen los mismos contadores.
  • Archivos efímeros: las URL de las capturas de pantalla caducan a las 24 horas.
  • Inicio rápido autoalojado: el inicio rápido documentado para redes de confianza desactiva la autenticación de la API y no es una arquitectura de producción.

Privacidad y tratamiento de datos

Zero Data Retention, que no conserva contenido de página ni datos extraídos más allá de la duración de la solicitud, solo está disponible en los planes Enterprise y añade 1 crédito por página. Las capturas de pantalla no están disponibles en modo ZDR. Fuera de ZDR, poner storeInCache en false impide que Firecrawl almacene en caché los resultados de una solicitud. Todos los planes indican SOC 2 Type II, pruebas de penetración, autenticación multifactor y ocultación de PII. Un acuerdo de tratamiento de datos figura a partir del plan Standard. La política de privacidad dice que la información personal se conserva hasta que solicites su eliminación por escrito. En la política de privacidad y los términos revisados no se encontró ninguna declaración sobre el uso de datos de clientes para entrenar modelos.

Preguntas frecuentes

Q1. ¿Firecrawl es gratis?

Sí, dentro de unos límites. El plan Free da 1.000 créditos al mes sin tarjeta, y el acceso sin clave funciona para search, scrape e interact con topes diarios por IP. Los planes de pago empiezan en 19 $ al mes, o 16 $ al mes con facturación anual.

Q2. ¿Respeta Firecrawl el robots.txt?

Por defecto, sí. Ignorar el robots.txt es una opción exclusiva de Enterprise, y el proyecto deja en manos del usuario la responsabilidad de cumplir las políticas de cada sitio web.

Q3. ¿Qué deja fuera la versión de código abierto?

La pila autoalojada predeterminada no incluye Agent, Browser, Interact, panel, controles empresariales, capturas de pantalla ni acciones de página. La extracción basada en LLM requiere tu propio proveedor compatible con OpenAI u Ollama.

Q4. ¿Qué pasa cuando se me acaban los créditos?

Las cuentas Free reciben errores HTTP 402 hasta el restablecimiento mensual. En los planes de pago con el pago por uso activado, Firecrawl compra más créditos automáticamente hasta tu límite mensual; si está desactivado, las solicitudes también devuelven 402.

¿Conoces una herramienta similar?
Si conoces otras grandes herramientas de IA, no dudes en enviárnoslas