
O Firecrawl transforma resultados de pesquisa, páginas avulsas e sites inteiros em Markdown limpo ou JSON no formato de um schema para agentes de IA e pipelines de RAG, com um núcleo de código aberto sob AGPL e uma nuvem gerenciada que adiciona interação com o navegador e controles empresariais.
Já usou esta ferramenta? Avalie-a
Já usou esta ferramenta? Avalie-a
O Firecrawl é uma API de web scraping que pesquisa na web, extrai páginas avulsas ou sites inteiros e opera páginas, devolvendo Markdown limpo ou JSON estruturado que aplicações de IA podem consumir. A empresa o resume como uma única API para transformar sites em dados limpos e prontos para LLM.
O serviço é operado pela SideGuide Technologies, Inc., uma empresa de Delaware que atua sob o nome Firecrawl. A imprensa de tecnologia independente o descreve como um crawler web de código aberto popular entre desenvolvedores e agentes de IA, com uma versão com suporte comercial vendida por meio de uma API.
Essa divisão entre código aberto e serviço hospedado orienta a maioria das decisões de compra. O repositório de código aberto é licenciado principalmente sob AGPL-3.0, enquanto os SDKs e alguns componentes de interface usam a licença MIT. A versão hospedada roda no Fire-engine, que a empresa chama de sua infraestrutura proprietária para proxies, renderização e mais. No site, o Firecrawl afirma que mais de 1,25 milhão de desenvolvedores e mais de 150.000 empresas constroem com ele, incluindo equipes da Apple, da Canva e da Lovable (registro de 28 de setembro de 2026). Os três cofundadores criaram a empresa em 2022. Em 22 de setembro de 2026, o Firecrawl anunciou uma Série B de 75 milhões de dólares liderada pela Smash Capital.
O limite de crawl é de 10000 páginas por padrão, então o crawl de um site grande para nesse número, a menos que o limite seja alterado.
As saídas do Scrape incluem Markdown, resumo, HTML limpo, HTML bruto, capturas de tela, links, JSON, URLs de imagens, elementos de marca, registros de produtos, áudio ou vídeo de URLs de vídeo compatíveis e um formato de consulta em linguagem natural. Ao passar um schema JSON para /scrape, os dados voltam exatamente nesse formato, como listas de produtos, tabelas de preços ou dados de contato, sem parsing à parte. O JavaScript é renderizado automaticamente, então aplicações de página única e sites com carregamento dinâmico devolvem o conteúdo completo. Além de HTML, o serviço processa arquivos PDF e DOCX.
Por padrão, o Firecrawl entrega resultados do cache quando existe uma cópia com menos de dois dias (um maxAge de 172.800.000 ms). Definir maxAge como 0 força uma nova busca, que segundo a documentação demora mais e tem mais chance de falhar.
O Firecrawl informa 96% de cobertura em seu próprio conjunto de benchmark de 1.000 URLs, executado em 13 de janeiro de 2026, com latência P95 de 3.387 ms no mesmo conjunto. São medições feitas e publicadas pela empresa, não testes independentes.
A primeira configuração funcional segue um caminho curto, e cada etapa libera mais da API:
A empresa cita como usos comuns agentes de pesquisa aprofundada, pipelines de RAG, enriquecimento de leads, inteligência competitiva, geração de conteúdo e monitoramento de preços. Seus casos de clientes publicados ligam essas categorias a equipes nomeadas:
Os quatro exemplos vêm do próprio site do Firecrawl. Mostram o padrão que cada equipe usa, não resultados medidos.
A orientação do próprio Firecrawl organiza a escolha em torno de quem opera a infraestrutura. A recomendação é começar pelo Firecrawl Cloud, a menos que o acesso ao código-fonte ou o controle da infraestrutura compense o trabalho operacional.
O Firecrawl é acessado por uma API REST, SDKs oficiais, uma CLI e um servidor MCP, ou pode ser auto-hospedado.
| Decisão | Código aberto | Firecrawl Cloud |
|---|---|---|
| APIs principais de scrape, crawl, map e search | Incluídas | Incluídas e gerenciadas |
| Extração e formatos baseados em LLM | Conectar um provedor compatível com OpenAI ou Ollama | Caminho de provedor gerenciado |
| Agent, Browser, Interact, painel, controles empresariais | Fora da stack padrão | Conforme produto e plano |
| Uso e cobrança | Custos da sua infraestrutura e de provedores | Modelo de planos e créditos |
A stack auto-hospedada padrão tem mais uma lacuna: capturas de tela e ações de página não estão disponíveis, porque ambas exigem o Fire-engine.
Os preços do Firecrawl são baseados em créditos, e todas as faturas são cobradas em USD, independentemente do endereço de cobrança. A tabela combina a lista de planos, que mostra as duas modalidades de cobrança, com a comparação de planos.
| Plano | Créditos por mês | Cobrança mensal | Cobrança anual | Navegadores simultâneos | Limite de /scrape, /map, /search |
|---|---|---|---|---|---|
| Free | 1.000 | US$ 0, sem cartão | Não oferecido | 2 | 10 / min |
| Hobby | 5.000 | US$ 19/mês | US$ 16/mês | 5 | 100 / min |
| Standard | 100.000 | US$ 99/mês | US$ 83/mês | 25 | 500 / min |
| Growth | 500.000 | US$ 399/mês | US$ 333/mês | 50 | 5.000 / min |
| Scale | 1.000.000 | US$ 749/mês | US$ 599/mês | 100 | 10.000 / min |
| Enterprise | Personalizado | Personalizado | Personalizado | Personalizado | Personalizado |
Os planos anuais são cobrados uma vez por ano, mas os créditos ainda são redefinidos todo mês em uma data de renovação mensal virtual. Os endpoints /crawl e /agent têm um limite próprio e mais baixo, de 2 requisições por minuto no Free a 2.000 no Scale. Os endpoints de batch scrape compartilham o limite de crawl. O pagamento passa pela Stripe, que aceita a maioria dos principais cartões de crédito e débito e o PayPal.
Scrape, Crawl, Map e Monitor custam 1 crédito por página, e Search custa 2 créditos a cada 10 resultados. Search arredonda para cima a cada 10 resultados, então 11 resultados custam 4 créditos. As opções do Scrape somam-se à tarifa base: a extração JSON acrescenta 4 créditos por página, e uma página extraída com formato JSON e Zero Data Retention ao mesmo tempo custa 6 créditos. Agent está em prévia, com 5 execuções gratuitas por dia e preço dinâmico depois disso.
Duas tarifas unitárias diferem entre páginas. A página de preços lista Interact a 2 créditos por minuto de navegador. A documentação de cobrança diz que sessões que usam um prompt são cobradas a 7 créditos por minuto de navegador e sessões só com código a 2. Ela também lista Map a 1 crédito por chamada, e não por página.
As regras de acúmulo entram em conflito entre páginas oficiais. A página de preços diz que o Scale acumula créditos não usados por um mês e o Enterprise uma quantidade personalizada, sem acúmulo no Hobby, no Standard ou no Growth. Já a documentação de cobrança diz que planos Scale anuais acumulam créditos do plano não usados por 1 mês e planos Enterprise anuais por 2 meses.
Em discussões da comunidade de desenvolvedores, o Firecrawl é citado ao lado de Tavily, Exa, Perplexity e Linkup como ferramenta para agentes pesquisarem na web.
O Firecrawl publica páginas de comparação com muitas dessas ferramentas, mas elas são escritas pelo Firecrawl e defendem o próprio produto.
O Zero Data Retention, que não guarda conteúdo de página nem dados extraídos além da duração da requisição, está disponível apenas nos planos Enterprise e acrescenta 1 crédito por página. Capturas de tela não estão disponíveis no modo ZDR. Fora do ZDR, definir storeInCache como false impede o Firecrawl de armazenar em cache os resultados de uma requisição. Todos os planos listam SOC 2 Type II, testes de penetração, autenticação multifator e ocultação de PII. Um acordo de processamento de dados aparece a partir do plano Standard. A política de privacidade diz que as informações pessoais são mantidas até você solicitar a exclusão por escrito. Na política de privacidade e nos termos analisados, não foi encontrada nenhuma declaração sobre o uso de dados de clientes para treinar modelos.
Sim, dentro de limites. O plano Free dá 1.000 créditos por mês sem cartão, e o acesso sem chave funciona para search, scrape e interact sob tetos diários por IP. Os planos pagos começam em US$ 19 por mês, ou US$ 16 por mês na cobrança anual.
Por padrão, sim. Ignorar o robots.txt é uma opção exclusiva do Enterprise, e o projeto atribui ao usuário a responsabilidade de seguir as políticas de cada site.
A stack auto-hospedada padrão não inclui Agent, Browser, Interact, painel, controles empresariais, capturas de tela nem ações de página. A extração baseada em LLM exige seu próprio provedor compatível com OpenAI ou o Ollama.
Contas Free recebem erros HTTP 402 até a redefinição mensal. Nos planos pagos com o pague conforme o uso ativado, o Firecrawl compra mais créditos automaticamente até o seu limite mensal; com ele desativado, as requisições também retornam 402.