Пользовались этим инструментом? Оцените его
Пользовались этим инструментом? Оцените его
Firecrawl — это API для веб-скрапинга, который ищет в интернете, скрапит отдельные страницы или целые сайты и управляет страницами, возвращая чистый Markdown или структурированный JSON, готовый для ИИ-приложений. Компания описывает его как единый API, превращающий сайты в чистые данные, готовые для LLM.
Сервис управляется компанией SideGuide Technologies, Inc., корпорацией из Делавэра, ведущей бизнес под названием Firecrawl. Независимые технологические издания описывают его как популярный веб-краулер с открытым исходным кодом для разработчиков и ИИ-агентов, коммерчески поддерживаемая версия которого продаётся через API.
Разделение на открытый код и хостинговый сервис определяет большинство решений о покупке. Открытый репозиторий в основном лицензирован по AGPL-3.0, а SDK и часть UI-компонентов используют лицензию MIT. Хостинговая версия работает на Fire-engine — по словам компании, это её собственная проприетарная инфраструктура для прокси, рендеринга и не только. На своём сайте Firecrawl утверждает, что с ним работают более 1,25 млн разработчиков и свыше 150 000 компаний, включая команды Apple, Canva и Lovable (данные зафиксированы 28 сентября 2026 года). Три сооснователя запустили компанию в 2022 году. 22 сентября 2026 года Firecrawl объявил о раунде серии B на 75 млн долларов под руководством Smash Capital.
Лимит обхода по умолчанию — 10000 страниц, поэтому обход большого сайта останавливается на этом числе, если лимит не изменить.
Вывод Scrape включает Markdown, сводку, очищенный HTML, исходный HTML, скриншоты, ссылки, JSON, URL изображений, элементы бренда, записи о товарах, аудио или видео с поддерживаемых видео-URL и формат запросов на естественном языке. Если передать в /scrape JSON-схему, данные вернутся ровно в этой форме — например, списки товаров, таблицы цен или контакты — без отдельного парсинга. JavaScript рендерится автоматически, поэтому одностраничные приложения и динамически загружаемые сайты отдают полный контент. Помимо HTML, сервис разбирает файлы PDF и DOCX.
По умолчанию Firecrawl отдаёт результаты из кеша, если есть копия моложе двух дней (maxAge 172 800 000 мс). Значение maxAge 0 принудительно запускает свежую загрузку, которая, по документации, занимает больше времени и чаще завершается ошибкой.
Firecrawl сообщает о покрытии 96 % на собственном эталонном наборе из 1 000 URL, прогнанном 13 января 2026 года, при задержке P95 3 387 мс на том же наборе. Это измерения, проведённые и опубликованные самой компанией, а не независимые тесты.
Путь к первой рабочей настройке короткий, и каждый шаг открывает больше возможностей API:
Компания называет типичными сценариями агентов глубокого исследования, RAG-конвейеры, обогащение лидов, конкурентную разведку, генерацию контента и мониторинг цен. Опубликованные истории клиентов связывают эти категории с конкретными командами:
Все четыре примера взяты с сайта самого Firecrawl. Они показывают схему работы каждой команды, а не измеренные результаты.
Собственные рекомендации Firecrawl строят выбор вокруг того, кто управляет инфраструктурой. Совет компании — начинать с Firecrawl Cloud, если только доступ к исходному коду или контроль над инфраструктурой не стоят операционной нагрузки.
Firecrawl доступен через REST API, официальные SDK, CLI и MCP-сервер, а также может размещаться на собственной инфраструктуре.
| Решение | Открытый код | Firecrawl Cloud |
|---|---|---|
| Базовые API scrape, crawl, map и search | Включены | Включены и управляются |
| Извлечение и форматы на базе LLM | Подключить OpenAI-совместимого провайдера или Ollama | Управляемый путь провайдера |
| Agent, Browser, Interact, панель, корпоративный контроль | Нет в стандартном стеке | Зависит от продукта и тарифа |
| Использование и оплата | Ваша инфраструктура и затраты на провайдеров | Модель тарифов и кредитов |
У самостоятельно размещённого стандартного стека есть ещё один пробел: скриншоты и действия на странице недоступны, поскольку оба требуют Fire-engine.
Цены Firecrawl основаны на кредитах, а все счета выставляются в USD независимо от платёжного адреса. Таблица объединяет список тарифов, где показаны оба периода оплаты, со сравнением тарифов.
| Тариф | Кредитов в месяц | Помесячная оплата | Годовая оплата | Одновременные браузеры | Лимит /scrape, /map, /search |
|---|---|---|---|---|---|
| Free | 1 000 | $0, без карты | Не предлагается | 2 | 10 / мин |
| Hobby | 5 000 | $19/мес. | $16/мес. | 5 | 100 / мин |
| Standard | 100 000 | $99/мес. | $83/мес. | 25 | 500 / мин |
| Growth | 500 000 | $399/мес. | $333/мес. | 50 | 5 000 / мин |
| Scale | 1 000 000 | $749/мес. | $599/мес. | 100 | 10 000 / мин |
| Enterprise | Индивидуально | Индивидуально | Индивидуально | Индивидуально | Индивидуально |
Годовые тарифы оплачиваются раз в год, но кредиты всё равно обнуляются каждый месяц в виртуальную дату ежемесячного продления. У эндпоинтов /crawl и /agent отдельный, более низкий лимит — от 2 запросов в минуту на Free до 2 000 на Scale. Эндпоинты batch scrape делят лимит crawl. Оплата проходит через Stripe, который принимает большинство основных кредитных и дебетовых карт, а также PayPal.
Scrape, Crawl, Map и Monitor стоят 1 кредит за страницу, Search — 2 кредита за 10 результатов. Search округляет вверх с шагом в 10 результатов, поэтому 11 результатов стоят 4 кредита. Опции Scrape добавляются к базовой ставке: извлечение JSON добавляет 4 кредита за страницу, а страница, отскрапленная одновременно в формате JSON и с Zero Data Retention, стоит 6 кредитов. Agent находится в режиме предпросмотра: 5 бесплатных запусков в день, после этого динамическое ценообразование.
Две ставки различаются на разных страницах. Страница цен указывает Interact по 2 кредита за браузерную минуту. Документация по оплате говорит, что сессии с промптом стоят 7 кредитов за браузерную минуту, а сессии только с кодом — 2. Та же документация указывает Map по 1 кредиту за вызов, а не за страницу.
Правила переноса на официальных страницах противоречат друг другу. Страница цен говорит, что Scale переносит неиспользованные кредиты на один месяц, а Enterprise — индивидуальный объём, без переноса на Hobby, Standard и Growth. Документация по оплате, напротив, говорит, что годовые тарифы Scale переносят неиспользованные кредиты тарифа на 1 месяц, а годовые Enterprise — на 2 месяца.
В обсуждениях сообщества разработчиков Firecrawl упоминается наряду с Tavily, Exa, Perplexity и Linkup как инструмент для поиска в вебе агентами.
Firecrawl публикует страницы сравнения со многими из этих инструментов, но их пишет сам Firecrawl, и они выступают в пользу его продукта.
Zero Data Retention, при котором содержимое страниц и извлечённые данные не хранятся дольше времени выполнения запроса, доступен только на тарифах Enterprise и добавляет 1 кредит за страницу. В режиме ZDR скриншоты недоступны. Вне ZDR значение storeInCache false не даёт Firecrawl кешировать результаты запроса. Для всех тарифов указаны SOC 2 Type II, тестирование на проникновение, многофакторная аутентификация и маскирование PII. Соглашение об обработке данных указано начиная с тарифа Standard. Политика конфиденциальности гласит, что персональные данные хранятся, пока вы письменно не запросите их удаление. В изученных политике конфиденциальности и условиях не найдено заявлений об использовании данных клиентов для обучения моделей.
Да, в определённых пределах. Тариф Free даёт 1 000 кредитов в месяц без карты, а доступ без ключа работает для search, scrape и interact в рамках дневных лимитов на IP. Платные тарифы начинаются от $19 в месяц или $16 в месяц при годовой оплате.
По умолчанию — да. Игнорирование robots.txt — опция только для Enterprise, а ответственность за соблюдение политик каждого сайта проект возлагает на пользователя.
Стандартный самостоятельно размещённый стек не включает Agent, Browser, Interact, панель управления, корпоративные средства контроля, скриншоты и действия на странице. Для извлечения на базе LLM нужен собственный OpenAI-совместимый провайдер или Ollama.
Аккаунты Free получают ошибки HTTP 402 до ежемесячного сброса. На платных тарифах с включённой оплатой по мере использования Firecrawl автоматически докупает кредиты до вашего месячного лимита; если она выключена, запросы тоже возвращают 402.