Apify는 브라우저 자동화와 데이터 추출까지 아우르는 웹 스크래핑 플랫폼으로, 모든 작업이 Actor라는 하나의 배포 단위를 중심으로 돌아갑니다. 공식 사이트는 이 제품을 "AI를 위한 신뢰할 수 있는 도구의 최대 마켓플레이스"로 규정하며 실시간 웹 데이터, 경쟁사 추적, 리드 생성, 소셜 미디어 모니터링, 그리고 자체 앱과 에이전트와의 통합을 제공합니다. 실제로 일하는 방식은 두 가지뿐입니다. 다른 개발자가 이미 게시해 둔 기성 Actor를 실행하거나, 직접 작성해 배포하는 것입니다.
Apify를 운영하는 곳은 체코 기업 Apify Technologies s.r.o.로, 프라하 Vodičkova 704/36에 등록되어 있고 법인 번호는 04788290입니다. 이 제품은 현재 AI 물결 속 대다수 도구보다 역사가 깁니다. Apify는 2015년 미국 마운틴뷰의 Y Combinator Fellowship에서 Jan Čurn과 Jakub Balada가 시작했고, 팀은 2016년 체코로 돌아와 제품을 중심으로 회사를 세웠습니다. 이 출신이 중요한 이유는 명확합니다. Apify는 대규모 언어 모델 붐보다 몇 년 앞선, 본질적으로 스크래핑 인프라 회사였고, 오늘날의 AI 지향 포지셔닝은 성숙한 크롤링 기반 위에 얹은 한 겹이지 신제품의 겉포장이 아닙니다.
회사가 공개적으로 밝히는 규모는 전 세계 고객 8만 명, 월 1 PB 이상 처리 데이터, 스토어 내 61,525개의 기성 Actor입니다. 이는 감사받은 지표가 아니라 벤더 자체 발표 수치이므로, 인용 가치는 주로 마켓플레이스 규모의 자릿수를 보여 준다는 데 있습니다. 그리고 바로 그 규모가 이 플랫폼의 가장 독특한 지점입니다.
먼저 분명히 해 둘 점이 있습니다. 이것은 개발자 제품이지 소비자용 앱이 아닙니다. 클릭 몇 번으로 쓰는 스크래핑 도구를 평가하듯 Apify를 평가하는 것은 의미가 없습니다. 추상화 계층, 과금 모델, 장애 양상이 모두 문서를 읽고 메모리 할당을 계산하며 "예상보다 행 수가 적게 반환된" 실행을 디버깅할 의향이 있는 사용자를 전제합니다.
플랫폼의 모든 것은 Apify Actor입니다. 공식 문서의 정의는 정확합니다. Actor는 구조화된 JSON 입력을 받아 작업(웹 스크래핑, 브라우저 자동화, 데이터 처리 등)을 수행하고 선택적으로 구조화된 출력을 만들어 내는 서버리스 클라우드 프로그램입니다. Apify Console에서 수동으로, API나 CLI를 통해, 또는 일정에 따라 실행할 수 있고, 더 큰 자동화로 조합할 수도 있습니다.
구조는 의도적으로 관습적입니다. 하나의 Actor는 소스 코드의 위치와 빌드·실행 방법을 지정하는 Dockerfile, README 형태의 문서, 입력과 출력을 기술하는 스키마, 내장 스토리지 시스템에 대한 접근 권한, 그리고 이름·설명·작성자·버전 같은 메타데이터로 구성됩니다. 계약 자체가 "Docker 이미지 + JSON 스키마"이기 때문에 Actor는 사실상 어떤 언어로도 작성할 수 있고, Actor끼리 서로 호출하여 단순한 단위에서 복잡한 시스템을 조립할 수 있습니다.
Actor는 공개와 비공개로 나뉩니다. 비공개 Actor는 온전히 당신의 것이고, 공개 Actor는 Apify Store에 올라가 누구나 실행할 수 있습니다. 바로 이 구분 하나가 플랫폼을 호스팅 서비스에서 마켓플레이스로 바꿔 놓습니다.
Store야말로 Apify의 진짜 해자입니다. 사용량이 가장 많은 Actor는 특정 사이트를 겨냥한 스크래퍼이며 각자의 개발자 네임스페이스 아래 게시됩니다. clockworks/tiktok-scraper, compass/crawler-google-places, apify/instagram-scraper, apify/website-content-crawler 같은 식이고, 각각 사용자 수와 별점이 표시되어 투입 전에 채택도를 확인할 수 있습니다. 예를 들어 구글 지도 스크래퍼는 홈페이지 목록에서 568K 사용자와 1,764건의 평가 기준 4.7점을 보여 줍니다.
이 점은 겉보기보다 운영상 훨씬 중요합니다. 사이트별 스크래퍼는 낡습니다. 대상 사이트가 마크업을 바꾸거나 봇 차단을 강화하면 스크래퍼는 망가집니다. Store Actor를 선택한다는 것은 결국 다른 사람의 유지보수 약속에 베팅하는 일이고, 그래서 별점과 사용자 수가 가장 먼저 읽어야 할 숫자입니다. 인기 있고 활발히 관리되는 Actor와 기능 목록만 같고 방치된 Actor는 완전히 다른 물건입니다.
Apify Proxy는 부수 기능이 아니라 별도로 가격이 매겨진 제품 라인입니다. 문서는 이렇게 설명합니다. Apify Proxy는 스크래핑 시 IP 주소를 순환시켜 지리적 차단을 피하도록 해 주며, Actor 안에서든 HTTP 프록시를 지원하는 어떤 애플리케이션에서든 사용할 수 있고, Apify가 IP 풀의 상태를 모니터링하며 주소를 교체해 IP 기반 차단을 방지합니다.
네 가지 유형이 제공되며 비용과 차단 프로필이 각각 다릅니다. 데이터센터 프록시는 가장 빠르고 저렴하지만, 다른 사용자의 활동 때문에 해당 IP가 차단될 수 있습니다. 주거용 프록시는 전 세계 가정과 사무실에 위치한 IP를 사용해 차단될 가능성이 가장 낮습니다. Google SERP 프록시는 검색 결과 페이지 추출 전용으로 국가와 언어를 선택할 수 있습니다. Unblocker는 내장된 스마트 라우팅으로 봇 차단과 캡차 시스템을 자동으로 우회하므로 직접 챌린지를 감지하거나 풀 필요가 없습니다.
실행 결과는 데이터셋, 키-값 저장소, 요청 큐라는 세 가지 스토리지에 기록되며, 각각 시간 기반 저장 용량과 읽기·쓰기·목록 조회 횟수로 과금됩니다. XLSX와 CSV 같은 표 형식 내보내기는 최대 2000개 열로 제한됩니다. 이름을 붙인 스토리지는 무기한 보존되고, 이름 없는 스토리지는 아래 한계 항목의 보존 규칙을 따릅니다.
제어 측면에서 플랫폼 자체가 데이터 추출 API 역할을 합니다. 코드로 플랫폼을 구동하는 REST 인터페이스, Actor 실행이 성공하거나 실패할 때 외부 이벤트를 발생시키는 웹훅, 저장소 이벤트로 실행을 트리거하는 GitHub 통합이 제공됩니다. Actor가 다른 Actor를 트리거할 수도 있어서, 외부 오케스트레이터 없이도 다단계 파이프라인을 구성할 수 있습니다.
Apify의 오픈 소스 참여는 구색 맞추기용 저장소가 아니라 실질적입니다. 홈페이지는 Apify가 Python과 JavaScript 모두와 잘 어울리며 Playwright, Puppeteer, Selenium, Scrapy는 물론 자체 웹 크롤링·브라우저 자동화 라이브러리인 Crawlee와도 호환된다고 밝힙니다. Crawlee는 Apify 자체 라이브러리로 수집 시점 홈페이지 카운터에 GitHub 스타 25,453개가 표시되었고, Apify 밖에서도 문제없이 동작하기 때문에 부담 없는 진입점이 됩니다.
AI 쪽에서는 통합 문서가 Actor와 스토리지를 MCP 호환 AI 클라이언트에 노출하는 Apify MCP server를 안내하며, Claude Code CLI·GitHub Copilot·Cursor·Codex CLI·OpenCode 플러그인, OpenAI Agents SDK·LangChain·Vercel AI SDK·Google ADK용 도구 래퍼, 벡터 인덱싱을 위한 Pinecone까지 함께 제공합니다. 이것이 "AI를 위한 도구"라는 포지셔닝의 구체적 실체입니다. Actor가 에이전트가 호출할 수 있는 도구가 되는 것입니다.
Website Content Crawler Actor는 웹사이트를 크롤링하고 텍스트를 추출해 AI 모델, LLM 애플리케이션, 벡터 데이터베이스, RAG 파이프라인에 공급하기 위해 존재하며 Markdown 출력과 HTML 정리를 지원합니다. MCP server나 LangChain 래퍼와 결합하면 현재 가장 흔한 신규 구축 패턴이 됩니다. Apify가 크롤링·렌더링·차단 우회를 맡고, 하위 스택이 청킹·임베딩·검색을 담당합니다.
예약 실행되는 Actor에 웹훅을 더하면 주기적 모니터링이 간단해집니다. 이커머스 가격 추적, 마켓플레이스 게시물 변경, 리뷰 모니터링, 경쟁사 페이지 비교가 여기에 해당합니다. 스케줄링과 재시도, 스토리지라는 기계 장치야말로 직접 만들면 계속 돌봐야 하는 부분입니다.
구글 지도와 소셜 플랫폼 스크래퍼는 Store에서 사용량이 가장 많은 축에 들며, 보통 공개된 사업체 정보로 잠재 고객 목록을 만드는 데 쓰입니다. 동시에 법적 경계가 가장 날카로운 사례이기도 합니다. 사업체 연락처 기록에는 개인 데이터가 포함되는 경우가 잦기 때문에, 여기에 파이프라인을 세우기 전에 반드시 한계 항목을 먼저 읽으십시오.
Apify는 양면 시장을 운영합니다. 개발자를 향한 홈페이지의 제안은 명확합니다. Actor 게시는 무료이고 컴퓨팅 자원 비용은 사용자가 지불하며, 신규 창작자는 500달러의 무료 플랫폼 크레딧을 받습니다. Apify는 결제·세무·인보이스까지 처리하고 매월 순수익을 정산하므로, 꾸준히 관리하는 스크래퍼 하나가 SaaS 운영 부담 없이 작은 제품 사업이 될 수 있습니다.
클릭만으로 쓰는 도구를 기대하는 비기술 사용자에게는 맞지 않습니다. 독립 리뷰어들이 학습 곡선을 거듭 지적하며, 특히 과금 모델은 사용자가 메모리와 실행 시간, 프록시 소비를 스스로 따져 볼 것을 전제합니다.
Apify는 브라우저의 Apify Console을 통해 사용하는 호스팅형 클라우드 플랫폼이며 데스크톱이나 모바일 애플리케이션은 없습니다. 프로그래밍 방식 접근은 REST API, 공식 API 클라이언트, Apify CLI를 통하며 JavaScript와 Python SDK가 제공됩니다. Actor 자체가 Docker 이미지이므로 런타임은 당신이 패키징하는 대로입니다.
기반 크롤링 라이브러리인 Crawlee는 오픈 소스이며 Node.js나 Python이 도는 곳이라면 어디서든 실행됩니다. Apify 플랫폼을 전혀 쓰지 않는 환경도 포함됩니다. 에디터와 에이전트 통합은 Claude Code CLI, VS Code의 GitHub Copilot, Cursor, Codex CLI, OpenCode를 아우르고, MCP server는 Actor를 모든 MCP 호환 클라이언트에 연결합니다. 워크플로 연결로는 Zapier, Make, n8n, GitHub, Google Sheets, Google Drive, Slack이 있습니다.
Apify는 선불 한도에 초과분 종량 과금을 얹는 모델을 씁니다. Free 플랜은 0달러이며 Apify Store나 자신의 Actor에 쓸 수 있는 5달러가 포함되고, 컴퓨팅 유닛당 0.2달러에 커뮤니티 지원, 신용카드는 필요 없습니다. Starter는 월 29달러에 29달러 사용량이 포함되며 CU 단가는 동일한 0.2달러입니다. Scale은 월 199달러에 199달러가 포함되고 CU당 0.16달러에 우선 채팅 지원이 붙습니다. Business는 월 999달러에 999달러가 포함되며 CU당 0.13달러에 전담 계정 매니저가 배정됩니다. Enterprise는 맞춤 견적으로 SLA와 SSO가 추가됩니다. 연간 결제는 10% 할인으로 안내됩니다.
표시 가격보다 중요한 구조적 사항이 둘 있습니다. 첫째, 사용하지 않은 사용 크레딧은 다음 청구 주기로 이월되지 않으며 주기가 끝나면 소멸합니다. 월간 한도는 쓰지 않으면 사라지는 구조입니다. 둘째, 초과 시 동작이 플랜별로 크게 다릅니다. 유료 사용자는 설정 가능한 한도 내에서 초과분을 청구받으며 계속 사용할 수 있지만, 무료 사용자는 다음 월간 주기가 시작될 때까지 차단됩니다.
Store의 Actor는 플랫폼 사용량 위에 두 번째 과금 계층을 얹습니다. 문서는 세 가지 모델을 설명합니다. pay per event는 결과 한 건 생성이나 Actor 시작처럼 제작자가 정의한 이벤트에 대해 지불하는 방식이고, pay per usage는 개발자가 추가로 받지 않고 플랫폼 자원 비용만 내는 방식이며, rental은 플랫폼 사용량과 별도로 개발자에게 매월 정액을 내는 방식입니다. 가격 페이지 FAQ는 앞의 두 가지만 설명한다는 점에 유의하십시오. 문서가 더 완전한 출처이고, 어떤 모델이 적용되는지는 각 Actor 페이지가 최종 근거입니다.
프록시와 스토리지는 별도로 계량됩니다. 주거용 프록시는 Free와 Starter에서 GB당 8달러, Scale에서 7.5달러, Business에서 7달러입니다. SERP 프록시는 1,000 SERP당 2.5달러에서 1.7달러까지, Unblocker는 1,000 요청당 1.5달러에서 1달러까지 내려갑니다. 데이터셋 시간 기반 저장은 하위 등급에서 1,000 GB-시간당 1.00달러이고 요청 큐는 4.00달러입니다. 학생, 스타트업, 비영리 단체에는 30% 할인이 안내되어 있습니다.
Apify의 차별점은 세 가지의 결합입니다. 관리되는 Actor의 매우 큰 마켓플레이스, 독립적으로 채택 가능한 오픈 소스 라이브러리, 그리고 프록시부터 스토리지까지 아우르는 인프라입니다. 대가는 과금의 복잡성과 서드파티 Actor 관리자에 대한 의존입니다.
Apify는 체코 기업 Apify Technologies s.r.o.가 제공하는 웹 스크래핑·브라우저 자동화·데이터 추출용 클라우드 플랫폼입니다. 작업은 JSON 입력을 받아 구조화된 출력을 내는 서버리스 클라우드 프로그램인 Actor로 포장되며, 수만 개의 기성 Actor 마켓플레이스에서 고르거나 직접 작성해 배포하면 됩니다.
대체로 그렇습니다. 기존 Store Actor를 양식만 채워 실행하는 것은 비개발자도 접근할 만하지만, 비용을 이해하고 실패를 진단하며 출력을 자기 시스템에 연결하는 일은 모두 기술적 숙련을 전제합니다. 리뷰어들은 기본 사용을 넘어서면 뚜렷한 학습 곡선이 있다고 일관되게 지적합니다. 완전한 비기술 사용자에게는 Octoparse 같은 시각적 도구가 더 맞습니다.
두 계층입니다. 플랫폼 계층은 컴퓨팅 유닛(메모리 1024MB로 1시간이 1 CU), 프록시 트래픽, 스토리지 작업, 데이터 전송을 청구합니다. 플랜에는 선불 한도가 포함되며 무료 5달러, Starter 29달러, Scale 199달러, Business 999달러이고 CU 단가는 0.2달러에서 0.13달러까지 내려갑니다. 두 번째 계층은 Actor 자체의 모델로 이벤트당, 사용량당, 또는 월 정액 임대입니다. 남은 한도는 매 주기 소멸합니다.
평가와 소규모 일회성 작업이라면 가능합니다. 신용카드 없이 월 5달러 사용량이면 저렴한 Actor에서 의미 있는 횟수를 돌릴 수 있습니다. 다만 반복 작업에는 빠듯하고 두 가지 제약이 물립니다. 한도를 넘기면 다음 주기까지 차단되고, 최근 10회 실행만 4개월 동안 보존됩니다.
Apify 클라우드에서 도는 컨테이너화된 프로그램으로, 선언된 입력 스키마와 출력 목적지를 갖습니다. 계약이 Docker 이미지와 JSON이기 때문에 어떤 언어로도 작성할 수 있고, 필요할 때나 일정에 따라 실행되며, 다른 Actor와 연결됩니다. 이 균일함이 있기에 마켓플레이스가 성립합니다.
Apify가 공개한 입장은 공개된 데이터를 스크래핑하는 것은 일반적으로 합법이며, 로그인 뒤 데이터와 개인 데이터, 지식재산, 기밀 데이터는 실질적인 주의가 필요하고 서비스 약관이나 국가적·국제적 규정의 보호를 받을 수 있다는 것입니다. 플랫폼이 당신의 구체적 용도를 승인해 주지는 않습니다. 약관은 접근 권한이 있고 관련 법을 준수하는 데이터만 처리하도록 요구합니다. 개인 데이터나 상업적으로 민감한 대상이 얽힌다면 직접 법률 자문을 받으십시오.
개인정보 처리방침은 Apify가 데이터 처리자로서 고객을 대신해 처리하는 개인 데이터를 고객이 별도로 동의하지 않는 한 AI 모델 학습에 사용하지 않는다고 명시합니다. 별도로 플랫폼의 AI 기능에 대해서는 당신의 입력과 그 결과 출력이 어떤 기반 모델의 학습에도 사용되지 않는다고 약관이 규정합니다. 실행 데이터는 플랜의 보존 규칙에 따라 플랫폼 스토리지에 보관됩니다.
부분적으로 가능합니다. Apify의 크롤링·브라우저 자동화 라이브러리 Crawlee는 오픈 소스여서 Apify 계정 없이 자체 인프라에서 실행됩니다. 포기하는 것은 관리 계층입니다. 프록시 순환, 스케줄링, 스토리지, 모니터링, 그리고 Store가 여기에 해당합니다. 많은 팀이 로컬 Crawlee로 프로토타입을 만들고 관리 계층이 필요해질 때 Apify에 배포합니다.
Actor마다 다릅니다. 독립 개발자가 게시하기 때문입니다. 각 상세 페이지에서 볼 수 있는 신호, 즉 별점과 평가 건수, 사용자 수, 최근 업데이트가 실질적인 판단 근거입니다. 자리 잡은 게시자가 만들고 널리 쓰이며 최근 갱신된 Actor는 방치된 것과 전혀 다르게 동작하고, 대상 사이트가 개편된 뒤로 업데이트가 없는 스크래퍼는 십중팔구 망가져 있습니다.
독립 리뷰에서 두 가지가 반복됩니다. 첫째는 비용 예측 가능성으로, 다층 과금 모델 탓에 작업을 돌리기 전에 월 청구액을 예상하기 어렵습니다. 둘째는 학습 곡선이며 특히 고급 기능과 자동화 워크플로 주변에 몰려 있습니다. 최대 과금 한도를 설정하고 일정을 걸기 전에 테스트 실행하면 첫 번째는 상당 부분 해소되고, 두 번째는 개발자 플랫폼의 본질적 속성입니다.