Appen은 AI 학습 데이터 기업으로, AI 시스템을 구축하는 팀에 사람이 생산하고 사람이 검증한 데이터, 데이터 라벨링, 모델 평가를 판매합니다. 1996년 시드니에서 설립되었으며, 처음에는 초기 NLP 시스템을 위한 음성·언어 데이터에 집중했습니다. 현재 호주증권거래소(ASX)에 종목 코드 APX로 상장되어 있습니다. Appen은 자사의 역할을 프런티어 모델을 학습시키는 전문가 검증 데이터를 제공해 AI 시스템이 뉘앙스, 맥락, 복잡성을 대규모로 이해하도록 하는 것이라고 설명합니다.
회사는 같은 시장의 양쪽에서 활동합니다.
Appen은 검증을 거친 기여자가 100만 명 이상이고, 170개 이상 국가가 참여하며, 235개 이상 언어를 지원한다고 밝힙니다. ASX에 상장한 해인 2018년에 Appen은 플랫폼 역량을 확장하기 위해 Figure Eight를 인수했습니다.
Appen은 맞춤형 데이터 작업을 여섯 개 제품군으로 나누며, 각 제품군은 현대 모델 개발의 한 단계를 위해 설계되었습니다.
분야 전문가 RLHF에 대해 Appen은 선호도 순위와 비교 피드백을 의학, 법률, 과학, 금융 분야의 검증된 박사, 의사, 법학 박사가 제공한다고 밝히며, 일반적인 크라우드소싱 라벨링으로는 임상 진단이나 법적 논증이 올바른지 판단할 수 없다고 주장합니다. 규제 감사에서는 EU AI 법, NIST AI RMF, 조직의 윤리 프레임워크를 기준으로 모델 출력을 평가합니다.
별도의 코딩 제품군은 LLM과 코딩 에이전트의 학습·평가용 저장소 수준 데이터셋을 제공하며, 60개 이상의 환경, 50개 이상의 언어, 검증 가능한 RL 과제 500개를 포함합니다. 이 환경들은 비공개이며 공개 코드 색인에 포함되지 않는다고 설명되므로, 알려진 학습 데이터 중복 없이 평가를 실행할 수 있습니다.
ADAP는 Appen의 데이터 라벨링 플랫폼이며, Appen은 이 플랫폼이 자동화와 사람의 감독을 결합해 폭넓은 모달리티와 AI 활용 사례에 맞는 데이터를 제공한다고 설명합니다. Appen이 제시하는 주요 기능은 다음과 같습니다.
Appen의 카탈로그에는 RL 과제와 검증기부터 음성, 코드, 기업 데이터까지 8개 카테고리에 걸쳐 596개 데이터셋이 있습니다. 모든 데이터셋에는 출처, 동의, 라벨링 방식, 알려진 한계, 라이선스 조건을 기록한 사양서가 함께 제공됩니다. Appen은 선택 기준을 이렇게 설명합니다. 기성 데이터셋은 일반적인 카테고리를 표준 조건으로 다루며 며칠 안에 납품되고, 맞춤형 수집은 프로젝트에 특정 인구 구성, 통제된 음향 환경, 전문 분야 커버리지가 필요할 때 사용합니다.
Appen은 공급 측 프로그램도 운영합니다. 기업이 이미 사용하고 있는 워크플로와 운영 노하우를 새 모델을 구축하는 AI 연구소에 라이선스하고, Appen은 추출, 익명화, 연구소와의 협의를 맡습니다. 이 프로그램은 운영 데이터를 세 가지 범주로 정의합니다. 운영 문서, 의사결정 및 에스컬레이션 기록, 기록 시스템입니다.
Appen이 공개한 사례 연구는 이 회사가 맡는 작업의 범위를 보여 줍니다. 아래 수치는 모두 회사가 직접 밝힌 것입니다.
Appen이 잘 맞는 대상:
덜 맞는 대상:
모바일 작업은 주로 사물 사진 촬영, 영상 녹화, 오디오 녹음이며, Appen은 앱에서 작업을 시작하기 전 일부 가입 및 프로젝트 선택 단계에는 컴퓨터를 쓰도록 권장합니다.
Appen은 구매자용 가격을 공개하지 않습니다. 이번 리뷰에서 전체 사이트맵을 포함해 확인한 공식 페이지에는 가격표, 요금제 비교표, 셀프서비스 결제가 없으며, AI 데이터 팀의 문의 양식은 비즈니스 및 영업 문의 전용으로 표시되어 있습니다.
표준 카탈로그 라이선스는 상업적 학습 권리를 포함한 영구·비독점 라이선스이며, 라이선스 유형은 각 데이터셋의 사양서에 기재됩니다. 기업 데이터의 경우 파트너십마다 개별 견적을 내고, 추출을 시작하기 전에 조건을 서면으로 합의하며, 검수 시 대금이 지급됩니다. Appen은 추출, 익명화, 준비, 전송을 부담하며 선불 비용, 설정 수수료, 파트너 지급액 공제가 모두 없습니다. 가치는 운영 지식의 희소성, 원천 시스템 간의 연결 정도, 데이터의 양과 기간이 클수록 높아집니다.
CrowdGen은 최고 시급으로 $100+/시간을 내세우며, 각주에서 보수율은 지역과 기술에 따라 정해진다고 밝힙니다. 분야별 상한은 의료 임상 전문가와 법률 전문가가 가장 높아 각각 최대 $450/시간과 최대 $400/시간이고, 소프트웨어 엔지니어는 최대 $150/시간, 언어학자는 최대 $95/시간입니다. 금융 분야 상한은 투자 매니저의 최대 $150/시간부터 FP&A 분석가의 최대 $180/시간까지이며, 의료 행정 담당자는 최대 $90/시간입니다. 이는 상한일 뿐 일반적인 수입이 아닙니다. CrowdGen은 작업 시작 전에 보수율을 명확히 안내한다고 밝힙니다. Appen은 또한 프로젝트 참여를 위해 기여자에게 어떤 비용도 결코 요구하지 않겠다고 밝힙니다.
Appen과 겹치는 서비스를 각 서비스의 자체 포지셔닝에 따라 요약하면 다음과 같습니다.
Appen 자체 구성에는 여기에 더해 라이선스 가능한 데이터셋 카탈로그, 기업 운영 데이터 라이선스 프로그램, 전용 시설에서 수집·동기화·라벨링을 엔드투엔드로 처리하는 피지컬 AI 데이터가 있습니다.
네. CrowdGen은 스스로를 Appen의 기여자 플랫폼이라고 소개하며, Appen의 사기 주의 안내 페이지도 crowdgen.com과 app.crowdgen.com을 공식 웹사이트로 명시합니다.
Appen은 지원하거나 일을 시작하는 대가로 돈을 보내라고 절대 요구하지 않고, 수표를 미리 보내지 않으며, 공식 이메일은 @appen.com 주소에서만 보낸다고 밝힙니다.
대부분의 수입은 미국 달러로 표시되고 현지 통화로 지급되며, 은행 송금, PayPal, Payoneer, Airtm 등의 방법으로 출금할 수 있습니다.