Copyleaks는 AI 콘텐츠 탐지와 표절 검사를 하나로 묶어, 하나의 글에 대해 서로 맞물린 두 가지 질문에 답하는 콘텐츠 무결성 플랫폼입니다. 이 글에 생성형 모델이 쓴 부분이 있는가, 그리고 이미 다른 곳에 존재하는 부분이 있는가. 이 두 질문을 별개의 제품 두 개로 나누지 않고 하나의 작업 흐름 안에서 다루는 것이 이 제품의 설계 전제입니다. 2015년에 설립된 이 회사는 표절 검사에서 출발했고, 대규모 언어 모델이 일상적인 글쓰기에 들어오면서 AI 탐지와 컴플라이언스 영역으로 확장했습니다. 이 연혁은 제품을 평가할 때 중요합니다. 표절 쪽은 약 10년에 걸쳐 다듬어진 대조 데이터베이스와 매칭 기술에 기대고 있는 반면, AI 탐지 쪽은 훨씬 최근에 등장했고 이 문서에서 길게 다루듯 훨씬 더 논쟁적인 통계 분류기에 기대고 있기 때문입니다.
제품의 실제 형태는 한 번의 스캔과 한 장의 리포트입니다. 웹 앱, 브라우저 확장, Google Docs 부가기능, API, 학습관리시스템 중 하나로 텍스트를 제출하면 구간이 강조 표시된 문서 화면과 백분율이 돌아옵니다. 표절 쪽은 일치한 출처를 보여주고, AI 쪽은 어느 구간이 기계 생성의 통계적 흔적을 갖는지 보여줍니다. 다만 AI와 표절이 한 리포트에 합쳐지는 것은 텍스트 스캔에 한정된 특성입니다. 이미지 검사는 AI 흔적 여부만 판정하며 이미지 표절 대조는 수행하지 않습니다.
누구에게 맞는지는 어느 쪽 절반을 중시하느냐에 달려 있습니다. 대학과 학교는 LMS에 연결된 학문적 진실성 계층으로 사용하고, 출판사와 콘텐츠 팀은 기고문이 독창적인지 그리고 기계가 쓴 것처럼 읽히는지 확인하는 데 사용합니다. 기업은 지식재산 컴플라이언스, 생성형 AI 거버넌스, AI 학습 데이터가 사람이 쓴 것인지 검증하는 용도로 씁니다. 개인은 제출 전에 자기 글을 확인하는 데 무료 크레딧을 사용합니다. 회사는 100개국 이상, 500곳 이상의 기업 및 교육기관, 매월 3천만 건 이상의 스캔을 자체 보고하고 있으나 이는 감사받은 수치가 아니라 벤더의 자기 보고입니다.
신규 계정에는 제한된 무료 크레딧이 포함되며, 결제 전에 실제 문서를 돌려 리포트를 판단하기에 충분합니다. 상시 대량 사용을 감당할 영구 무료 등급은 없으므로 무료 크레딧은 평가 수단으로 이해하는 편이 맞습니다.
유료 개인 요금제는 크레딧 기반 구독입니다. Personal은 월 16.99달러, 연간 결제 시 월 13.99달러이고, Pro는 월 99.99달러, 연간 결제 시 월 74.99달러이며 25개 사용자 좌석, 고급 탐지 필터, 사이트맵 업로드를 통한 전체 사이트 스캔, 교차 언어 표절 탐지, 분석 대시보드가 추가됩니다. 과금 단위는 통합 크레딧으로 1크레딧이 최대 250단어 또는 이미지 1장을 처리합니다. 따라서 5천 단어 논문은 20크레딧을 쓰고, 요금제에 적힌 크레딧 수는 대략 그 250배의 단어 수에 해당합니다. Enterprise와 Education은 맞춤 견적이며 교육 요금은 기관의 전일제 학생 수를 기준으로 산정됩니다. API 접근과 LMS 연동은 이 두 등급을 통해서만 제공됩니다.
구독 전에 확인할 상업 조건이 세 가지 있습니다. 놓치기 쉽고 뒤늦게 발견하면 비용이 큽니다. 요금제는 누적되지 않아 전환 시 기존 요금제를 덮어쓰고 남은 크레딧이 소멸합니다. 환불은 보장되지 않으며 결제 주기 시작 10일 이내에 요청하고 크레딧을 전혀 쓰지 않은 경우에만 검토됩니다. 모든 요금제는 해지 전까지 자동 갱신됩니다. 1년이 아니라 한 학기처럼 사용이 계절적이라면, 연간 약정을 하기 전에 결제 화면에서 월 단위 결제가 실제로 선택 가능한지 확인하십시오.
이 절은 다른 도구의 같은 절보다 더 큰 비중을 받아야 합니다. AI 탐지 정확도는 마케팅 주장과 독립 증거가 크게 갈라지는 문제이고, 오판의 결과를 개인이 떠안기 때문입니다.
정확도 수치는 벤더의 자기 보고입니다. Copyleaks는 99% 이상의 정확도를 내세우지만, 그 수치에는 해당 정확도 평가가 영어 데이터셋에 대한 내부 테스트에 기반한다는 각주가 붙어 있어 독립 감사 결과가 아니라 자기 보고에 해당합니다. 이는 악의를 주장하는 것이 아니라 각주가 실제로 페이지에 있다는 사실을 짚는 것입니다. 다만 회사가 자체 영어 테스트셋으로 얻은 99%가 여러분의 언어로 된 여러분의 문서에 대한 보증으로 읽혀서는 안 됩니다.
벤더 자신의 숫자로도 비영어 성능은 뚜렷하게 낮습니다. 공식 언어별 표에는 분명한 기울기가 있어 AI 측 수치가 영어 99.20%에서 독일어 95.63%, 포르투갈어 93.08%로 내려갑니다. 포르투갈어의 약 7%포인트 차이는 대표 수치가 시사하는 것보다 미탐지가 상당히 많다는 뜻입니다. 또한 AI 탐지는 30개 이상 언어, 표절 탐지는 100개 이상 언어를 지원하므로 두 숫자를 혼용해서는 안 됩니다.
독립 학술 연구는 이 분야의 마케팅과 반대되는 결론을 냅니다. Weber-Wulff 등이 동료 심사 학술지 International Journal for Educational Integrity에 발표한 연구는 14개 탐지 도구를 시험한 뒤, 현재 이용 가능한 탐지 도구들이 정확하지도 신뢰할 만하지도 않으며 산출물을 사람이 쓴 것으로 분류하는 편향을 가진다고 결론지었습니다. 같은 연구는 내용 난독화 기법이 도구 성능을 크게 악화시킨다는 점도 확인했습니다. 한 가지 분명히 해 둘 점이 있습니다. Copyleaks는 그 논문에서 선행 연구 개괄 부분에만 등장하며 저자들이 직접 시험한 14개 도구에는 포함되지 않으므로, 이는 이 제품에 대한 직접 측정이 아니라 분야 전반에 대한 증거입니다.
"코넬 연구"라는 표현은 주의해서 봐야 합니다. 코넬대학교 연구가 Copyleaks를 가장 정확한 탐지기로 인정했다는 주장이 널리 퍼져 있지만, arXiv는 코넬 테크가 운영하는 프리프린트 플랫폼이므로 그곳에 게재되었다는 사실이 코넬대학교의 연구 결과나 보증을 뜻하지 않습니다. 프리프린트는 동료 심사를 거쳤다는 보장도 없습니다. 어떤 탐지기든 인용하는 학술적 근거는 누가 수행했고 어떤 테스트셋을 썼으며 심사를 거쳤는지 확인해야 합니다.
오탐은 비원어민 영어 작성자에게 가장 크게 작용합니다. The Markup의 보도에 따르면 일곱 개 탐지기가 비원어민 영어 작성자의 글을 AI 생성으로 표시한 비율이 61%였고, 약 20%의 논문에서는 그 오판이 만장일치였던 반면 원어민의 글에서는 같은 오류가 거의 나타나지 않았습니다. 원리는 단순합니다. 탐지기는 언어적 예측 불가능성에 보상을 주는데, 제2언어로 쓰는 사람은 자신이 받은 교육이 보상해 온 형식적이고 변주가 적은 문체를 쓰는 경우가 많습니다. 이 점을 고려하지 않고 탐지를 도입하는 기관은 어느 벤더를 고르든 차별적인 절차를 만드는 셈입니다.
사용자 평판은 좋지 않으며 쟁점도 바로 이 지점에 몰려 있습니다. Trustpilot 점수는 5점 만점에 2.6점, 표본은 344건이며 그중 49%가 1점이고 Software Vendor 분류에서 85개 중 80위입니다. 가장 큰 불만은 사람이 쓴 작업물이 AI 생성으로 채점되는 것으로, 스스로를 퇴역 군인이나 대학원생이라고 밝힌 사용자들이 제기했습니다. 다만 해석에 단서가 필요합니다. 리뷰 플랫폼은 피해를 본 쪽을 선별하는 성격이 있어, 잘못 표시된 사람은 결과가 예상과 맞은 사람보다 글을 남길 동기가 훨씬 강합니다. 이 점수는 전반적 정확도의 측정치가 아니라 실패 양상에 관한 증거로 읽어야 합니다.
벤더 자신의 입장은 마케팅 문구보다 절제되어 있습니다. 공개 답변에서 회사는 고도로 정형화된 사람의 글이 때때로 AI 패턴을 모방할 수 있다고 인정하고, AI 점수를 강한 지표로 삼되 최종 판단은 사람이 하라고 권합니다. 타당한 조언이며, 이 기준으로 회사의 마케팅을 견제할 만합니다.
알려진 간섭 요인과 운영상의 제약: 흔한 글쓰기 보조 도구가 표시를 유발할 수 있고, 최소 길이 요건 탓에 짧은 구간은 결과가 불안정하며, 스캔 설정 차이로 같은 문서가 다른 점수를 받을 수 있습니다. 같은 문서가 학생 쪽과 교수자 쪽에서 다른 점수로 나온다는 후기가 반복되며 회사는 이를 설정 차이로 설명합니다.
회사는 99% 이상의 정확도와 0.03%의 오탐률을 내세우지만, 자사 사이트의 각주대로 그 수치는 영어 데이터셋 내부 테스트에서 나온 것입니다. 이 분야를 다룬 독립 동료 심사 연구는 탐지 도구가 전반적으로 정확하지도 신뢰할 만하지도 않다고 결론지었습니다. 정직한 답은 근본적 신뢰성이 논쟁 중인 도구군 안에서 상대적으로 좋은 성능을 보이지만, 현재 어떤 탐지기도 그 출력을 증거로 취급할 만큼은 아니라는 것입니다.
신규 계정에 제한된 무료 크레딧이 제공되어 실제 문서로 제품을 평가할 수 있습니다. 지속 사용은 유료입니다. Personal은 월 16.99달러(연간 결제 시 13.99달러), Pro는 월 99.99달러(연간 결제 시 74.99달러)입니다.
텍스트는 가능하며 두 결과가 한 리포트에 함께 나옵니다. 이미지는 불가능합니다. 이미지 스캔은 AI 흔적 여부만 탐지하고 표절 대조는 하지 않습니다.
AI 탐지는 30개 이상, 표절 탐지는 100개 이상의 언어를 지원합니다. 공개된 언어별 정확도는 영어가 가장 높고 다른 언어에서는 측정 가능한 수준으로 떨어지므로 비영어 결과는 더 신중하게 다루십시오.
가능합니다. Copyleaks는 Grammarly 같은 플랫폼이 일부 기능에 ChatGPT 등 생성형 모델을 사용하며 그 출력이 잠재적 AI 콘텐츠로 표시될 수 있다고 직접 밝히고 있습니다. 기본 맞춤법과 문법 교정은 표시를 유발하지 않도록 되어 있지만 생성형 재작성 기능은 그럴 수 있습니다.
예. 주요 학습관리시스템 일곱 곳, 곧 Canvas, Moodle, D2L Brightspace, Blackboard, Schoology, Edsby, Sakai를 위한 네이티브 커넥터가 마련되어 있습니다. 다만 이 연동 기능은 교육기관용과 기업용 요금제에서만 제공되며 개인 구독에는 포함되지 않습니다.
요금제를 상향하거나 일회성 크레딧을 추가 구매할 수 있습니다. 다만 요금제는 누적되지 않아 전환 시 기존 요금제를 덮어쓰고 남은 크레딧이 소멸하므로, 주기 중간의 상향은 쓰지 않은 잔여분을 잃게 할 수 있습니다.
점수만 보지 말고 리포트를 열어 어느 구간이 왜 표시되었는지, AI Source Match가 어디를 가리키는지 확인하십시오. 초안 이력, 버전 기록, 메모 등 작성 과정의 증거를 모으십시오. 그 결과로 평가를 받는 상황이라면 어떤 스캔 설정을 썼는지 물어보십시오. 같은 문서라도 설정에 따라 점수가 달라질 수 있습니다. 비원어민 영어 작성자라면 탐지기 전반에 이 집단에 대한 상당한 편향이 연구로 기록되어 있다는 점을 정당하게 제기할 수 있습니다.
회사는 PCI DSS, SOC 2, SOC 3, GDPR 관련 자격을 보유하고 있다고 밝힙니다. 기업·교육 구매자는 온프레미스 또는 프라이빗 클라우드와 지역별 저장 옵션을 선택할 수 있으며, 데이터 소재지 요건이 있다면 이 경로를 택해야 합니다. 개인 요금제는 표준 호스팅 서비스에서 운영됩니다.
환불은 보장되지 않습니다. 공개된 정책은 결제 주기 시작 10일 이내에 요청하고 크레딧을 전혀 사용하지 않은 경우에만 환불을 인정하므로, 구독 후가 아니라 구독 전에 무료 크레딧으로 평가하십시오.