Copyleaks 是一個把 AI 內容偵測與比對合為一體的內容合規平台,針對一段文字回答兩個相關的問題:裡面有沒有生成式模型寫的部分,以及有沒有已經存在於別處的部分。它把這兩個問題放進同一套流程,而不是讓你分別使用兩個產品。公司成立於 2015 年,起點是抄襲比對,隨著大型語言模型進入日常寫作,才擴展出 AI 偵測與合規能力。這段沿革在評估它時相當關鍵:比對這一側倚靠的是打磨了約十年的資料庫與比對技術,而 AI 偵測這一側倚靠的則是新得多、也遠更具爭議的統計分類器。
產品的實際形態是一次掃描加一份報告。你透過網頁端、瀏覽器擴充功能、Google Docs 增益集、API 或學習管理系統送出文字,取得一份標示重點的文件檢視與一個百分比。比對這側顯示對應到的來源,AI 這側顯示哪些段落帶有機器生成的統計特徵。要留意的是,AI 與比對合併成一份報告這項特性僅適用於文字掃描;圖片偵測只判定是否有 AI 痕跡,不做圖片比對。
至於適合誰,端看你重視哪一半。大學與學校把它當成接進 LMS 的學術誠信層;出版方與內容團隊用它查核投稿是否原創、讀起來是否像機器所寫;企業用於智慧財產權合規、生成式 AI 治理,以及查核 AI 訓練資料是否由人撰寫;個人則用免費額度在送出前自我檢查。官方自報涵蓋 100 多個國家、500 多家企業與教育機構,每月處理超過 3000 萬次掃描——這些是廠商自報數字,未經獨立稽核。
新帳號包含少量免費點數,足以拿真實文件跑一遍、判斷報告品質後再付費。產品沒有可支撐高強度使用的長期免費檔,免費額度更應理解為評估機制。
個人向付費方案為訂閱制,按點數計費。Personal 月付 16.99 美元,年付折合每月 13.99 美元;Pro 月付 99.99 美元,年付折合每月 74.99 美元,Pro 另含 25 個使用者席次、進階偵測篩選器、透過網站地圖掃描整站、跨語言比對與分析儀表板。計費單位是統一點數:1 點可掃描最多 250 字或 1 張圖片——因此一篇 5,000 字的論文消耗 20 點,而方案標稱的點數換算成字數約為其 250 倍。Enterprise 與 Education 為客製報價,教育版按機構全日制學生人數計價;API 接入與 LMS 整合僅透過這兩檔提供。
訂閱前有三條商務條款值得留意,它們容易被忽略、事後才發現代價卻不小:方案不疊加,切換方案會覆蓋原方案並作廢剩餘點數;退款不保證,僅在計費週期開始 10 天內且未使用任何點數時才可能核准;所有方案預設自動續訂,直到主動取消。如果你的使用是季節性的(例如只用一個學期而非整年),請在結帳前確認月付選項對你確實可選,再決定是否承諾年繳。
這一節值得比多數工具的同名章節得到更多篇幅,因為 AI 偵測準確率是一個行銷說法與獨立證據嚴重分歧的議題,而且判斷錯誤的代價由個人承擔。
準確率數字是廠商自報。Copyleaks 宣傳超過 99% 的準確率,但該數字帶有註腳,明確說明評級基於英語資料集的內部測試。這不是指控廠商造假——註腳就寫在頁面上——但一個由廠商用自己的英語測試集得出的 99%,不該被當成對你的文件、你的語種的保證。
按廠商自己的數字,非英語表現明顯較弱。官方分語種表格顯示出清楚的梯度:AI 側數值從英語的 99.20% 降到德語 95.63%、葡萄牙語 93.08%。葡萄牙語約 7 個百分點的差距意味著漏偵測明顯多於標稱值。另需注意 AI 偵測支援 30+ 語言而比對支援 100+ 語言,兩個數字不可混用。
獨立學術研究與該品類的行銷口徑相反。Weber-Wulff 等人發表於同儕審查期刊 International Journal for Educational Integrity 的研究測試了 14 款偵測工具,結論是現有偵測工具既不準確也不可靠,且系統性偏向把內容判定為人類撰寫;該研究同時發現內容混淆技術會顯著惡化工具表現。這裡需要一處澄清:Copyleaks 在該論文中僅出現在其對既往研究的綜述部分,並不屬於作者自己實測的那 14 款工具,因此這是關於品類的證據,而非對本產品的直接測量。
「康乃爾研究」這個說法需要謹慎看待。「康乃爾大學研究認定 Copyleaks 最準確」的說法流傳很廣,但 arXiv 是康乃爾科技園營運的預印本平台,論文發表於該平台並不等於康乃爾大學的研究結論或背書;預印本也未必經過同儕審查。查核任何偵測器引用的學術背書時,都應確認由誰執行、用什麼測試集、是否經過審查。
誤判對非母語英語寫作者衝擊最大。根據 The Markup 的報導,七款偵測器把非母語英語者的寫作誤判為 AI 生成的比例達 61%,約 20% 的論文遭全部偵測器一致誤判,而母語者的寫作幾乎不出現同類錯誤。機制並不複雜:偵測器獎勵語言上的不可預測性,而用第二語言寫作的人往往寫出其所受教育所獎勵的那種正式、低變化度的行文。任何機構若在部署偵測時不考慮這一點,無論選擇哪家廠商,建立的都是一套帶有歧視性的流程。
使用者口碑不佳,且爭議正集中於此。Trustpilot 顯示評分為 2.6 分(滿分 5 分),樣本數 344 則,其中 49% 為一星,在 Software Vendor 分類中排名第 80 位(共 85 家)。最主要的抱怨是人工撰寫的作品被判為 AI 生成,投訴者中包括自述為退伍軍人與在學研究生的使用者。解讀時需要一則提醒:評論平台天然篩選出受損的一方,被誤判的人比掃描結果符合預期的人有強得多的發文動機。該分數應被視為關於失效形態的證據,而非對整體準確率的測量。
廠商自身的表態比其行銷口徑更克制。在公開回覆中,公司承認高度公式化的人類寫作偶爾會模仿 AI 模式,並建議把 AI 分數視為強指示訊號、由人做最終判斷。這條建議是穩妥的,值得用它來要求其行銷口徑。
已知的干擾因素與操作限制:常見寫作輔助工具可能觸發標示;最低文字長度意味著短段落結果不穩定;掃描設定差異會讓同一份文件得出不同分數——使用者一再反映同一份文件在學生端與教師端分數不同,廠商將其歸因於雙方掃描設定不同。
官方宣傳超過 99% 準確率、0.03% 誤判率,但按其網站註腳,該數字來自英語資料集的內部測試。針對該品類的獨立同儕審查研究則認為,偵測工具整體上既不準確也不可靠。誠實的答案是:在一個根本可靠性有爭議的工具類別中,它的表現相對較好;但目前沒有任何偵測器足以讓其輸出被當成證據使用。
新帳號會取得一定額度的免費點數,足以拿真實文件評估產品。持續使用需付費:Personal 月付 16.99 美元(年付折合 13.99 美元),Pro 月付 99.99 美元(年付折合 74.99 美元)。
文字可以,兩類結果出現在同一份報告中。圖片不行:圖片掃描只偵測是否存在 AI 痕跡,不做抄襲比對。
AI 偵測支援 30 多種語言,比對支援 100 多種。官方公布的分語種準確率以英語最高,其他語種有可測量的下滑,因此對非英語結果應格外謹慎。
有可能。Copyleaks 明確說明 Grammarly 這類平台使用 ChatGPT 等生成式模型實作部分功能,其輸出可能被標示為潛在 AI 內容。基礎拼字與文法修正原本不應觸發標示,但生成式改寫功能可能會。
可以。系統為七個主流學習管理系統提供了原生連接器,分別是 Canvas、Moodle、D2L Brightspace、Blackboard、Schoology、Edsby 與 Sakai。要注意的是,這項整合能力僅在教育版與企業版方案中提供,個人訂閱並不包含。
可以升級方案或另購一次性點數。但要注意方案不疊加——切換方案會覆蓋目前方案並作廢剩餘點數——因此週期中途升級可能讓你損失沒用完的額度。
打開報告而不是只看分數,查看哪些段落被標示、AI Source Match 指向何處。蒐集你的寫作過程證據:草稿修改歷程、版本紀錄、筆記。如果結果會影響對你的評估,可以詢問對方使用了哪種掃描設定——同一份文件在不同設定下分數可能不同。非母語英語寫作者還應知道,已有研究記錄了偵測器普遍對該族群存在明顯偏誤,這是可以正當提出的一點。
官方自述持有 PCI DSS、SOC 2、SOC 3 與 GDPR 相關資格。企業與教育版可選地端部署或私有雲並支援區域化儲存,有資料落地要求時應走這條路徑。個人方案運行在標準託管服務上。
退款不保證。公布的政策只在計費週期開始 10 天內提出、且未使用任何點數時才可能核准,因此應當在訂閱前用免費點數評估,而不是訂閱後再評估。