Copyleaks 是一个内容完整性平台,回答关于一段文字的两个相关问题:其中有没有生成式模型写的部分,以及有没有已经存在于别处的部分。它把这两个问题放进同一个工作流,而不是让你分别使用两个产品。公司成立于 2015 年,起点是抄袭检测,随着大语言模型进入日常写作,才扩展出 AI 检测与合规能力。这段历史在评估它时很关键:查重一侧依托的是打磨了约十年的比对库与匹配技术,而 AI 检测一侧依托的是要新得多、也远更有争议的统计分类器。
产品的实际形态是一次扫描加一份报告。你通过网页端、浏览器扩展、Google Docs 加载项、API 或学习管理系统提交文本,得到一份高亮标注的文档视图和一个百分比。查重一侧显示匹配到的来源,AI 一侧显示哪些段落带有机器生成的统计特征。需要注意的是,AI 与查重合并为一份报告这一特性只适用于文本扫描;图像检测只判定是否有 AI 痕迹,不做图像查重。
至于适合谁,取决于你更看重哪一半。高校与学校把它作为接入 LMS 的学术诚信层;出版方与内容团队用它核查投稿是否原创、是否读起来像机器所写;企业用于知识产权合规、生成式 AI 治理,以及核验 AI 训练数据是否由人撰写;个人则用免费额度在提交前自查。官方自报覆盖 100 多个国家、500 多家企业与教育机构,每月处理超过 3000 万次扫描——这些是厂商自报数字,未经独立审计。
新账号包含少量免费额度,足以用真实文档跑一遍并判断报告质量后再付费。产品没有可支撑高强度使用的长期免费档,免费额度更应理解为评估机制。
个人向付费套餐为订阅制,按信用点计费。Personal 月付 16.99 美元,年付折合每月 13.99 美元;Pro 月付 99.99 美元,年付折合每月 74.99 美元,Pro 另含 25 个用户席位、高级检测过滤器、通过站点地图扫描整站、跨语言查重与分析面板。计费单位是统一信用点:1 点可扫描最多 250 词或 1 张图片——因此一篇 5,000 词的论文消耗 20 点,而套餐标称的点数换算成词数约为其 250 倍。Enterprise 与 Education 为定制报价,教育版按机构全日制学生人数计价;API 接入与 LMS 集成仅通过这两档提供。
订阅前有三条商务条款值得留意,它们容易被忽略、事后发现代价却不小:套餐不叠加,切换套餐会覆盖原套餐并作废剩余额度;退款不保证,仅在计费周期开始 10 天内且未使用任何额度时才可能获批;所有套餐默认自动续订,直到主动取消。如果你的使用是季节性的(例如只用一个学期而非整年),请在结账前确认月付选项对你确实可选,再决定是否承诺年付。
作为内容合规平台的核心承诺,这一节值得比大多数工具的同名章节获得更多篇幅,因为 AI 检测准确率是一个营销话术与独立证据严重分叉的议题,而且判断错误的代价由个人承担。
准确率数字是厂商自报。Copyleaks 宣传超过 99% 的准确率,但该数字带有脚注,明确说明评级基于英语数据集的内部测试。这不是指控厂商造假——脚注就写在页面上——但一个由厂商用自己的英语测试集得出的 99%,不应被当作对你的文档、你的语种的保证。
按厂商自己的数字,非英语表现明显更弱。官方分语种表格显示出清晰梯度:AI 侧数值从英语的 99.20% 降到德语 95.63%、葡萄牙语 93.08%。葡萄牙语约 7 个百分点的差距意味着漏检显著多于标称值。另需注意 AI 检测支持 30+ 语言而查重支持 100+ 语言,两个数字不可混用。
独立学术研究与该品类的营销口径相反。Weber-Wulff 等人发表于同行评议期刊 International Journal for Educational Integrity 的研究测试了 14 款检测工具,结论是现有检测工具既不准确也不可靠,且系统性偏向把内容判定为人类撰写;该研究同时发现内容混淆技术会显著恶化工具表现。这里需要一处澄清:Copyleaks 在该论文中仅出现在其对既往研究的综述部分,并不属于作者自己实测的那 14 款工具,因此这是关于品类的证据,而非对本产品的直接测量。
「康奈尔研究」这一说法需要谨慎对待。「康奈尔大学研究认定 Copyleaks 最准确」的说法流传很广,但 arXiv 是康奈尔科技园运营的预印本平台,论文发布于该平台并不等于康奈尔大学的研究结论或背书;预印本也未必经过同行评议。核查任何检测器引用的学术背书时,都应确认由谁执行、用什么测试集、是否经过评审。
误报对非母语英语写作者打击最重。据 The Markup 的报道,七款检测器把非母语英语者的写作误判为 AI 生成的比例达 61%,约 20% 的论文遭全部检测器一致误判,而母语者的写作几乎不出现同类错误。机理并不复杂:检测器奖励语言上的不可预测性,而用第二语言写作的人往往写出其所受教育所奖励的那种正式、低变化度的行文。任何机构若在部署检测时不考虑这一点,无论选择哪家厂商,建立的都是一套具有歧视性的流程。
用户口碑不佳,且争议正集中于此。Trustpilot 显示评分为 2.6 分(满分 5 分),样本量 344 条,其中 49% 为一星,在 Software Vendor 分类中排名第 80 位(共 85 家)。最主要的投诉是人工撰写的作品被判为 AI 生成,投诉者中包括自述为退伍军人与在读研究生的用户。解读时需要一条提醒:评论平台天然筛选出受损方,被误判的人比扫描结果符合预期的人有强得多的发帖动机。该分数应被视为关于失效形态的证据,而非对整体准确率的测量。
厂商自身的表态比其营销口径更克制。在公开回复中,公司承认高度公式化的人类写作偶尔会模仿 AI 模式,并建议把 AI 分数视为强指示信号、由人作最终判断。这条建议是稳妥的,值得用它来要求其营销口径。
已知的干扰因素与操作约束:常见写作辅助工具可能触发标记;最低文本长度意味着短段落结果不稳定;扫描配置差异会让同一文档得出不同分数——用户反复反映同一份文档在学生端与教师端得分不同,厂商将其归因于双方扫描配置不同。
官方宣传超过 99% 准确率、0.03% 误报率,但按其站点脚注,该数字来自英语数据集的内部测试。针对该品类的独立同行评议研究则认为,检测工具总体上既不准确也不可靠。诚实的答案是:在一个根本可靠性存在争议的工具类别中,它的表现相对较好;但目前没有任何检测器足以让其输出被当作证据使用。
新账号会获得一定量免费额度,足以用真实文档评估产品。持续使用需付费:Personal 月付 16.99 美元(年付折合 13.99 美元),Pro 月付 99.99 美元(年付折合 74.99 美元)。
文本可以,两类结果出现在同一份报告中。图像不行:图像扫描只检测是否存在 AI 痕迹,不做抄袭比对。
AI 检测支持 30 多种语言,查重支持 100 多种。官方公布的分语种准确率以英语最高,其他语种有可测量的下降,因此对非英语结果应格外谨慎。
有可能。Copyleaks 明确说明 Grammarly 这类平台使用 ChatGPT 等生成式模型实现部分功能,其输出可能被标记为潜在 AI 内容。基础拼写与语法纠正本不应触发标记,但生成式改写功能可能会。
可以。系统为七个主流学习管理系统提供了原生连接器,分别是 Canvas、Moodle、D2L Brightspace、Blackboard、Schoology、Edsby 与 Sakai。需要注意的是,这项集成能力仅在教育版与企业版套餐中提供,个人订阅并不包含。
可以升级套餐或另购一次性信用点。但要注意套餐不叠加——切换套餐会覆盖当前套餐并作废剩余额度——因此周期中途升级可能让你损失未用完的额度。
打开报告而不是只看分数,查看哪些段落被标记、AI Source Match 指向何处。收集你的写作过程证据:草稿修改史、版本记录、笔记。如果结果会影响对你的评估,可以询问对方使用了哪种扫描配置——同一文档在不同设置下得分可能不同。非母语英语写作者还应知道,已有研究记录了检测器普遍对该群体存在明显偏差,这是可以正当提出的一点。
官方自述持有 PCI DSS、SOC 2、SOC 3 与 GDPR 相关资质。企业与教育版可选本地部署或私有云并支持区域化存储,有数据驻留要求时应走这条路径。个人套餐运行在标准托管服务上。
退款不保证。公布的政策只在计费周期开始 10 天内提出、且未使用任何额度时才可能获批,因此应当在订阅前用免费额度评估,而不是订阅后再评估。