AI Detection

Copyleaks AI 检测器评测:内置于你的 LMS 的检测器

Copyleaks 是许多学生在未主动选择的情况下接触到的 AI 检测器,它与抄袭检测一起捆绑在 Canvas、Moodle 和 Blackboard 中。该供应商宣称准确率超过 99%,误报率为 .03%。在 2026 年 6 月的 Vrije Universiteit Brussel 研究中,它未能将 40 篇完全由 AI 生成的论文中的任何一篇完整标记出来。以下是证据实际显示的内容。

6 min
Copyleaks AI Detector Review: The Detector Built Into Your LMS

大多数学生从不主动选择 Copyleaks。它通常是预装的,由几年前签约的机构接入作业提交系统,因此许多写作者第一次听到这个名字,往往是在自己的提交旁边出现一个百分比时。所以,真正重要的问题不是 Copyleaks 是否受欢迎,而是你所在大学嵌入其学习管理系统的检测器,是否足够准确,能够承担机构赋予它的权重。

供应商的回答十分明确, 其产品页面宣称准确率超过 99 percent,误报率低至 .03 percent,处于行业最低水平。迄今发表的最严格独立学术测试给出的答案则不同。2026 年 6 月发表在 Vrije Universiteit Brussel 的一项同行评审研究中,Copyleaks 没有完整标记出 40 篇完全由 AI 生成的学术论文中的任何一篇。

这两种说法可以同时成立,而它们之间的距离正是这篇评述所要讨论的内容, Copyleaks 是什么,公司声称了什么,独立测试实际上发现了什么,以及它给出的分数能够证明什么,不能证明什么。

Copyleaks 是什么,谁实际上在使用它?

Copyleaks 最初是抄袭检测工具,随着生成式模型的出现又加入了 AI 检测,这正是机构喜欢它的原因, 一次提交就会生成一份合并报告,同时覆盖抄袭匹配和疑似 AI 内容。其官网列出了与 Canvas、D2L、Moodle、Blackboard、Schoology、Edsby 和 Sakai 的原生集成,这覆盖了学生很可能所处的大部分 LMS 市场。公司还声称支持 30 多种语言,并可检测来自 GPT-5、GPT-4、Claude、Gemini、DeepSeek、Llama 等模型的输出。

这种分发模式是 Copyleaks 最重要的单一事实。与 Turnitin 和 GPTZero 一样,它是少数几种机构确实大规模部署的 AI 检测器之一,这意味着被它评分的人很少是选择它的人,也很少是能够看到完整报告的人。

Copyleaks 主页:面向企业和大学的内容完整性与 AI 检测平台
Copyleaks 向企业和大学销售内容完整性服务,学生通常是通过 LMS 接触到它,而不是通过这个主页。

Copyleaks 对其自身准确率有何主张?

该公司 AI detector 页面上的标题写着“由独立第三方研究支持的 99% 准确率”,而在同一页面更下方,这一主张又被强化为“超过 99% 的准确率,以及行业最低的 .03% 假阳性率”。该页面公布了其最新模型按语言划分的指标,列出英语在人类文本上的准确率为 99.97 percent,在 AI 文本上的准确率为 99.20 percent,法语、德语、意大利语、葡萄牙语和西班牙语也都高于 93 percent。页面还称,该工具对非母语英语文本保持“较低的假阳性率”,并引用了 Cornell Tech 研究人员在 arXiv 上发表的一项研究,该研究将 Copyleaks 评为所测试的最准确检测器。

请仔细阅读这些主张。按语言划分的数据来自供应商自身的测试方法,而其引用的第三方研究也是它自行挑选的。这并不意味着这些数字是假的,但在外部机构按照大学实际裁定的那类文档对其进行复现之前,它们仍属于营销表述。从机制上说,Copyleaks 将其模型描述为基于人类写作训练,并标记偏离人类模式的特征,这与 TextPulse 关于 AI detectors 如何工作的说明所涵盖的、适用于整个类别的同类统计信号一致。

独立证据显示了什么?

迄今为止,最有力的独立测试是 Vrije Universiteit Brussel study,该研究于 2026 年 6 月发表在 International Journal for Educational Integrity。研究人员构建了一个由 160 篇长篇学术论文组成的语料库,每篇都超过 4,000 词,并平均分为四类:由非英语母语研究生完全人工撰写、完全由 AI 生成、混合写作,以及先由 AI 生成后再刻意人工化。研究人员将全部 160 篇论文分别输入四种机构检测器:Pangram、GPTZero、Copyleaks 和 Turnitin。

Copyleaks 通过了全部 40 篇人工撰写论文的检测,结果确实很好。其余结果都很糟糕。对于 40 篇完全由 AI 生成的论文,它没有将任何一篇判定为完全由 AI 撰写,只对其中 40 篇中的 10 篇给出了至少部分标记,而且在这些 100 percent 机器生成的文档上,其报告的 AI 占比中位数仍低于 20 percent。对于人工化的 AI 论文,它识别出了 22.5 percent。Pangram 是该研究中表现最好的工具,在同样的文档上,它对完全由 AI 生成的论文标记率为 97.5 percent,对人工化论文的标记率为 92.5 percent。

Paper set (40 each)CopyleaksTurnitinPangram
Fully human-written100% correctly cleared100% correctly cleared100% correctly cleared
Fully AI-generated25% flagged at least partially, 0% fully0% flagged97.5% flagged, 65% fully
Humanized AI22.5% identified50% identified92.5% identified
Van Vlasselaer、Van Droogenbroeck 和 Spruyt 的检测结果,International Journal for Educational Integrity,2026 年 6 月。

作者的结论十分明确:在所研究的四种工具中,"at this moment only one produced satisfactory results,",而那并不是 Copyleaks。对于当前模型生成的长篇学术写作,也就是机构最关心的文档,Copyleaks 在这项测试中的主要失败模式是漏检 AI 文本,而不是错误指控人类。

关于误报,以及谁会受到伤害?

漏报会让供应商难堪。误报会毁掉学生的一个学期,因此 .03 percent 这一说法值得单独审视。在 Bloomberg Businessweek 2024 年的调查中,记者将 500 篇 Texas A&M 申请文书全部输入 Copyleaks 和 GPTZero,这些文书都写于 2022 年夏天,早于 ChatGPT 出现。两项服务错误地将其中 1 to 2 percent 标记为可疑,在某些情况下,所给出的确定性接近 100 percent。1 to 2 percent 听起来很小,直到把它乘到一所大学的提交量上,而且这相当于 Copyleaks 所宣传比率的 30 to 60 倍。

公平性图景确实是混杂的。在 VUB 研究中,Copyleaks 判定为无问题的 40 篇人工撰写论文全部由非英语母语者写成,这在该样本上确实是对供应商有利的证据。但更广泛的同行评审文献一再发现,这类检测器恰恰会在这一群体上误判,TextPulse 关于为什么 AI 检测器对非英语母语者存在偏见的页面对此有深入讨论,而 Bloomberg 的报道也记录了那些因分数而受损、却无法查看或质疑这些分数的学生。如果这种情况发生在你身上,实际应对方案已另行整理:如何证明你没有使用 AI

将你自己的论文人性化

改写你的 AI 辅助文本,使其听起来更像人工撰写,同时不改动重要词语或引文。

免费开始

定价与访问权限,针对那些并未选择它的人

供应商自己的页面列出了个人定价:免费扫描额度最高 25,000 characters,Personal 方案每月 16.99 dollars, 按年计费为 13.99 billed annually,且有信用额度限制,Pro 方案每月 99.99 dollars,Education 和 Enterprise 合同则通过其销售团队以定制定价出售。学生几乎从不支付这些费用。机构购买许可,教师查看报告,而被评分的作者往往什么也看不到,除非有人与其分享。这种不对称,而不是标价,才是关键的访问现实。

Copyleaks 在检测器格局中的位置

Copyleaks 的真正优势在于运营层面, 一份报告同时整合抄袭检测和 AI 检测, 该类别中最广泛的 LMS 覆盖范围, 以及比大多数竞争对手支持更多的语言。作为企业工作流产品, 它是可信的。作为测量工具, 其公开证据基础比其部署范围更薄弱。在唯一一项针对长篇学术文档的同行评审直接对比研究中, 它与最佳工具相差巨大, 甚至 Turnitin, 其自身的检测方法 工作方式不同, 也识别出了更多经过人类化处理的样本。Copyleaks 的百分比, 无论高低, 都只是某个模型在供应商控制其报告方式的条件下给出的估计。它值得进一步查看, 但绝不能单独作为结论。

完整比较

Copyleaks 只是这个拥挤领域中的一个参与者, 而本评测发现的模式, 即供应商的确定性摆在前面, 独立证据则更为薄弱, 在整个领域中反复出现。关于它与 Turnitin, GPTZero, Pangram, ZeroGPT 以及其他工具在同一证据优先标准下的表现对比, 请参见完整的 AI detectors compared 指南。

我们自己的研究发现了什么

在 TextPulse Research 的检测器一致性研究中,九款商用 AI 检测器对同样的 90 篇学术文本进行了评分。其中一篇是 455 词的混合文本:开头和结尾由人工撰写,中间是 168 词的 AI 生成段落。Copyleaks 将这篇文本判为 0% AI,而其他工具对同样文字的判定从 0% 到 95.7% 不等。完整论文、语料库和每款工具的分数矩阵开放于 TextPulse Research

Copyleaks 对研究语料库中混合文本的判定。
Copyleaks 对研究语料库中混合文本的判定。
XLinkedInFacebook

常见问题

该供应商的产品页面声称准确率超过 99%,误报率为 .03%,依据的是其自身的测试方法。独立结果较弱, 在 Vrije Universiteit Brussel 于 2026 年 6 月发表的一项经同行评审的研究中,Copyleaks 将 40 篇完全由 AI 生成的学术论文中没有一篇判定为完全由 AI 撰写,并且只识别出 22.5 percent 的人类化 AI 论文,而对同一测试中的 40 篇人类撰写论文全部正确放行。

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

获取 AI 人性化最新动态

获取有关学术写作、AI 检测和人性化的技巧,直接发送到您的收件箱。

不发垃圾邮件。可随时取消订阅。