AI Humanization

AI Humanizer 与 Paraphrasing Tool:不是同一项工作

paraphrasing tool 和 AI humanizer 常被交替使用,但它们承担不同的工作,也有不同的失效方式。下面说明其目的、输入、各自会出什么问题,以及如何判断哪一个真正能解决你的问题。

5 min
Table comparing an AI humanizer vs paraphraser by purpose, input, common failure and what each is good for

在第三周,他们的导师指出一段文字与原文过于接近。在第九周,他们的导师又指出另一段文字听起来像 ChatGPT。导师把这两段文字都标记到同一个浏览器标签页文件夹里。学生会去拿任何已经打开的工具,因为在他们看来,这像是同一个问题,两个不同的问题却披着同样的抱怨外衣。

这种不匹配是 AI humanizer 与改写工具的问题,它源于两种不同工具却被放在同一货架上出售。改写工具的存在,是为了用不同的话重述来源文本。这本质上是一项避免抄袭的任务, 输入是别人的句子,工作是生成一个意思相同、但又不会与输入句子相似到构成复制的新句子。AI humanizer 的存在,是为了改变一段文字的阅读方式。这是一项风格任务, 输入通常是用户自己用 AI 起草的文本,工作是调整其节奏和用词,直到它不再读起来像语言模型输出的统计平均值。

TextPulse 的 关于如何 humanize AI 文本的指南 介绍了 humanizer 实际会进行的句子层面修改。本文则停留在更高一层, 即在你真正想修正的问题面前,你究竟应该使用哪一类工具。

AI Humanizer 与改写工具, 核心区别

AI humanizer 与改写工具的区别在于目的,而不在于质量。评价改写工具时,看的是它在保留原意的同时,输出在措辞上与来源文本拉开了多大距离,因为这种距离正是使用它的全部意义。评价 humanizer 时,看的是一段文本完成后读起来如何,因为读起来像某种具体而不均匀的人类声音,正是使用它的全部意义。

每个工具所期望的输入也不同。改写工具的设计是接收他人的句子,并返回一个新的句子。humanizer 的设计是接收一份草稿,通常是用户自己的草稿,这份草稿完全由语言模型生成,然后在不需要第二个来源进行对照的情况下重塑其形式。如果给 humanizer 一段来自他人论文的引文,它也会很乐意改写,这正是这两种工具开始真正发生冲突的地方。

改写工具实际上做什么

改写工具按句子逐句工作,在尽量保持原意不变的同时替换词语并重排从句。它的整个设计都指向一个结果, 生成一串新的词语,使相似度检查器无法将其与原文匹配,而人类读者仍然会认出它表达的是同样的意思。这项工作比听起来更狭窄,因为该工具必须在处理到的每个句子中,同时保留意义并改变措辞。

这种失败模式直接源于这种设计。改写工具会把摆在它面前的每一串词语都当作可以替换的对象,包括只有一种正确形式的技术术语、专有名词,或位于句中间的引文。改写工具无法区分引文和普通从句,因此像 (Alghamdi et al., 2019) 这样的参考文献可能会被改得面目全非,而不是保持不变。同样的盲点也会影响领域特定术语, 将 'statistically significant' 替换为更宽泛的短语,会改变句子实际主张的内容,而不仅仅是它听起来的方式。

AI humanizer 实际上做什么

AI humanizer 在句子和段落层面工作,通过变化句长、重组从句,以及替换语言模型过度使用的一小组词语,所有这些都旨在打破检测器或细心读者会注意到的统计一致性。它没有需要贴近的源文本,也没有需要避免的相似度分数,因为避免与他人作品的文本重叠从来就不是它的任务。

还值得注意的是,这种失效模式同样源于这种设计。不同于改写工具,后者只改变词语, 而且往往连完整词语都不会改变, 人性化工具有能力把两句承载着两项不同主张的句子合并起来,把限定性从句移离它所限定的数字,或者丢失原文中真正起作用的某个具体细节。改写工具会破坏它们本应保留不动的单个词语。人性化工具会破坏那些在段落中传递意义的句际联系。

将你自己的论文人性化

改写你的 AI 辅助文本,使其听起来更像人工撰写,同时不改动重要词语或引文。

免费开始

它们实际比较的地方

并列来看,这两种工具不再像竞争者,而更像不同的设备部件。

改写工具AI 人性化工具
目的在不与原文措辞过于接近、以致构成抄袭的情况下,重新表述来源内容逐句改变草稿的读法,而不改变其所表达的内容
典型输入他人的句子或段落用户自己生成的 AI 草稿
优化目标与来源文本的低重叠度不均匀的句子节奏和普通的用词
常见失效把它视为可互换词语的技术术语、专有名词和引文弄得支离破碎合并或漂移句子,在此过程中丢失细节或限定性从句
真正适合的用途在不直接照搬措辞的情况下,重新表述你正在引用的特定段落重写整份 AI 起草的文档,使其读起来像是一个人写的

你实际上需要哪一种?

应当使用哪种工具,取决于你实际面对的是什么问题。如果担心的是你的措辞与某个特定来源过于接近,那么改写工具正是为此而设计的,而且只针对那一段内容。如果担心的是整份草稿读起来像是语言模型写的,那么改写工具无法解决这个问题,因为重新排列单个词语几乎不会触及读者或检测器真正注意到的句子层面的节奏。

AI 人性化工具是为第二个问题而设计的,这就是为什么将整份 AI 起草的文档通过 TextPulse's AI humanizer 处理,能够处理逐字替换永远触及不到的句子节奏。

免费的 burstiness checker 会向你展示同样的不均匀性,而人性化工具正试图修正这种不均匀性,而且不会改写任何一句话,如果你想在决定哪种工具真正解决问题之前先看清问题,这会很有帮助。

为任务选择合适的工具

有些产品是有意模糊这一点的。QuillBot 主要将自己定位为改写工具,而其 Premium 方案现在又捆绑了一个单独的人性化功能,这正是那种让两类工具听起来可以互换的包装方式,尽管它们所处理的底层任务并不相同。像这样的捆绑功能是否真的能经受住某个特定检测器的检验,是另一个问题,不是本文要回答的问题。当任务确实是改写、压缩来源内容,或用你自己的话重述一个定义,而且不涉及任何检测器时,请使用 专为学术写作设计的改写工具,并把人性化工具留给它所要解决的统计问题。

改写工具会以一种特定且有充分记录的方式失效。为什么改写后的文本仍然会被标记解释了其机制,而 Turnitin 是否会专门检测 QuillBot 则在其单独页面中作答。

用错工具通常不会立刻显得失败。它看起来像是一个改写工具,技术上通过了相似度检查,但读起来仍像机器生成的文本,或者像一个人性化工具,读起来完全像人写的,却在悄悄偏离它原本从未被设计去追踪的来源。无论这两类工具中的哪一种是否真的能经受住真实检测器的检验,而不只是相似度分数的检验,都是另一个问题,我们在 关于 AI 人性化工具是否真的有效的文章中已有讨论。

XLinkedInFacebook

常见问题

AI humanizer 与 paraphraser 的区别在于目的,而不是能力。paraphrasing tool 会用不同措辞复述他人的句子,使其不会与来源过于接近,这是一项避免抄袭的任务。AI humanizer 会重写草稿,通常是用户自己的 AI 生成文本,使其读起来像一个不那么整齐的人的声音,而不是模型的平均输出,这是一项风格任务。

Mark

Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.

获取 AI 人性化最新动态

获取有关学术写作、AI 检测和人性化的技巧,直接发送到您的收件箱。

不发垃圾邮件。可随时取消订阅。