AI 人性化工具安全吗?隐私与诚信
AI 人性化工具安全吗,实际上分成两个独立问题, 你粘贴的文档会发生什么,以及使用该工具本身是否会使你的学术地位面临风险。以下是在决定之前需要核查的事项,二者都包括在内。
一名博士一年级学生在与导师会面前一晚,把半章内容粘贴进一个免费的 AI humanizer,十秒后得到一份更流畅的草稿,随后才开始想,这一章刚才到底去了哪里。AI humanizer 用在这样的工作上安全吗?当你认真提出这个问题时,它会立刻分成两个独立的问题, 也就是,文档本身在粘贴进去之后会发生什么,以及使用该工具本身是否会使你在所在机构中的地位面临风险。供应商对第一个问题大多用营销文案作答,而对第二个问题则完全回避。
对于市面上的所有产品,这两个问题都没有一个简单的是或否答案, 如果有,任何试图告诉你答案的页面都只是在向你推销某种东西。它们都对应一系列你可以在粘贴任何内容之前核查的具体事项, 例如在供应商自己的页面上,或在你所在机构自己的政策中核查。关于“AI humanizers 是否安全”,真正有用的说法就是这一点, 一份简短、可核查的清单,结合你所在机构自己的政策来衡量,而不是对整个类别下一个裁断。
TextPulse 自己的 如何将 AI 文本 humanize 的指南 说明了 humanizer 在句子层面所做的编辑,以及这些编辑为何会改变段落的节奏。本文关注的是另一个问题, 即在特定平台上,对特定文档进行这些编辑,是否真的可以安全地这样做。
AI Humanizers 安全吗?这取决于问题是什么
AI humanizers 是否安全,实际上分成一个数据问题和一个诚信问题,这两者几乎彼此无关。数据问题关乎文档本身, 它去了哪里,谁可以阅读,以及它是否会在你粘贴它的会话结束后继续存在。诚信问题关乎你本人, 你的机构是否允许使用该工具,以及在未说明的情况下使用它是否构成学术不端。
某个供应商可能在其中一个方面表现良好,却对另一个方面提供不了任何有用信息。即使某个工具拥有出色的隐私政策,它仍然不会告诉你你所在大学允许什么,而一项允许 AI 辅助的政策也不会保护一份被供应商处理不当的文档。这两个问题都需要各自的答案。
粘贴进去的文本会发生什么
每个 AI humanizer 都需要访问你的全文才能改写它。第二个问题是,当你点击提交时,你的文本会离开你的设备。除此之外它会发生什么,无论是被存储、存储多久,以及它是否曾进入未来模型的训练流程,完全取决于某一家特定供应商对其隐私政策的说明,而不是这类工具通常都成立的任何事情。
TextPulse 的 AI humanizer 是一个可行的例子,说明某个特定供应商可以如何选择回答训练问题,而它的回答形式值得被用作在其他地方要寻找什么的模板,而不是用来声称每个产品都以相同方式处理它。
训练用途是这种担忧最尖锐的版本。把提交的文档输入未来模型训练数据的供应商,实际上是在无限期保留一份副本,并在之后把你的句子混入别的输出中。某一项具体政策会用一句话回答这个问题,无论答案是哪一种。TextPulse 自己的隐私政策明确说明,提交的文本不会被用于训练、微调或改进其模型,而且其运行所依赖的第三方基础设施在合同上也被禁止这样做。这才是值得寻找的回答形式, 一个明确立场,而不是耸肩式的含糊其辞。
保留是第二个部分,与训练分开。供应商可以承诺绝不使用你的文本进行训练,同时仍然把你提交过的每一份文档保存多年,并且可被员工读取。要寻找与账户相关联的明确保留期限,以及删除你提交内容的方式,而不只是删除你的登录信息。你可以删除的账户,不等于你可以删除的文档。
将你自己的论文人性化
改写你的 AI 辅助文本,使其听起来更像人工撰写,同时不改动重要词语或引文。
在粘贴未发表手稿之前要问的问题
值得记住的是,作业草稿和处于禁运期的论文章节并不是同一种风险。如果一篇已经完成的论文被改写工具读取后出了问题,你失去的其实很少。如果一份未发表的手稿、资助申请,或者一章尚未得到导师批准的内容出了问题,那么它的全部价值就在于先不让任何其他人看到它。风险级别的变化并不意味着该工具不安全。这意味着,对下面这些问题给出含糊答案时,在那份文档上应比在一条讨论帖上更为谨慎。
下表是“这是否安全”的实际版本, 四个问题,以及当供应商实际上并未认真思考该问题时,具体答案与其通常说法之间的对照。
| 要问的问题 | 含糊的答案 | 具体的答案 |
|---|---|---|
| 我的文本会被用于训练你们的模型吗? | “我们可能会使用数据来改进我们的服务。” | 隐私政策本身明确写明不会,或者有明确命名的、可选择退出的训练条款,而不只是营销文案。 |
| 我的文档会保留多久,保存在什么地方? | 网站任何地方都没有说明保留期限。 | 与你的账户绑定的保留期限,以及如果你删除该账户会发生什么。 |
| 我能永久删除我提交的内容吗? | 只有“联系支持”,没有给出时间范围。 | 提供自助删除选项,或者对删除请求给出明确的响应期限,例如三十天。 |
| 是否会有人阅读我的文档? | 政策中任何地方都没有提到。 | 对员工或第三方访问设定明确限制,以及授予访问权限的原因。 |
使用 AI Humanizer 是否违反学术诚信规则?
AI humanizer 是否会使你面临学术风险,取决于两件事, 你的机构政策实际写了什么,以及你用该工具做了什么。对于每一所学校,这两个问题都没有统一答案,因为各自的政策写法并不相同。
出版机构大体上彼此一致。Elsevier、Wiley、Taylor and Francis,以及 COPE 和 ICMJE 的指导意见,许多期刊政策也都回溯到这些指导意见,它们最终都指向同一点, AI 辅助是允许的,它不能被列为作者,而且使用情况必须披露。大学则没有那么一致。Oxford、Cambridge、Harvard、MIT 和 Monash 都把实际的允许与否决定下放给院系、课程,或个人评估说明,而不是为整个机构设定一条统一规则,并且它们都仍然要求,只要允许使用,就必须说明其使用情况。
你把工具用于什么,与是否被允许使用它同样重要。把一段完全由 AI 起草的段落交给 humanizer 处理,以掩盖它是由 AI 起草的,这与在你自己写完每一个论点之后,用同一个工具润色你自己的句子,是不同的行为,即使两者都从同一次按钮点击开始。TextPulse 自己的 关于在学术写作中合乎伦理使用 AI 的指南,对这一区别的说明,比这里单独一节所能容纳的更为详细。
如何使用而不越界
把数据问题和诚信问题视为两个彼此独立的检查,而且都应在你粘贴任何内容之前完成,而不是之后。在数据方面,这意味着要阅读上面四个问题对应的实际隐私政策,而不是首页。在诚信方面,这意味着要查看你所在机构当前的政策,或者直接询问你的导师,因为上学期看起来宽松的政策,可能已经发生变化。
- 在粘贴任何尚未发表的内容之前,先阅读隐私政策本身,而不是营销页面。
- 查看你所在课程或院系目前允许什么,因为规则往往是在整个大学层面之下设定的。
- 如果你的机构要求披露工具的使用,即使修改本身很小,也应如实说明。
- 保存一份未经过编辑的草稿副本,这样你就能证明在任何工具接触它之前你写了什么。
风险中的检测部分已在另一页单独说明,见Turnitin 是否会识别 humanized text。其下方的类别混淆,humanizer 与 paraphraser 之争,在二者之间做出选择之前值得先厘清。
这一切并不意味着工具本身就是风险。未读的隐私政策和未核对的课程手册才是真正的风险,而且阅读它们所花的时间都比你原本准备粘贴进去的那一章更少。
常见问题
对于如此敏感的内容,AI 人性化工具安全吗?这取决于供应商的数据政策,而不是工具类别本身。应寻找明确声明,说明提交的文本绝不会用于模型训练,注明保留期限,并提供永久删除文档的方法,而不只是关闭账户。处于 embargo 状态的论文使风险显著提高,因此,只要其中任何一点回答含糊不清,就应暂缓使用。
Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.