学术散文中的句子节奏:为什么统一的写作看起来像机器写的
统一的句子长度不是语法问题,而是节奏问题,而且无论任何检测器怎么想,它都会让读者感到疲惫。本文讨论为什么学术散文会变得平板,节奏实际上对读者起什么作用,以及如何通过真实的修改前后示例把变化重新引入段落。
一位导师曾在一份草稿上退回修改,并在整页旁边的页边只写了一条批注: “这读起来像一份检查清单。” 页面上没有一句话有语法错误。每个句子都是完整的、标点正确的论断,长度大约二十五个词,接连不断,连续九个段落都是如此。内容没有问题。问题在于节奏,而节奏并不是语法检查能够发现的东西。
在学术写作中学习如何变换句子长度,与其说是为了刻意加入短句,不如说是为了注意句子长度何时已经在发挥作用,或者何时已经失效。一个短句如果接在三个长句之后出现,其分量会比平时更重。一个始终不分断、从头到尾重复数页的长句,无论其中论证多么严密,都会让读者感到疲惫。节奏是一种工具,而大多数学术写作都没有使用它。
如何在学术写作中变换句子长度
在学术写作中变换句子长度,关键不是把词数当作目标去刻意追求,而是在某种模式连续运行超过两三个句子之后,故意打破这种模式。先把论证写出来。然后回读,并标出所有长度相近、连续出现的句群。接着打断其中一个,把两个过于单薄的句子合并成一个足以配得上其篇幅的句子,或者在读者注意力自然开始游移的地方,把一个长句切开。
这并不意味着要像调到另一种设置的节拍器那样,在页面上机械地交替写短句、长句、短句、长句。机械的模式仍然是模式,受过训练的读者几乎和识别第一种节奏一样快地就能察觉第二种节奏。目标是与论证相一致的变化,而不是为了变化本身而变化。
为什么学术散文会变得平板
若干常见习惯会把学术句子推向相近的长度,而这些习惯都不是懒惰。其中之一是缓和语气,例如 "it could be argued that" 或 "the findings appear to suggest" 这类短语会在一句又一句的前面加上一个几乎相同的从句,因此后面的内容在真正开始之前就已经继承了相似的结构。第二种是许多写作者早期就被反复训练的主题句模板, 一个主张,接着是一串为其提供支撑的句子,这些句子的长度大致相同。
第三个原因比习惯更深。把草稿修改得过于平滑,直到它听起来始终正式,可能会恰好删去早期较粗糙草稿仍然保留的长度变化,因为在润色语气时,支离和不均衡往往是写作者首先会删去的东西。这样写出来的文字读起来很谨慎,也读起来很平板,而这两者并不是同一种称赞。
节奏实际上对读者有什么作用
在连续几句长句之后,一个短句会显得更有分量,而这种效果几乎完全来自对比,而不是内容本身。三句各三十个词的句子会为第四句建立预期。一个五个词的句子打破这种预期时,会显得有意为之,几乎像是作者停顿了一下,而读者会把这种停顿理解为强调,而不必说明原因。
相反的代价同样真实,却很少受到关注。一篇论文如果连续六页都保持每句接近二十八个词,那么它并不是一次读起来很难。它是连续六页都难读,因为节奏中没有任何东西提示一个想法在哪里结束、下一个想法在哪里开始,读者必须独自补出这种结构,在整整一章的长度里一句接一句地这样做。这样的疲劳与词汇或论证质量关系不大。它是一个节奏问题。
将你自己的论文人性化
改写你的 AI 辅助文本,使其听起来更像人工撰写,同时不改动重要词语或引文。
前后对照, 两个平淡段落的改写
两个简短片段可以把这一机制具体化。两个例子都没有改变所主张的内容,只是改变了主张的节奏。
| 之前 | 之后 | 变化之处 |
|---|---|---|
| 该干预降低了所有三个队列的焦虑评分,而且这种降低在不同年龄之间都保持一致,这一点在研究开始时并未预料到,并且表明该机制可能并不依赖年龄,而原始假设并未考虑到这种可能性。 | 该干预降低了所有三个队列的焦虑评分。无论年龄如何,这一点都成立,而这在团队开始研究时没有人预料到。该机制也许并不依赖年龄。 | 一个六十词的长句变成了三个长度不同的句子。主张没有改变。这样的节奏让读者有三个独立的位置去注意所发生的事情。 |
| 参与者来自四家诊所。伦理批准已提前获得。知情同意以书面形式记录。数据收集持续了六个月。分析遵循了预先注册的计划。 | 参与者来自四家诊所,伦理批准已提前获得,知情同意在数据收集开始前以书面形式记录,随后数据收集在一项预先注册的分析计划下持续了六个月。 | 五个整齐划一的句子变成了两个更长的句子。这与第一个例子相反, 原本被人为切分成清单的程序步骤合并后读起来更自然,因为它们描述的是一个连续过程,而不是五个独立事件。 |
构建变化的技巧
大声读一页内容,或者至少低声默读,并标出每一个你的声音想要停顿、但标点并不允许停顿的地方。这种不匹配通常意味着,一个句子试图容纳两个更适合分成两个句子的想法。
计数的帮助比听起来更大。读者其实已经在无意识地做类似的事情。在一项2023年的感知研究中,研究人员发现,人们会根据一句话在页面上占据多少行文字来猜测句子的长度,而不是实际去数词数。他们在不到半秒内就能做到。因此,选一页,通读一遍,并在页边写下每个句子的词数。不要被平均值吸引,应该看分布。若一页上每个数字彼此相差都在三到四个词以内,那么无论平均值如何,这一页都应当先修改。
把段落中最短的句子留给需要被记住的要点,而不是留给恰好已经没有内容可说的从句。这样的安排是一种选择,而且有意这样安排,正是刻意控制节奏的段落与偶然形成的段落之间最主要的区别。
TextPulse 的 免费 burstiness 检查器会自动执行同样的计数练习,按长度为粘贴的草稿中每个句子绘图,因此模式会在一页上清晰可见,而不必逐句手工读出。它的设计初衷是捕捉检测器所识别的这种同样的平板感,但其底层测量的,仍是本节一直在描述的那种节奏。
这种同一模式在检测层面也有自己的名称。本网站上的一篇配套文章解释了burstiness 实际测量的是什么,完整讨论了检测角度,因此本文可以继续专注于首先把句子写出来。
何时均一性仍然是正确选择
这并不是一条可以不加判断地普遍适用的规则。一个编号的方法部分,如果列出五个按顺序进行的步骤,本来就应该读起来像五条简短而相似的说明,因为读者需要按顺序执行它们,而不是在执行时欣赏文风。附录中的清单,或者逐字转录的一组访谈问题,其均一性是应得的,任何改写都不应在不需要变化的地方人为制造变化。
这些都不需要特殊软件就能察觉,只需要愿意按照读者实际会采用的速度把页面从头读到尾。TextPulse 的免费工具集合涵盖了值得对整篇草稿运行的节奏、词汇和结构检查,而不只是一次只看一个段落。
节奏只是分类器读取内容时所看见的一部分。关于为什么 AI 文本会被标记的更完整说明涵盖了其他所有方面,而Turnitin 自身的方法则另行说明,供那些截止日期正受该特定系统约束的人参考。
让读者感到乏味的那种平淡,在机械层面上,也正是检测器在报告文档中低变化度时所衡量的主要内容,这一主题在本网站的关于 AI 检测器实际如何工作的核心指南中有其自身的阐述。无论如何,读者总是先一步到达那里。在它成为统计数据之前,节奏一直都是读者的问题。
常见问题
在学术写作中变化句子长度,关键在于在第四次重复之前先注意到一种模式:把段落读一遍,标出任何连续三个或更多长度相近的句子,然后打断其中一个,把两个短句合并,或者在自然停顿处截断一个长句。把字数当作目标,往往不如有意打断一种模式有效。
PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.