如何逐步撰写研究问题
主题还不是问题,而初稿问题也很少是值得回答的那个。本文将一个主题依次经过每一步收窄,人口、变量、结果,以及FINER测试,直到它具体到足以真正研究。
以艰难方式学习如何撰写研究问题,是一种常见情形,即导师会在页边批注“这只是一个主题,不是一个问题”,然后把提案退回给你。批注上方那一行通常写着类似“本文考察远程工作和员工福祉”的内容,这只是命名了一个领域,而不是任何人都可以去回答的东西。把一个感兴趣的领域转化为一个真正的问题,是分阶段完成的,漏掉其中一步,正是会产生一个无法说明其所检验内容的方法部分的原因。
这一过程的可靠版本有四个步骤。先把主题缩小,直到它明确指向一个人群、一个变量和一个结果。再用一个称为 FINER 的五部分检验来核对结果。然后把措辞收紧,直到其中没有任何内容会被误读。本文以一个例子贯穿这四个步骤,即检索练习是否比重读更能帮助学生更长时间地保留材料,这样每一步都能被看见,而不只是被断言。
先从主题开始,而不是从问题开始
主题命名的是一个领域。“学习技巧和考试表现”是一个主题,它告诉读者你在研究哪个领域,却没有说明你真正想弄清什么。问题命名的是你打算研究的一种关系。只要一句话还没有做到这一点,方法部分就还没有任何可供检验的内容。
对其进行初步缩小的尝试,可能会写成“检索练习是否帮助学生比重读学得更好”。这已经有进展,但按原样写出的这句话仍然不能被研究。“帮助”和“学得更好”都没有指明任何测量方式,而“学生”既可以指小学班级,也可以指博士生群体。这样松散的问题会迫使每一位读者,包括导师在内,去猜测你真正的意思。
如何撰写一个能指明其各部分的研究问题
一个可行的研究问题要命名三件事, 一个研究对象, 一个你可以测量或操控的变量, 以及一个结果。研究对象是你正在研究的人或事物。变量是会因个案而异的东西,无论那是某种行为、某种条件,还是某人接受的某种处理。结果是你实际会测量的内容,用来判断该变量是否产生了差异。
应用于检索练习主题时,研究对象变成了导论课程中的一年级本科生,而不是泛指的“学生”。变量变成了每周低风险检索测验,与在相同时间内重读同一材料相比,而不是单独笼统的“检索练习”这一概念。结果变成了在材料学习结束两周后进行的延迟测验得分,而不是未被测量的“学习”这一想法。合起来就是, 在导论课程中的一年级本科生中,完成每周低风险检索测验的学生,是否会在两周后的延迟测验中,比花费相同时间重读材料的学生得分更高?
将问题通过 FINER 测试
这是 Hulley 及其同事提出的一项五部分检查,称为 FINER。FINER 代表可行、感兴趣、新颖、符合伦理,以及适用。它用于临床研究,但我们在医学之外也很好地教授它,因为同样的五种失败模式会出现在每个领域。一个问题必须全部通过这五项,而不只是那些容易回答“是”的项目。
| 字母 | 它在问什么 | 应用于检索练习问题 |
|---|---|---|
| F, feasible | 你实际上能获得这项研究所需要的参与者、时间和访问权限吗 | 一个课程单元、两周和一个标准测验平台,使这项研究在一个学期内实施是现实可行的 |
| I, interesting | 答案对你、导师或该领域有意义吗 | 决定如何组织复习环节的教师对答案有直接利害关系 |
| N, novel | 它是否扩展或挑战了已经发表的内容,而不是重复它 | 大多数已发表的比较都把测验与完全不进行额外复习进行对照,而不是与在时间上匹配的重读进行对照 |
| E, ethical | 伦理委员会会批准你将如何研究它吗 | 课堂测验和延迟测试只带来不超过最小风险 |
| R, relevant | 它是否与一个真实的理论或实践问题相关 | 它与课程在实际中如何设计相关,而不仅仅是抽象层面的记忆心理学 |
在正式确定之前,先将一个草拟的问题输入研究问题生成器进行检查,所起的作用大致相同,只是用几秒钟而不是一整周的反复犹豫来完成。它最有助于发现你自己写作中最难察觉的失败之处,也就是一个听起来很具体,但实际上仍然没有指明任何真实变量的问题。
将你自己的论文人性化
改写你的 AI 辅助文本,使其听起来更像人工撰写,同时不改动重要词语或引文。
收紧措辞,直到不可能被误读
一旦这三部分就位,连接它们的词语如果仍然松散,也会造成很大损害。像“affect”“impact”和“improve”这样的动词听起来很精确,但它们本身并不测量任何东西, 读者无法仅从“affect”判断你指的是增加、减少,还是仅仅与之相关。修正方法在每个领域都一样, 用你计划进行的实际比较或测量来替换含糊的动词。
| 薄弱版本 | 缺少什么 | 强版本 |
|---|---|---|
| 远程工作会影响生产力吗? | 没有研究对象,没有明确定义的变量,也没有可测量的结果 | 在中型公司的软件工程师中,每周在家工作超过三天,与每周在家工作一天或更少相比,是否会改变每个冲刺周期完成的代码审查数量? |
| 护士疲劳会影响患者安全吗? | “疲劳”和“安全”都没有被测量,而且没有内置比较 | 在连续值三个夜班的注册护士中,自我报告的疲劳是否与比只值一个夜班的护士更高的用药错误率相关? |
| 城市绿地对心理健康有益吗? | “有益于”在研究开始前就预设了答案的方向 | 在居住在公共公园两公里范围内的成年人中,每周去公园的频率是否与标准焦虑量表上更低的得分相关? |
右侧的每个强版本都做了同样三件事, 它指出了研究对象是谁, 它用可测量的比较替换了含糊的动词, 并且去掉了任何预设答案方向的词语。这些都不是为了单纯把问题写得更长。它们使这个问题真正有可能被回答。
草拟问题常见的失败方式
大多数不可用的研究问题都可归结为四种模式, 而且一旦知道要看什么, 这四种模式都很容易识别。把草拟的问题大声读出来, 并问一问是否有两位不同的研究者会据此设计出两项不同的研究, 这样通常可以在导师介入之前发现其中大部分问题。
- 是或否的死胡同,例如“作业有帮助吗”,它只产生一个信息位,无法发展成真正的研究设计
- 把两个问题叠在一起,例如“压力如何影响学业表现和社会关系”,这迫使作者在本来回避作出的选择之间二选一
- 带有价值判断的框架,例如“为什么远程工作比办公室工作更好”,它预设了研究本应去发现的答案
- 缺少结果变量,例如“课堂设计如何影响学习”,其中“影响”和“学习”都没有指明研究者能够测量的任何内容
问题确定之后会发生什么
一个通过 FINER 检验的问题,仍然会分成两条不同的后续路径。经验研究版本需要一个假设,即一个可检验的单一预测及其零假设对应项,而用于文献综述或论证性论文的版本则需要一个论题陈述。更完整的流程,从这一步开始,经由这一分叉,直到完成提纲,都在我们的如何规划研究论文指南中加以说明。
研究问题的类型是单独归类的,而研究问题与假设之间的区别决定了你实际需要其中哪一种。
在这个阶段,一个经过收紧的问题比一段润色过的段落更有价值,因为后续的一切, 假设、提纲、实际写作,都会由它来塑造。专为学术写作打造的 AI humanizer值得在后面了解, 一旦有了草稿,就需要它听起来像提出问题的人,而不是像一个模板。
常见问题
一个好的研究问题会说明人口、变量和结果。人口是你正在研究的人或事物,变量是因案例而异的因素,结果是你会测量的内容,用来判断它是否产生了影响。三者中任何一个含糊不清,这个问题就还不能按原样进行研究。
Content planner and copywriter at TextPulse. Sara runs the blog day to day, from planning and drafting through to publishing. She writes the practical guides: clear explanations of academic writing problems, aimed at the person who actually has to hand something in.