千笔-AIWritePaper · https://www.aiwritepaper.com讨论与局限是论文里最容易「写得很顺、审不过」的部分。常见的两种假完成一是讨论段把相关结果写成因果、把单校样本写成普遍规律还用一句「与已有研究一致」带过二是局限段只有「样本量有限、方法有待完善、未来可进一步深化」三件套没有一条说明这个局限会让结论往哪个方向偏。答辩或审稿一问「D1 是相关还是因果局限会高估还是低估这个效应」整段失守。这篇给出一个可复跑的协议先用三列表把每条发现的解释和边界写死再做双版本烟测拿同一段讨论的版本 A故意保留常见毛病和版本 B按三列表重写逐行对照每一行给出 pass/fail最后再放一个伪 B失败样本它看起来什么都写了却在最关键的一行失败。文中的研究情境是虚构示例只用来演示写法不对应任何真实研究。图左侧三列表是真源中部版本 A 与版本 B 逐行对照右侧验收结论与伪 B 的失败行。目标说明读完应能独立完成五件事为讨论与局限建三列表发现编号 | 解释与谁对话 | 边界与局限影响方向每条发现一行。写出同一段讨论的版本 A 与版本 B并能逐句指出二者差在哪里。用 R1–R7 验收表给 A、B 两个版本逐行判 pass/fail而不是凭感觉说「B 更好」。识别伪 B局限列全了结论却在最后一句复活这种段落必须判失败。用一个 18 行的粗筛脚本先扫一遍可疑措辞再做人工验收。适用边界适合结果章已经定稿讨论与局限还在反复改。导师批注「讨论太浅」「局限太套路」但说不清具体改哪一句。用 AI 辅助起草过讨论段需要检查有没有被写成因果或过度外推。不适合结果本身还没跑完讨论的边界取决于设计和数据先把结果章定下来。想用烟测证明「论文一定能过」烟测只证明这段讨论可以被逐句核对。期待一个万能模板不同设计实验、准实验、横断面、质性能写的强度不同边界句要按设计写。三列表讨论与局限的真源列写什么最低标准发现编号D1、D2……与结果章表图对应能指到具体表号解释与谁对话这个发现与哪几篇文献相符或相反差异可能来自哪里点名文献不写「已有研究」边界与局限影响方向设计允许的最强措辞每条局限会使结论高估还是低估不支持哪种外推至少一句「不支持……」示例虚构发现编号解释与谁对话边界与局限影响方向D1AI 写作辅助时长与写作焦虑弱负相关表 3与文献 [12] 课堂干预方向相符与文献 [17]「依赖加重焦虑」相反差异可能来自测量时点横断面只能写相关可能存在反向因果自报时长有回忆偏差可能放大相关不支持外推到研究生和其他院校三列表不进正文它是写讨论段时的对照依据正文每一句都应该能在表里找到出处。双版本烟测真 A/B 段落版本 A故意保留常见毛病必须判 fail本研究发现生成式 AI 的使用能够显著降低大学生的写作焦虑这与已有研究结论一致充分说明 AI 工具在高等教育写作教学中具有广阔的应用前景。当然本研究也存在一定的局限性如样本量有限、研究方法有待完善等未来研究可进一步扩大样本范围、深化相关分析。版本 B按三列表重写在本校 312 名本科生的横断面样本中每周使用生成式 AI 写作辅助的时长与写作焦虑呈弱负相关D1见表 3。这一方向与文献 [12] 在课堂干预中的观察相符但与文献 [17] 报告的“依赖加重焦虑”相反两者差异可能来自测量时点不同学期中 vs 期末。由于数据来自单校横断面问卷D1 不能解释为使用 AI 导致焦虑下降焦虑较低的学生也可能更愿意尝试新工具反向因果。此外使用时长为自报回忆偏差可能使高频使用者被高估从而放大相关的绝对值。因此D1 只支持“在单校本科样本中存在弱负相关”不支持向研究生或其他院校外推检验因果方向需要纵向追踪或随机分组设计。A/B 验收表逐行判定编号检查项通过标准版本 A版本 BR1发现可指回句中出现发现编号或表号fail无表号passD1、表 3R2措辞与设计相符横断面只写相关不用因果动词fail「显著降低」pass「弱负相关」R3文献对话点名相符与相反各至少一篇写出差异来源fail「与已有研究一致」pass[12] 相符、[17] 相反、时点差异R4替代解释至少一条替代解释反向因果、混杂等fail无pass反向因果R5局限写影响方向每条局限说明高估还是低估fail「样本量有限」无方向pass回忆偏差可能放大相关R6边界句至少一句「不支持……」fail反而外推到「高等教育」pass不支持外推到研究生、其他院校R7未来研究可执行说出需要什么设计来回答什么问题fail「进一步深化」pass纵向或随机分组检验因果方向版本 A 七行全败版本 B 七行全过。门禁没有 A 的 fail 记录不得声称做过双版本烟测B 有任何一行 fail不得合入。失败样本伪 B 为什么不过本研究局限在于1单校横断面数据无法确定因果方向2使用时长为自报可能存在回忆偏差3样本仅含本科生。尽管如此结果仍表明生成式 AI 能够有效缓解写作焦虑建议高校尽快推广 AI 写作辅助。它比版本 A 好看得多局限分条列出甚至承认了「无法确定因果方向」。但逐行看R2 fail最后一句「有效缓解」是因果措辞和第1条自相矛盾。R5 fail三条局限都没有写影响方向读者不知道结论会被高估还是低估。R6 fail「建议高校尽快推广」正是第3条局限所否定的外推。伪 B 的问题不在于少写了什么而在于局限写了结论没改。局限段一旦承认「无法确定因果」同一章节里所有因果措辞都必须同步降级否则等于自己推翻自己。这一条也是审稿中最容易被直接指出的矛盾。可跑粗筛先扫措辞再人工验收下面的脚本只做粗筛命中可疑措辞就报出来缺少影响方向词和边界句也报出来。它不能代替 R1–R7只是让人工验收先看最可能出问题的地方。# lint_discussion.py —— 讨论/局限段落粗筛只报可疑信号不代替人工判定importre,sys RULES[(causal_verb,r(显著)?(降低|提升|提高|缓解|导致|促进)(了)?[^。]{0,8}(焦虑|能力|成绩|效率),因果动词须对照设计是否允许因果),(vague_consist,r与(已有|以往|既有)研究(结论)?一致,‘一致’未点名文献),(hype,r(广阔|巨大)的?(应用)?前景|充分(说明|证明)|尽快推广,外推/口号),(boilerplate,r一定的?局限|有待(完善|提高)|进一步(扩大|深化),模板化局限),]NEED[(impact_dir,r(高估|低估|放大|缩小|偏向),局限未写影响方向),(boundary,r(不能解释为|不支持|仅支持|只支持),缺边界句)]textopen(sys.argv[1],encodingutf-8).read()NEGre.compile(r(不能解释为|并不意味着|并非)[^。]{0,12}$)# 否定语境不报hits[(k,m.group(0),why)fork,p,whyinRULESforminre.finditer(p,text)ifnot(kcausal_verbandNEG.search(text[max(0,m.start()-20):m.start()]))]miss[(k,why)fork,p,whyinNEEDifnotre.search(p,text)]fork,s,whyinhits:print(fHIT{k:13}「{s}」{why})fork,whyinmiss:print(fMISS{k:13}{why})print(RESULT:,failifhitsormisselsepass(仅粗筛仍需人工 R1–R7))对三个版本实跑的输出原样 version_A HIT causal_verb 「显著降低大学生的写作焦虑」 因果动词须对照设计是否允许因果 HIT vague_consist 「与已有研究结论一致」 ‘一致’未点名文献 HIT hype 「充分说明」 外推/口号 HIT hype 「广阔的应用前景」 外推/口号 HIT boilerplate 「一定的局限」 模板化局限 HIT boilerplate 「有待完善」 模板化局限 HIT boilerplate 「进一步扩大」 模板化局限 MISS impact_dir 局限未写影响方向 MISS boundary 缺边界句 RESULT: fail version_B RESULT: pass(仅粗筛仍需人工 R1–R7) version_B_fake HIT causal_verb 「缓解写作焦虑」 因果动词须对照设计是否允许因果 HIT hype 「尽快推广」 外推/口号 MISS impact_dir 局限未写影响方向 MISS boundary 缺边界句 RESULT: fail一个值得记下的细节初版脚本把版本 B 里「不能解释为使用 AI 导致焦虑下降」也报成了因果措辞这是否定语境下的误报于是加了NEG规则。规则脚本一定会有误报和漏报所以结果栏写的是「仅粗筛」。协议记录可抄走version,finding,check,result,note A,D1,R1-R7,fail,七行全败故意保留 B,D1,R1-R7,pass,七行全过 B_fake,D1,R2|R5|R6,fail,局限写了结论没改踩坑只改局限段不回头改讨论段和结论段里的因果措辞。把「与已有研究一致」当成文献对话从来不写相反的文献。局限条目越列越多却没有一条写影响方向读者无法判断结论还剩多少可信度。未来研究写成「扩大样本、深化分析」没有说明用什么设计回答什么问题。删掉版本 A 的记录事后无法证明做过对照。当天 45 分钟脚本从结果章抽出 2–3 条核心发现建三列表。把现有讨论段复制一份作为版本 A不改动跑粗筛并记录。按三列表重写版本 B跑粗筛。用 R1–R7 逐行给 A、B 判定写进协议记录。全文搜索因果动词确认讨论、局限、结论、摘要四处措辞一致。总结讨论与局限的双版本烟测核心是两件事每句话能在三列表里找到出处每条局限说清结论会往哪边偏。版本 A 用来证明问题真实存在版本 B 用来证明问题可以逐行修掉伪 B 提醒你局限和结论必须同步修改。三列表是真源验收表是门禁脚本只是粗筛。
