本文档完整呈现一次英文学术论文(教育学 / 应用语言学)审阅任务的运作方式——从工作方法(四条写作标准),到审阅者的思考与核验过程,再到最终交付的逐条审阅报告。
整个审阅并非一次性"通读打分",而是六个环环相扣的步骤。每一步都产生中间产物,最终汇入审阅报告。
调用 paper-revision 技能:四条写作标准的操作性定义、检查清单、回复信风格规范,作为审阅的"标尺"。
用 anydoc 将 Manuscript.docx 转为 Markdown,建立统一的行号体系,便于精确标注每条意见的位置。
通读全文建立整体框架,确认用户所指"第 1–3 部分"的边界(Introduction / Challenges / PE scaffolding)。
两条核验线并行:①文档标记检查(高亮 / tracked changes);②对关键引用逐条做网络文献核验。
对 1–3 部分逐段审阅:英语规范、逻辑合理、问题意识、表达直接清晰。产出 Major × 6、Minor × 16。
交付 Markdown 审阅报告 + 可分享 HTML 站点,每条意见含定位、原文、改法与核验依据。
站点按"他人如何看懂整个流程"组织——先看标准,再看怎么用标准审,最后看审出什么。
所有审阅与修改都遵循统一的方法论——以研究者已发表的两篇代表性论文(Yan & Gao, 2025, CALL;Yan et al., 2026, System)为校准样本提炼出的四条写作标准。它们既是审阅的"标尺",也是修改的"靶心"。
正式学术语域:第三人称客观叙述、名词化与被动语态适度使用、系统性 hedging;术语管理严密(首用定义、缩写统一、核心概念先操作化);显性语篇连接词;APA 引用规范。
宏观"漏斗式"结构层层收窄(背景 → 核心概念 → 理论依据 → 实证证据 → 研究空白 → 研究问题);章节间镜像对应(RQ ↔ Results ↔ Discussion);段落内"主题句 → 证据 → 解读"闭环;段际显式过渡。
研究问题的正当性来自理论与实证的双重铺垫;显式宣告研究空白;问题与测量、分析、结果一一挂钩。严禁提出没有文献根据的问题、假设或"想法"。
结论先行(段首论断句)、主谓距离短、统计数据括号化、对比用平行结构 + 明示标记、定义 + i.e. 消除歧义、避免冗余与生僻词。
| 模式 | 适用场景 | 工作流 |
|---|---|---|
| 模式一 按审稿人意见修改 |
用户提供稿件 + 审稿人意见(可能多轮),逐条回应并修改 | 通读建档 → 逐条制定策略(采纳/部分采纳/拒绝)→ 修改稿件 → 撰写回复信 → 交叉检查"意见→修改位置→回复位置"对照表 |
| 模式二 自主修改 |
用户提供稿件 + 修改目标,无外部审稿意见 | 先以模拟审稿人身份按四条标准通读生成模拟意见(可多位审稿人并行:理论/方法/语言)→ 与用户对齐 → 逐条回应修改 → 修改后自审 |
本次任务属于"审阅"环节:既非模式一(无审稿人意见),也非模式二(未进入修改),而是两者的共同前置步骤——按四条标准诊断稿件现状。修改将在用户确认后按模式一/二的流程执行。
当任务进入"回复审稿人"阶段时,回复信严格模仿研究者的个人风格。以下是风格要点,供协作方理解其行文逻辑。
| 情形 | 处理 |
|---|---|
| 意见合理 | 感谢 → 说明改了什么、改在哪 → 致谢 |
| 意见部分合理 | 接受部分 + 拒绝部分及理由 → 尽量纳入 limitations |
| 意见基于误解 | 用理论或数据澄清,语气保持尊重 |
| 要求超出研究范围 | 说明范围界定 + 归入 future work |
| 格式/语言类意见 | 直接修正并简短回复("Fixed.") |
以下按时间顺序还原本次审阅的真实决策过程——包括范围界定、文档检查、文献核验中的关键发现,以及每条意见的判定逻辑。灰色标签为"过程性发现",红/蓝标签对应最终报告中的 Major / Minor 条目。
先通读全文(293 行转换稿),建立章节地图:Introduction → Challenges → PE scaffolding → 模型 → The study → Method → Results → Discussion → Implications → Limitations。据此确认用户所说"1–3 部分"为前三节(行 9–35)。关键决策:只审这三节,但引用与术语的一致性检查仍以全文为参照系(例如发现 orphan reference 属于全文性问题时如实标注)。
用脚本检查 docx 的黄色高亮与 tracked changes,结果:1–3 部分没有任何高亮或修订标记,高亮全部集中在第 4–6 部分且多为中文批注(如"【Why short-term longitudinal】")。
疑点:正文转述该研究"比较 zero-shot vs chain-of-thought 两种提示技术",但参考文献条目标题为 "Generative AI offers more, but students revise less: Comparing the effects of teacher and AI feedback on student essay revisions"——标题指向"教师 vs AI 反馈"比较,与转述方向不一致。
疑点:正文称 EFL 写作者"拒绝"了 38% 的 GenAI 反馈——需要核实具体数字与口径。
疑点:正文给出"对 ChatGPT 反馈实施修订 67% vs 教师反馈 83%"两个具体数字。
疑点:正文称该文"reviewed material and procedural scaffolds"——但该文(Psychology Learning & Teaching)是实证研究而非综述。
按四条标准逐段过稿,识别出四类"无需文献即可判定"的问题:
分级标准:Major = 语法硬伤 / APA 硬规则 / 引用-内容失配(投稿前必须处理);Minor = 术语管理、表达优化、结构一致性与措辞精确化(建议改进)。6 条 Major、16 条 Minor 全部给出:定位(小节/段落/行号)+ 原文 + 建议改法 + (引用类)核验依据。
输出物:① Markdown 审阅报告;② 可分享 HTML 版本;③ 本工作流站点(你正在浏览的页面)。文献核验的 4 条记录与来源链接均随报告交付,便于接收方复核。
1–3 部分整体质量高,漏斗式结构完整:引言(背景 → 质量与互动优势 → "反馈不自动转化为修订"的问题 → 理论解释 → 空白 → 研究行动)→ 第 2 节(两类挑战详述 → 三层归因 → 三条设计标准)→ 第 3 节(PE 三类方法:material → procedural → technique-based,逐类递进 → 概念再定义 → 过渡到第 4 节)。
段落内"主题句 → 证据 → 解读"闭环基本完整;挑战部分数据支撑具体(38%、67%/83%、三分之一失败率);hedging 系统使用得当;对比用平行结构;问题意识达标——RQ 所需的理论与实证铺垫均在 1–3 部分到位。
但存在 2 处硬伤级语法错误、1 处引文标注异常,另有 2 处引用-内容匹配存疑,投稿前必须处理。
"caution" 不接名词短语作宾语(cautioned X = 警告 X),"cautioned students' underdevelopment" 语义不通。建议改为:
缺冠词且搭配生硬。建议改为:
省略号后紧跟 [with] 令人费解。若原文即为 "repetitive and tedious comments with general descriptions…",直接引用即可,无需 [with];若原文有出入,请核对原文后调整省略号与插入语。
参考文献中有两位同姓同年的 Li:
APA 7 规定同姓同年作者必须在夹注中加名字首字母。正文 "Guo & Wang, 2024; Li, 2025" 必须改为 Li, B., 2025 或 Li, S., 2025(请确认引的是哪一篇)。
核验情况:Bürgermeister, Glogger-Frey, & Saalbach (2021, Psychology Learning & Teaching) 的公开摘要为 "supporting the distinct processes of assessment and providing feedback within a peer feedback setting in teacher education",未见 "material / procedural scaffolds" 两个术语,且该文是实证研究而非综述,"reviewed in" 的定位存疑。请核对原文:
核验情况(Springer 链接 + 作者团队摘要):
正文只转述了"CoT 反馈质量更高",未提"修订结果各组相似"这一关键限定,且把研究焦点从"教师 vs AI 反馈"偏转为"两种提示技术比较"。建议核对原文后补足限定:
PE 在引言首次出现时只给缩写不给定义,定义直到第 3 节首句才出现。建议首次出现处给简版定义:
两词首次出现时仅有引号/括注,无操作性定义。建议各给一句括注定义(需有文献依据,如 Carless & Boud 2018 对 feedback literacy 的定义),或在首次出现处注明后续将展开。
"One underlying reason…" 暗示还有 "Another",但下文是同一原因的延伸。建议改 A key underlying reason… 或 One important reason…。
首次出现时 "direct" 含义不清(直接照搬?直接添加?)。建议澄清,如 "…suggested that students tended to apply feedback directly without deeper processing",或加引号并在后文统一。
请确认 Word 中是否同样存在(可能是 Markdown 转换产物)。
可精简为 EFL writers using GenAI assistance tend to reject…。
建议第 2 节末只收束设计原则,把具体设计预告留给第 5 节:
第 1 段用 "The first… Second,…" 指 challenges,第 2 段又用 "First… Second… Finally…" 指 factors,读者易混淆。建议第 1 段改 The first challenge… The second challenge…。
投稿前需统一为同一形式。
"with limited attention to…" 可考虑按惯用句式强化:
核验显示 38% = explicitly argued (22%) + ignored (16%)。用 "reject" 概括与 Chen 等人自身的操作化一致,但可更精确:…tend not to accept a relatively large proportion (38%) of GenAI feedback。
建议按 APA 加首字母区分(T. Zhang & Mao, 2023;Z. Zhang et al., 2025)。
该条目只出现在参考文献,正文无引用(全文性问题,投稿前处理——补引或删条)。
该文研究的是 automated writing evaluation (AWE),而上下文为 GenAI feedback。逻辑上"自动化反馈不自动产生收益"可借用,但建议注明其为相关证据(如 "related evidence from automated feedback research"),或更换更贴切的 GenAI 反馈研究。
两文标题(GenAI 对高阶思维影响的元分析;AI 对学业发展的影响)与"EFL writers' limited ability to formulate prompts"论点的匹配度需作者确认,必要时更换文献。
| 引用 | 核验结果 | 状态 |
|---|---|---|
| Farrokhnia et al. (2026) IJETHE 23(1), 6 |
研究存在;用 zero-shot vs CoT 生成 AI 反馈并与教师反馈比较;CoT 反馈结构质量最高但修订结果各组相似 | ⚠️ 转述需补限定 (Major-6) |
| Chen et al. (2026) CALL 39(3) |
确认 38% = explicitly argued (22%) + ignored (16%);form vs content 框架一致 | ✅ 数据一致 (Minor-12) |
| Zou et al. (2025) CALL |
研究存在;结论方向(GenAI 反馈 uptake 显著低于教师反馈)一致;67%/83% 具体数字未直接核实 | ⚠️ 建议核对原文数字 |
| Bürgermeister et al. (2021) PL&T 20(3) |
公开摘要未出现 material / procedural scaffolds 术语 | ⚠️ 建议核对 (Major-5) |