| name | coherent |
|---|---|
| description | 中文学术论文章节边界规范性审查。检查论文各章是否泾渭分明:方法章只写原理、摘要不写别人问题、 引言不堆砌方法细节、结果章不重复实验设置、讨论章不复述结果数字等。适用于中文论文投稿前的 结构合规性自查。触发词:论文审查、章节规范性、结构审查、内容越界检查、论文自查。 |
| version | 1.0.0 |
| author | MS-MDA project |
对中文学术论文(DOCX)进行逐章逐节的内容边界规范性审查。核心标准是:每个章节只写该章应有之内容,不越界、不混杂、不重复。
- 论文投稿前的结构合规性自查
- 导师/合作者反馈"某章写太杂"后的系统性诊断
- 论文修改过程中确认章节边界是否修正到位
- 任何需要检查章节"泾渭分明"的场景
- 论文 DOCX 文件路径(必须)
- 可选:用户指定的额外检查维度(如"重点查方法章")
用 Python 解析 DOCX,提取每个段落的:
- 段落序号(索引)
- Word 样式名(Heading 1/2/3/...、Normal 等)
- 完整文本内容
输出为 UTF-8 临时文件供审查使用。
from docx import Document
doc = Document(paper_path)
for i, para in enumerate(doc.paragraphs):
style = para.style.name if para.style else 'None'
text = para.text.strip()
if text:
print(f'[P{i}|{style}] {text[:200]}')根据 Heading 样式和常见关键词("引言""研究方法""结果""讨论""结论""参考文献"等)自动划分章节范围,标记每章的起止段落。
合法内容:研究问题一句话、本文方法一句话、本文结果一句话、关键词。 违规内容:详细铺陈领域背景、罗列他人方法缺陷、展开方法论细节、出现参考文献引用。
检查方式:
- 扫描摘要段落中是否出现
[N]引用标记 - 扫描是否出现「然而」「但是」开头的、长度超过 50 字的问题铺陈句
- 扫描是否出现具体模型名(非自己提出的)或他人方法的详细描述
严重度:出现引用标记 → 🔴 高;长问题句 → 🟡 中。
合法内容:背景问题、相关工作概述、现有方法局限性(概括性指出即可)、本文贡献概述。 违规内容:详细描述本文方法的技术细节(网络层数、维度、公式);进入其他章节专属内容(数据集统计、实验参数)。
检查方式:
- 扫描引言区域是否出现方法专属公式编号(如
(7)但引言中不应有公式) - 扫描是否出现「公共特征提取器由三层全连接层组成」类实现细节句
- 扫描相关工作是否超过引言总篇幅的 40%(如超过,说明过于冗长)
严重度:出现实现细节 → 🔴 高;相关工作过长 → 🟡 中。
合法内容:自己方法的架构描述、模块定义、公式推导、损失函数定义、算法流程。 违规内容:
- 以"别人的方法有XX问题"开篇(应出现在引言)
- 详细批评已有方法的缺陷(引言的工作)
- 嵌入完整文献综述(软加权 vs 硬选择的学术史)
- 过度展开背景知识(为什么电极阻抗不同等生理学背景)
- 出现「实验结果」「性能对比」等实验内容
检查方式——扫描方法章每一段的开篇主语:
- 若以「然而」「虽然已有」「传统方法」开头 → 🟡 标记,建议改写为「本框架/我们提出/该模块」开头
- 若连续 3 句以上讨论他人方法而非自己方法 → 🔴 标记
- 若出现命名实体列表(如"MS-ADA [15]、PR-PL [17]、NSAL [18]"连续列举)→ 🔴 标记为文献综述越界
- 若出现具体生理/物理背景解释超过 2 句 → 🟡 标记为背景越界
严重度判定:
| 违规模式 | 严重度 |
|---|---|
| 小节开篇批评已有方法(≥2句) | 🔴 高 |
| 嵌入完整文献综述(≥3个方法名并列) | 🔴 高 |
| 用大量篇幅分析别人的失败原因 | 🔴 高 |
| 过度展开背景知识 | 🟡 中 |
| 一句话带过式动机陈述 | 🟢 低(可接受) |
合法内容:实验设置、性能表格、对比分析、消融实验、可视化、复杂度分析。 违规内容:重新解释方法原理、重复数据集预处理步骤(已在方法章描述过)、讨论性语言越界到讨论章。
检查方式:
- 扫描结果章是否与方法章存在大段重复(用相似度检查)
- 扫描是否出现「这表明我们提出的方法具有深远意义」类讨论句
- 检查实验设置是否与数据集预处理(方法章 2.1)重复
严重度:与讨论章内容重叠 → 🔴 高;与方法章重复 → 🟡 中。
合法内容:发现的意义和启示、与已有研究的对比讨论、局限性分析、未来方向。 违规内容:大面积复述结果数字而不讨论含义、重新描述方法流程、出现新实验数据。
检查方式:
- 扫描讨论章中数字+百分号的密度(如每 100 字出现 ≥2 个具体数字,疑似复述结果)
- 检查是否以「Freeze-Prev策略在K从3增至10的过程中准确率下降了4.7个百分点」这种逐项复述的方式组织段落
严重度:大幅复述结果数字 → 🔴 高。
检查方式:
- 检查所有 Heading 段落编号是否连续、层级一致
- 检查是否有重复标题(如两个"结果"章)
- 扫描是否有 TODO/待办/占位符文本残留
- 检查图表标题是否在正确的章节范围内
严重度:重复章节 → 🔴 高;编号不一致 → 🟡 中;TODO 残留 → 🔴 高。
审查输出必须包含以下三个部分:
## 📑 章节结构识别
| 章节 | 起止段落 | 段落数 | Heading样式 |
|------|----------|--------|-------------|
| 标题 | P0 | 1 | Heading 5 |
| 摘要 | P1-P3 | 3 | Heading 3 |
| 引言 | P4-P22 | 19 | Heading 3 |
| 研究方法 | P23-P117 | 95 | Heading 3 |
| ... | ... | ... | ... |
每个问题按以下格式输出:
### 🔴 严重违规 N:位置 → 违规类型
**位置**:PXX-PYY(章节名,小节名)
**原文**(关键句摘录):
> ...
**问题**:具体说明越界类型和为什么违规。
**建议修改**:
> 改写后的版本(用删除线标记删除内容,粗体标记新增内容)
## 📊 问题汇总表
| 编号 | 严重度 | 位置 | 类型 | 一句话描述 |
|------|--------|------|------|-----------|
## 🛠️ 修改优先级
### 立即处理(🔴)
1. ...
### 尽快处理(🟡)
1. ...
### 建议处理(🟢)
1. ...
-
方法章的核心红线:方法章的第一句话、每个小节的第一句话,主语都应该是「本框架/我们/该模块/该策略」,而不是「已有方法/传统策略/别人的名字」。这是判断边界违规的最高优先级信号。
-
一句话准则:方法章中涉及"别人的问题"或"背景知识"的论述,如果超过一句话,就应移至引言或大幅压缩。
-
疑罪从有:不确定是否越界时,宁肯标记出来让作者判断,不要漏掉。
-
只审不改:本 skill 负责审查和给出修改建议,不自动修改论文原文。用户确认后如需修改,由用户另行指示。
-
尊重学科差异:计算机/工程类论文方法章会包含少量设计动机说明(半句话到一句话),这不视为违规。违规的判定标准是"是否构成了对他人方法的系统性评价"。
用户: 帮我审查 D:\write\内容中文.docx 的章节规范性
→ 触发 coherent skill
→ 执行全部 6 项检查
→ 输出完整审查报告
用户: 只查方法章有没有写别人问题
→ 触发 coherent skill
→ 仅执行检查 3
→ 输出方法章专项报告