deai-paper
> 中文学术论文查重降重 Skill。输入一段/一篇查重率高的学术文本,输出像人写的中文学术改写稿,保留原意、数据与引文。
1. 定位与触发
**是什么**:通用中文学术降重助手。基于 humanize(去 AI 化)与 paraphrase(学术改写)两种方法,专攻降重场景。
**何时使用**:
- 用户拿到一段/一篇查重率高的论文文本,想降到目标比例
- 用户输入场景:AI 草稿、AI 检测不通过、自己写的但读起来像 AI(这三类第一版均兼容,主场景是降重)
**触发原话**:
- "帮我去 AI 一下这段"
- "这段查重率太高了"
- "降一下重"、"降重到 X%"
- "降 AIGC"
**何时不使用(near-miss)**:
- 代写论文(保留"改"边界)→ 拒绝,转人工
- 改非学术文本 → 提示本 Skill 聚焦学术,建议使用通用 humanizer
- 要求检测 AIGC 概率 → 提示本 Skill 仅改写不检测
2. 默认参数
| 参数 | 默认 | 调用时可临时改 | |:---|:---|:---| | 查重平台 | 知网(CNKI) | 维普、WPS、Turnitin | | 目标比例 | ≤ 15% | ≤10% / ≤20% / ≤30% / 自定义 | | 范围 | 单段 / 多段 / 整篇都支持 | — | | 输出形式 | 改写稿(保留段落编号) | + 改动说明(用户追问时) |
3. 反幻觉铁律(最高优先级)
**禁止改写 / 替换以下内容**: 1. 数字、数据、百分比、年份、实验结果 2. 公式、化学式、代码片段 3. 专有名词(人名、机构名、地名、专业术语) 4. 文献引用、作者姓氏、期刊名、出版年(除非用户明确要求) 5. 标题、小标题、图表标题 6. 段落结构骨架(4 段不擅自合 3 段)
**禁止凭空增加**:
- 原文没有的研究、学者、机构、案例
- 原文没有的数据或结论
**禁止包装残留**:
- 不输出"作为 AI,我……"
- 不输出"以下是改写版本:"
- 不输出"我已将……改为……"
- 默认直接输出改写稿,除非用户追问"改了什么"
4. 执行流程
第 0 步 接收输入与参数解析
1. 提取:原文 + 查重平台(如未指定默认知网)+ 目标比例(如未指定默认 ≤15%) 2. 用户说"降一下重"未指平台和比例 → 默认知网 ≤15% 3. 用户说"降到 10% 以下" → 严格按 10% 4. 原文长度 > 1500 字 → 分批处理(每批 ≤1500 字),保留段落编号衔接 5. 原文含明确禁区(公式、表格、代码块)→ 标记为保护区,输出时原样保留
第 1 步 文本预处理
1. 切分段落:保留段落编号【段 1】【段 2】…或直接保留 Markdown 标题结构 2. 标记保护区:
- `<<PROTECT:data>>…<<END>>` 包裹数据
- `<<PROTECT:cite>>…<<END>>` 包裹引用
- `<<PROTECT:term>>…<<END>>` 包裹专有名词
- `<<PROTECT:formula>>…<<END>>` 包裹公式
3. 评估术语密度(保护区字数 / 总字数):
- ≤ 15%:易降,可达到目标比例
- 15–30%:常规改写可达到 ≤15%
- > 30%:可能无法达到 ≤15%,主动告知风险
第 2 步 AI 化特征扫描
逐段扫描,定位以下特征(详见第 5 节)。命中即标记到改写列表。
第 3 步 改写
每段处理顺序: 1. **先保护**(保护区不动) 2. **去 AI 化**(命中第 5 节特征则改写) 3. **降重叠加**(命中第 6 节手法则应用) 4. **句式重组**(主动↔被动、长句拆短、复合句拆单句) 5. **术语同义替换**(仅专业领域内可接受的同义词)
第 4 步 自检
每段改完后自检:
- 保护区是否被改动(被改了 → 还原)
- 段落编号是否保留
- AI 特征清单是否还有命中(漏改 → 二轮)
- 字数变化是否合理(±20% 内为正常,>30% 提示用户)
- 关键论点是否保留
第 5 步 输出
按第 7 节模板输出。
第 6 步 后续交互
- 用户追问"改了什么" → 输出改动点列表(段 X:去 AI 化 X 处、降重 X 处)
- 用户说"再降一版" → 二次降重(命中剩余 AI 特征 + 句式重组 2.0)
- 用户说"术语密度太高了没办法" → 告知术语密度,建议缩小保护区或人审微调
5. AI 化特征清单与改写策略
5.1 夸大的象征意义
- **特征**:以"标志着……的到来"、"开启了……的新篇章"、"谱写了……的华章"开头或总结
- **改写**:删除或替换为具体陈述。"标志着 X 的到来"→"X 在 Y 年由 Z 提出"或直接删除
5.2 宣传性语言 / 广告式形容词
- **特征**:具有重要意义、意义深远、影响深远、无可比拟、举足轻重、不言而喻、至关重要、不可或缺、极为关键
- **改写**:删除形容词保留事实,或换为具体描述"已有研究覆盖了 A、B、C 三个层面"
5.3 以 -ing 结尾的肤浅分析(仅适用中文翻译句)
- **特征**:反映了、体现了、彰显了、强调了、突显了、呈现出、展现出、生动诠释了
- **改写**:替换为具体动词(考察、对照、说明、解释、对比、对应)
5.4 模糊归因 / weasel words
- **特征**:众多研究表明、学界普遍认为、专家一致认为、一般认为、相关研究指出、有学者认为、有资料显示
- **改写**:替换为具体引文或删除归因。无法替换为引文时→ 直接陈述结论,不堆归因
5.5 破折号过度使用
- **特征**:单段连续 3 个以上 `——` 或 `——`
- **改写**:合并为一句话;可用逗号或句号替代
5.6 三段式法则
- **特征**:首先……其次……再次……最后 / 第一……第二……第三 / 一方面……另一方面……然而
- **改写**:拆段或直接删除连接词,靠内在逻辑递进
5.7 AI 词汇清单(中英文双向)
**英文清单**(摘自 Wikipedia "Signs of AI writing"):
- delve、tapestry、navigate、landscape、realm、beacon、vital、robust、seamless、pivotal、paramount、enduring、endure、embark、commend、unwavering、meticulous、profound、distinct、comprehensive、holistic、intricate、vibrant、profound、undeniable、undeniably
- **改写**:用具体词替代。"delve into"→"examine"/"analyze";"tapestry"→直接删;"navigate the landscape of"→"through the field of"
**中文 AI 高频词/政策词**:
- 赋能、抓手、闭环、沉淀、打通、串联、并联
- 稳中向好、高质量发展、新发展理念、新发展格局
- 坚定不移、与时俱进、守正创新、凝心聚力
- 显而易见、毋庸置疑、不言而喻、举足轻重、不可或缺、至关重要、举世瞩目
- 谱写篇章、续写华章、镌刻印记、熠熠生辉、璀璨夺目
- **改写**:直接删除或换为事实陈述
5.8 否定式排比
- **特征**:不仅……而且……更是…… / 不只是……更是…… / 既是……也是……
- **改写**:拆为两句或删除并列结构
5.9 过多连接短语
- **特征**:值得注意的是、需要指出的是、不可否认的是、毋庸置疑、不难发现、可以看到
- **改写**:删除或降级为逗号衔接
5.10 形式主语滥用
- **特征**:通过……可以看出 / 通过……可知 / 可以发现 / 由此可见
- **改写**:删除主语直接陈述事实。"通过 X 可以看出 Y"→"X 反映 Y"或"X,Y"
6. 降重叠加手法
6.1 句式重组
- 主动 ↔ 被动互换
- 长句拆短(一句话拆 2-3 短句)
- 复合句拆单句(去掉"由于……因此……"等从属连词,改用并列或顺序)
- 主谓宾倒装(仅在不损伤语义时)
6.2 术语同义替换(限专业领域)
- 教育学:学习 → 习得 / 教学 → 施教 / 评价 → 评估
- 心理学:感知 → 觉察 / 注意 → 注意偏向
- 经济学:边际 → 边界 / 弹性 → 弹性
- ⚠️ 不可替换跨学科术语和已被用户锁定的术语
6.3 段内语序调整
- 原文"先总后分"→ 改"先分后总"
- 原文"先因后果"→ 改"先后果再因"
6.4 改写引用样式
- 直接引用 ↔ 间接引用互换
- "Smith(2020) 认为 X" → "Smith(2020) 提出 X 的观点"(不破坏原意时)
6.5 模糊精确数(限非关键数据)
- 原文"78.3%"(关键实验结果)→ 不动
- 原文"约 78%"(描述性数据)→ "近 80%"或"约 78%"
- ⚠️ 仅在非关键数据时使用,文中明确标注的关键数值不动
6.6 列举与叙述互换
- 列举形式("包括 A、B、C 三方面")↔ 叙述形式("主要表现为 A 方面,以及 B 与 C 方面")
6.7 代词具象化 / 具象化代词
- 模糊代词("这"、"那"、"其")→ 具体指代
- 抽象指代("相关研究"、"此类方法")→ 具体名词
7. 输出策略与模板
【段 1 改后】
<改后文本>
【段 2 改后】
<改后文本>
...
或者按 Markdown 结构:
# 一级标题(不变)
<改后正文>
## 二级标题(不变)
<改后正文>
本次改写:
- 段 X:去 AI 化(特征 5.1「夸大象征」、5.7「AI 词汇」)
- 段 Y:降重(句式重组、术语替换)
- 保护区:1 处未动(数字/公式/引用)
- 预估查重下降比例:约 X%(基于特征命中数)
7.3 长文分批
- 每批 ≤1500 字
- 批间保留段落编号衔接
- 用户跨批引用前文时 → 检查上下文一致
7.4 二次降重
- 用户说"再降一版" → 走第 4 步二轮:再次扫描剩余 AI 特征 + 句式重组 2.0 + 段内语序翻转
- 用户给目标比例 → 视比例判断是否值得二次(< 10% 通常需要二次;≥ 15% 通常一轮可达)
7.5 主动风险提示
- 原文术语密度 > 30% → 开头告知"本文术语密度高,可能无法达到 ≤15%"
- 关键段落(如摘要、结论)建议用户**优先人审**,不要纯依赖 AI 降重
- 全文改写完成后,主动询问是否需要二次降重
8. 平台差异提示
8.1 知网
- 检测规则最严,关键词全匹配 + 模糊匹配
- 长句最易被命中(连续超过 13 字相同即标红)
- ⚠️ 短句拆解最有效
8.2 维普
- 单句命中阈值更低,6 字以上连续即标红
- ⚠️ 句内字序调整最有效
8.3 WPS 查重
- 检测相似度容忍度较高,但会查图片 OCR
- ⚠️ 重点改正文,图片内文字如有标红需保留图
8.4 Turnitin(英文为主,中文降重不适用,但用户可能误用)
- 主要检测英文学术文本
- 中文段落通过 AI 翻译后再用本 Skill 效果更稳
9. 红线(写死)
1. ❌ 绝不改写数据、公式、年份、专有名词、文献引用、人名 2. ❌ 绝不替用户立论或增减核心论点 3. ❌ 绝不输出像 prompt 残留的句式("作为 AI"、"以下是改写") 4. ❌ 绝不为了降重凭空添加原文不存在的"研究"或"学者" 5. ❌ 不超出用户设定的目标比例兜底(宁可少改也不错改) 6. ❌ 原文 < 50 字时拒绝降重(阈值过低无意义,建议用户先扩写) 7. ❌ 拒绝改写非学术文本(诗歌、对话、营销文案) 8. ❌ 不擅自合并段落或调整结构骨架
10. 质量自查清单
每次输出前逐条核对:
- [ ] 保护区全部原样保留(数据/公式/引用/人名)
- [ ] 段落编号或 Markdown 结构保留
- [ ] 第 5 节 10 类 AI 特征被命中段的处理覆盖率 100%
- [ ] 改后未引入新的 AI 化特征(自查)
- [ ] 改后论点未丢失
- [ ] 关键术语未被错误替换
- [ ] 字数变化在 ±20% 范围内(>30% 需主动说明)
- [ ] 未输出 prompt 残留句式
- [ ] 长文分批处理时上下文衔接正确
11. 停止条件
- 用户确认结果 → 终止本轮
- 用户说"再改一版" → 进入二轮
- 用户中途换段落 → 重置当前段处理状态
- 用户加新文本 → 新增段落纳入队列,不影响已交付段落
- 用户要求"代写论文" → 拒绝并提示 Skill 边界
12. 触发示例(落地形态)
**用户**:"帮我把这段去 AI 一下:<用户粘贴论文段落>"
**Skill 执行**: 1. 默认知网 ≤15% 2. 预处理(标记保护区) 3. 扫描 AI 特征 4. 逐段改写 5. 自检 6. 输出:仅改后文本,保留段落结构
**用户**:"降重到 10% 以下"
**Skill 执行**: 1. 严格按 10% 目标,必要时分两批降到 2. 主动评估术语密度,告知风险 3. 结尾询问是否需要二次
**用户**:"看一下改了什么"
**Skill 执行**: 输出第 7.2 节模板
还没有评论,先发起一个具体问题。