查重系统通常是整篇论文都会扫描,但不是所有内容都计入重复率。系统会根据格式自动识别并排除某些部分。
一、必查的核心部分(计入重复率)
以下内容是查重的核心检测对象,重复率计算主要来自这些部分:
摘要(中英文) :论文的精华浓缩,反而更容易被查出重复。摘要字数虽少,但每一句都在查重范围内。
正文全文:从引言/绪论到结论的全部文字内容,包括文献综述、研究方法、实验过程、数据分析、结果讨论等所有章节。这是查重占比最大、最容易被标红的部分。
致谢:多数系统会检测致谢部分。如果直接抄网上的通用模板,很容易被标红。
附录:部分学校要求检测附录。如果附录里放了调查问卷、原始数据等文字内容,且与他人雷同,也会被标红。
二、自动排除的部分(不计入重复率)
以下内容在格式规范的前提下,系统会自动识别并排除,不计入总文字复制比:
封面:学校统一模板,系统识别后自动排除。
原创性声明与授权书:系统自动识别并排除。
目录:必须用Word“引用→自动生成目录”功能生成,系统才能识别并排除。手动敲的目录会被当成正文检测。
参考文献列表:格式必须规范(如GB/T 7714标准),系统才能识别为引用区并排除。格式错乱会被当成正文检测导致标红。
页眉页脚、页码:系统自动识别排除。
三、不同查重系统的差异
知网查重 是分章节检测,依据目录自动识别封面、目录、文献等内容。本科论文建议用知网PMLC系统,包含大学生联合比对数据库。知网采用模糊算法,简单换几个字词并不能降低重复率。知网检测还设有一个5%的阈值,即一个段落中低于5%的相似内容可能不会被标记。
维普查重 规则更严格,更关注关键词密度和短句匹配。如果你的论文里某个专业术语反复出现太多次,即便句子结构完全不同,维普也可能判为重复。社科类论文在维普的重复率常比知网高5%到15%。
四、容易被忽略的细节
1. 表格内文字会被检测。 如果表格内容直接复制他人的,会被标红。
2. 图片、公式通常不检测。 用公式编辑器插入的公式、图片中的文字一般不被检测。但纯文字截图有一定概率被知网识别出来——文字越多、图片越清晰,被识别出来的几率越大。
3. 独创性声明等排除部分可能被误扫。 如果这些部分被系统识别为论文内容,可能导致大片标红、整体重复率升高。因此提交时务必按学校模板规范排版。
4. 参考文献格式不规范会被当成正文检测。 缺序号、标点全角半角混乱、不是独立区块等问题,都可能导致参考文献被标红。
5. 学位论文诚信承诺书、独创性声明、使用授权书等内容不参与查重。
6. 附件已发表论文建议检测时去除,以免自引率过高。
五、提交建议
绝大多数学校要求上传完整排版后的全文电子版(Word或PDF),从封面一直到致谢或附录,而不是只传正文。提交前确认:
- 目录用Word自动生成功能
- 参考文献格式严格规范
- 致谢自己写,别抄模板
- 附录按学校要求处理
格式规范是避免误判的前提。格式不规范,该排除的可能被当成正文检测,重复率虚高。