先说结论:SCI期刊查重用的是 iThenticate,不是 Turnitin。
这两个系统虽然同属一家公司(美国 Turnitin LLC),但定位完全不同。iThenticate 是给科研出版用的,Turnitin 是给高校教学用的。你在投 SCI 论文时,编辑后台调用的查重系统是 iThenticate——更准确地说,是通过 Crossref 的 Similarity Check 服务来调用。
很多人搞混了。有人拿 Turnitin 查出来 8% 的重复率,兴冲冲投出去,编辑用 iThenticate 一查,28%。也有人花大价钱查了 iThenticate,结果学校毕业论文只认 Turnitin 的结果。
两个场景,两个工具,不能混用。
iThenticate查重系统入口
https://www.58sci.com/ithenticate/index.html
一、SCI期刊到底用什么查重?
Crossref——全球最大的学术出版元数据组织——运营着一项叫 Similarity Check 的服务(早年叫 CrossCheck)。这项服务的底层查重引擎就是 iThenticate。
据 Crossref 官方文档,Similarity Check 的工作方式是:出版商将自己期刊论文的全文 URL 注册到 Crossref,Turnitin 据此索引这些内容,形成比对数据库。出版商在审稿流程中通过 iThenticate 提交新稿件,系统自动与数据库中的已发表内容比对,生成相似度报告。
目前的数据是:
也就是说,SCI 期刊的查重流程是标准化的:编辑收到稿件 → 系统自动调用 iThenticate → 生成相似度报告 → 编辑根据报告判断是否需要修改或拒稿。
Turnitin 不在这个流程里。
二、两者的数据库差异
这是造成查重结果不同的根本原因。
iThenticate 的数据库:学术出版为核心
iThenticate 的比对库主要由以下内容构成:
关键点:iThenticate 的数据库以已发表的学术内容为主,不包含学生作业库。
Turnitin 的数据库:教育场景为核心
Turnitin 的比对库构成不同:
一句话概括差异:iThenticate 的长板是期刊论文和学术出版物,Turnitin 的长板是学生作业库。
三、同一篇论文,为什么两个系统查重率不同?
同一个作者、同一篇稿件,在 Turnitin 和 iThenticate 中查出来的相似度可能差很多。原因有五个。
1. 数据库覆盖范围不同
这是最大的变量。
你的论文引言部分引用了一段 2023 年发表在 Journal of Materials Chemistry A 上的内容。iThenticate 索引了这本期刊,会标出匹配。Turnitin 如果没有收录这本期刊的全文,就查不出来。
反过来,你的方法部分跟某篇 2022 年清华大学硕士论文高度相似。Turnitin 的学生论文库里有这篇论文,会标出来。iThenticate 没有学生作业库,查不到。
所以:iThenticate 对学术出版物的检测更全,Turnitin 对学生间的互相抄袭更敏感。
2. 排除设置(exclusion options)不同
iThenticate 提供了更精细的排除选项:
Turnitin 也有排除选项,但默认设置通常更严格——很多高校配置的 Turnitin 不默认排除参考文献,也可能不排除引用。这意味着 Turnitin 的报告里,参考文献列表中的匹配会被计入总相似度,拉高数字。
同样的论文,一个排除了参考文献,另一个没排除,结果当然不同。
3. 算法匹配灵敏度不同
两个系统虽然同属一家公司,但底层算法针对不同场景做了调优。
iThenticate 更注重句子结构和语义级别的匹配——它比对的不仅是连续的文字串,还考虑句子的结构相似性。这让它能检测到"换了几个词但句子结构没变"的情况。
Turnitin 的算法相对更依赖连续词串匹配,对模板化语言和学生常见的改写手法比较敏感。
4. 机构自定义设置
Turnitin 允许高校管理员自定义检测配置:是否比对本校学生论文库、是否排除引用、是否排除参考文献、Small Matches 的阈值等。不同学校的 Turnitin 配置可能完全不同。
iThenticate 的设置由期刊编辑部或出版商控制,配置逻辑也不同。
所以同一个作者在不同机构用 Turnitin 查重,结果都可能不一样。
5. 报告呈现方式不同
iThenticate 的 Similarity Report 提供 Match Groups 功能,将相似来源归类合并,还配有 Flags Panel 标记被篡改的文本(如替换字符、隐藏字符)。报告格式适合科研编辑快速判断原创性。
Turnitin 的 Similarity Report 更侧重于逐段标注和教学场景下的抄袭检测,突出的是段落级别的直接复制。
报告的视觉呈现和分类逻辑不同,会让使用者对"重复率"的感知产生差异——即使底层匹配数据类似。
四、差异到底有多大?
根据 iThenticate 中文网站引用的案例统计,同一篇 SCI 投稿论文:
但这个数字仅供参考,实际差异取决于论文内容特征:
所以不存在一个固定的"换算公式"。两个系统的结果就是不可直接对比。
五、不同身份该用哪个?
表格
场景 | 用哪个 | 原因 |
|---|---|---|
本科生交课程作业 | Turnitin | 学校系统就是它 |
本科/硕士毕业论文 | Turnitin | 学校指定 |
博士毕业论文(不投稿) | Turnitin | 学校要求 |
博士毕业论文(同时准备投稿) | 两个都用 | 学校查 Turnitin,投稿查 iThenticate |
投 SCI/SSCI/EI 期刊 | iThenticate | 出版社指定 |
投国际会议论文 | iThenticate | 顶会大多用它 |
申请国外 PhD 交 writing sample | iThenticate | 招生办查得严 |
评职称提交代表作 | 看单位要求 | 有的要知网,有的要 iThenticate |
核心判断标准:你的论文最终要过哪个系统的检测,就用哪个做自查。
投 SCI 论文,最终过的是 iThenticate。你用 Turnitin 查出来 8%,不代表投出去也是 8%。那是一种虚假的安全感。
六、常见误区
误区一:"Turnitin 查不到就没事
Turnitin 查不到 ≠ 不存在重复。只是 Turnitin 的数据库没收录那篇来源。iThenticate 可能收录了。编辑用的不是 Turnitin。
误区二:"两个系统都是同一家公司,结果应该差不多
同一家公司做的两个产品,数据库不同、设置不同、算法侧重不同。就像同一个汽车集团出的轿车和卡车——发动机可能共享,但用途和调校完全不同。
误区三:"iThenticate 比 Turnitin 贵,所以更好
不是"更好",是"更适合 SCI 投稿场景"。Turnitin 在教学场景下比 iThenticate 更有效,因为它有庞大的学生作业库来检测同学间的互相抄袭。价格差异反映的是定位不同,不是绝对的质量高低。
误区四:"查重率越低越好
两个系统都不是追求零重复。iThenticate 的报告显示的是 Similarity Index(相似度指数),不是"抄袭率"。参考文献列表的匹配、直接引用的匹配、方法学标准化表述的匹配——这些都被计入相似度,但不代表抄袭。编辑看的是排除后的数字、单源匹配比例和匹配内容所在章节,不是只看总数。
误区五:"我的学校提供 Turnitin 账号,用它查 SCI 论文就行了
学校提供 Turnitin 是为了教学管理。用它查 SCI 论文,数据库不对口,结果参考价值有限。投稿前做一次 iThenticate 自查,成本不高,但能让你提前发现 Turnitin 看不到的问题。