时间:2026-07-30 编辑整理:早检测网 来源:早检测网
Crossref这个名字在学术圈出现的频率很高,但多数人只闻其名不知其意。有人说它是查重系统,有人说它是DOI管理机构,还有人干脆把它跟CrossCheck混为一谈。
你在SCI论文的参考文献里一定见过DOI。每篇文献末尾那一串https://doi.org/10.xxxx/xxxxx,就是DOI。
但DOI背后是谁在管?大部分人不知道。答案是Crossref。
Crossref这个名字在学术圈出现的频率很高,但多数人只闻其名不知其意。有人说它是查重系统,有人说它是DOI管理机构,还有人干脆把它跟CrossCheck混为一谈。
今天从头说起。
https://www.zaojiance.net/CrossCheck/
先纠正一个流传很广的误解:Crossref不是查重系统。
Crossref是一个非营利组织,2000年由一批学术出版社联合创立。它的核心工作只有一件事——让学术产出更容易被发现、引用、链接和重用。
怎么做到?靠三样东西:
DOI注册。 每篇学术文章、每本书的章节、每份数据集、每个预印本,都可以获得一个DOI(Digital Object Identifier,数字对象唯一标识符)。DOI跟网址不一样。网址会变——网站改版、出版社搬迁、域名过期,链接就断了。DOI不会变。它永久指向这篇文献,不管它在哪个平台上。你点击一个DOI链接,Crossref的系统会自动把你转到这篇文献当前的实际位置。
元数据管理。 每注册一个DOI,Crossref同时收录这篇文献的完整元数据——标题、作者、发表日期、期刊名、参考文献列表、资助信息、ORCID、许可协议等等。目前Crossref数据库里有超过1.5亿条这样的记录,来自全球16,000多家成员机构。
引用链接(Reference Linking)。 这是Crossref最早的核心功能。一篇论文的参考文献列表里列了20篇文献,如果这20篇都在Crossref注册了DOI,读者点击任意一条引用,就能直接跳到原文。不同出版社之间的论文通过这个系统互相连通。在Crossref出现之前,出版社之间要签几百份双边协议才能实现引用链接。Crossref把这件事变成了一个公共基础设施。
简单说,Crossref是学术出版世界的"地址管理局+电话簿"。它不负责写论文、不负责审稿、不负责出版。它负责让每一篇已经出版的论文有一个永久的地址,并且能被找到。
很多人对Crossref的认知停在"注册DOI的"。实际上它干的事情远不止这些。
Crossmark。 论文发表后如果发现错误、需要更正、甚至撤稿,Crossmark系统会在文献上标注更新状态。读者看到一篇论文时,能通过Crossmark标记知道这篇文章有没有被更正过、撤稿过。这是学术记录完整性的重要保障。
资助信息(Funder Registry)。 Crossref维护了一个全球资助机构注册表。论文在Crossref注册元数据时可以标注"本研究由某某基金资助",方便追踪科研经费的产出。
ORCID集成。 ORCID——那个给每个研究人员分配唯一编号的系统——最初就是Crossref参与推动的。现在每篇论文的元数据里都可以关联作者的ORCID,解决"同名不同人"的问题。
开放API。 Crossref把它的元数据数据全部对外开放,每月有超过20亿次API查询。任何人都可以搜索、下载、分析这些数据。搜索引擎、学术数据库、文献管理工具背后都在调用Crossref的API。
Similarity Check。 这就是跟CrossCheck有关的部分,下面详细说。
Crossref在2008年做了一件事:它找到了iParadigms公司(后来被Turnitin收购),合作推出了一项面向学术出版界的查重服务。
逻辑很简单。Crossref自己不做查重软件,但它的成员——那些期刊和出版社——需要一个工具来筛查投稿的原创性。iParadigms有现成的检测引擎(就是iThenticate),Crossref有全球最大的学术文献数据库。两家一结合,就有了CrossCheck。
CrossCheck的正式名称后来改成了"Crossref Similarity Check"。但CrossCheck这个名字太深入人心了,到现在大家还是习惯叫它CrossCheck。
运作方式是这样的:
所以,CrossCheck不是Crossref自己开发的系统。它是Crossref组织的一项服务,底层引擎是iThenticate。Crossref提供数据入口和会员管理,iThenticate提供检测技术。
一个比喻:Crossref是机场,CrossCheck是机场里的一条安检通道。飞机(稿件)从Crossref进来,通过CrossCheck这条通道做安检(查重),安检设备是iThenticate造的。
这个问题直接关系到查重的覆盖面。Crossref的数据规模:
学术文献。 超过1.5亿条记录,涵盖期刊论文、会议论文、图书章节、学位论文、数据集、预印本等。
成员机构。 超过16,000家,分布在167个国家和地区。成员不只是出版社——高校、图书馆、资助机构、博物馆、政府组织都在里面。
DOI解析量。 每月平均14亿次。全球93%的DOI点击都经过Crossref的系统。
覆盖的内容类型。 期刊论文(SCI、SSCI、EI等)、国际会议论文(IEEE、ACM、Springer LNCS等)、图书章节、学位论文(主要是欧美的,通过ProQuest等平台注册)、预印本(arXiv、bioRxiv、medRxiv、SSRN等)、数据集、软件代码。
需要说明的是:Crossref本身不"收录全文"。它是一个元数据注册机构。成员机构把文献的元数据和DOI注册到Crossref,部分成员还授权了全文用于查重比对。所以,某篇文献是否出现在CrossCheck的查重比对库里,取决于它的出版方有没有把全文授权给iThenticate。
对于主流SCI期刊——Elsevier、Springer、Wiley、IEEE、ACS这些大社——全文基本都是覆盖的。但对于一些小型出版社、地区性期刊、或者没有加入Crossref的机构,覆盖就有盲区。
CrossCheck(Similarity Check)不对个人开放。它是Crossref给会员机构用的服务。你作为投稿人,想自查重复率,用iThenticate就行。iThenticate和CrossCheck共享同一个检测引擎和几乎相同的数据库。你用iThenticate查出来的结果,跟期刊用CrossCheck查出来的,在投稿版本一致、检测时间间隔不超过15天的前提下,基本一致。
你发表的论文如果注册了DOI(SCI期刊基本都会注册),它就进入了Crossref的系统。从此以后,全世界任何人在Crossref数据库里搜你的文章,都能通过DOI找到它。如果有人引用了你的论文并且也注册了DOI,引用链也会自动建立。
如果另一篇新投稿的稿件跟你发表过的论文有大段重复,期刊编辑用CrossCheck一查就能发现。这就是Crossref数据库在防抄袭和一稿多投方面的价值。
如果你的论文需要更正或撤稿,通过Crossmark标注后,所有通过DOI访问这篇论文的人都能看到提醒。这不是什么愉快的场景,但它是学术记录完整性的必要机制。
"Crossref是一个查重系统吗?" 不是。Crossref是DOI注册和元数据管理组织。它提供了一项查重服务(CrossCheck/Similarity Check),但查重不是它的主业。
"CrossCheck和iThenticate是什么关系?" CrossCheck是Crossref给会员提供的查重服务品牌,底层技术是iThenticate。你可以把它们理解为"服务"和"引擎"的关系。
"Crossref数据库和iThenticate数据库是同一个吗?" 不完全是。iThenticate的数据库包括:学术文献、互联网网页、出版商内容等。CrossCheck通过Crossref的会员网络额外获得了所有已注册DOI论文的内容比对权限。两者的核心重合度很高,但不是完全等同。
"个人能用CrossCheck吗?" 不能。CrossCheck只对Crossref会员机构开放。个人自查用iThenticate。
"Crossref能查中文论文吗?" 覆盖有限。Crossref的成员以国际出版社为主,中文期刊加入Crossref的比例不高。知网、万方等中文数据库不在Crossref体系内。如果你的论文引用了中文文献,iThenticate/CrossCheck未必能比对到。
Crossref是学术出版世界的基础设施。它不写论文、不审稿、不出版。它做的是让每一篇论文有一个永久的地址(DOI),让论文之间的引用可以互相连通,让元数据可以被所有人查找和使用。
CrossCheck(现在叫Similarity Check)是Crossref提供的一项查重服务。Crossref自己不开发查重技术,它用iThenticate的引擎来做这件事。
对科研人员来说,Crossref最重要的存在方式是:你的论文发表后通过DOI进入它的系统,从此被全世界发现和引用。而CrossCheck的价值在于:它帮你守住投稿这一关——你的稿件有没有大面积抄袭、有没有跟已发表论文撞车,编辑用CrossCheck一查就知道。
这三个名字的关系,记住一句话就够了:Crossref是组织,CrossCheck是服务,iThenticate是技术。三者组合在一起,构成了全球学术出版领域最主流的查重体系。