AI论文检测靠谱吗?期刊AIGC检测系统工作原理全解析

AI论文检测

AI检测器是怎么判断一篇文章是不是AI写的?

从逻辑和算法上,是根据一些计算指标,而从我们自己的观感上,其实就是一篇文章有没有”AI味”。

当然,这个“AI味”其实可以用很“数学”的逻辑和公式来表述明白,这篇文章咱们就认真聊一聊这个问题。

一、底层逻辑:两个指标说了算

目前主流检测器,包括Turnitin、Copyleaks、GPTZero,核心都在算两个东西。一个叫困惑度,衡量的是这段话对语言模型来说”好不好猜”。

AI生成文本的本质是逐词挑出概率最高的那个词,所以句子特别顺,困惑度低,检测器一看,太顺了,可疑。

另一个叫突发性,人类写东西忽长忽短、偶尔蹦出一个出乎意料的词,AI则是匀速前进。两个指标一叠加,分数就出来了。

所谓AI检测,本质是概率指纹比对,不是阅读理解。

AI检测

二、为什么会有很高的“假阳性率”

假阳性率就是把一个人手写的东西,误判成AI生成的。

非母语作者写英文,用的往往是很标准的句式,词汇保守、句长均匀,和AI的概率特征高度重合。

斯坦福团队2024年发表在Patterns的研究里,几款主流检测器把非母语作者的作文成批判成AI生成,母语作者随手写的短文反而全部过关。

反方向的漏洞也存在:把AI生成的文本用改写工具过一遍,或者换个模型转述一遍,指标能大幅下降。

正是因为这个原因,所有的AI检测分数都只是参考证据,不是最终判决,这一点期刊编辑自己也承认。

我跟一些编辑聊过他们怎么搞AI检测。稿件进入编辑系统后会先过一轮自动化筛查。文字相似度用iThenticate,AI生成概率用Turnitin或Copyleaks的接口,图像部分用Proofig、Imagetwin这类工具查拼接、复制和生成痕迹。

任何一项亮红灯,稿件转人工复核,编辑拿着报告对照你的披露声明逐段看。

三、期刊的态度

Elsevier、Springer Nature、Wiley的政策大同小异,都允许用AI辅助语言润色、文献检索、代码调试,但要求投稿时如实披露。

而且,AI不能当作者,因为作者要为内容负责,AI负不了这个责。直接生成整篇稿件、用AI造图像,这个是严厉禁止的。

Nature 2023年的一项调查显示,大约三成研究者已经在写作中用上生成式AI,当然到了2026年,这个比例恐怕要高很多很多。所以,各家期刊心里也清楚这个趋势挡不住,所以政策的核心从来不是禁用,而是透明。

所以,作为作者,我这里提一点小小的想法。

首先,我非常建议大家投稿前都自己先测一轮,交叉两个工具,对高亮段落心里有数。写作过程留版本稿,从初稿到终稿的演化记录就是你的原创证明。

另外,披露声明也可以提前写好,工具名、用途、范围,一两句话说清,免得投稿之后被打回来补材料。

意得辑为您提供一站式SCI论文服务,从润色到翻译再到发表支持,是学术研究者信赖的专业选择。如果您需要关于SCI论文投稿指导与协助,欢迎访问意得辑官方网站(https://www.editage.cn/),我们将为您提供更多详细信息和专业建议。

看看其他文章

sci论文润色机构哪个好一点,sci论文润色机构推荐

润色英语论文的软件有哪些?论文润色软件推荐

SCI论文润色机构有哪些?SCI论文润色机构推荐

AI论文检测靠谱吗?期刊AIGC检测系统工作原理全解析插图2

上一篇: AI率检测:投稿前怎么自检AI痕迹?
下一篇: AI生成内容人工化怎么做?5个让AI文章更像人写的技巧