大四下学期,我论文经历了三轮折腾。先改维普查重,再改维普AIGC检测,最后改斟知智评。三周全部搞定,三项指标都合格了,我开心的不行,觉得终于解放了。结果答辩前一周,学长说了一句,你再查一遍维普AIGC检测吧,数据库更新了。我当时觉得没必要,但还是查了。结果显示AI疑似率从百分之十二涨到了百分之二十八。我整个人都傻了,论文一个字没改,数据自己变了。
后来我才知道,维普AIGC检测系统会定期更新算法和数据库。之前查出来低,不代表两周后还低。新算法对混合写作的检测灵敏度提升了很多,原来混合写作AIGC率普遍在20%到30%,升级后同样的混合文本飙到40%到55%。我那段“人工修改过的AI生成段落”,之前没被识别出来,新算法一查就暴露了。
赶紧找学长帮忙。他说你上次改的时候只做了表面功夫,没有从根上打破规整感。这次他让我用更彻底的方法,把那些段落的核心意思提炼出来,写在纸上,然后合上所有材料重新写一遍。不光要换词换句式,连段落的叙述顺序都得变。原来先写背景再写问题,现在直接从问题切入再倒回去解释背景。我熬了三个晚上重新改了一遍,再查降到了百分之十五,终于压回红线以下。
维普AIGC检测还有个新变化,增加了模板特征识别,从粗粒度改细粒度,拆到短语级别识别AI高概率词组共现模式。我原来以为改了句子长度就行了,结果新算法抓的是词语搭配组合。后来我刻意打乱了常用的学术词组搭配,“基于上述分析”改成“从上面这些数据来看”,“综上所述”改成“总的来看”,“本研究”换成“这个研究”。这些小改动看着不起眼,但正好命中了新算法的盲区。
学长说,维普AIGC检测升级后有三个新变化。第一个是多语言互译法彻底失效了,以前中英日来回翻译那一套完全不管用,新算法会追踪翻译痕迹。第二个是引入了跨段落关联分析,看第一段和第五段之间有没有隐含的结构循环,AI写长文每隔三四段就会出现一次结构循环。第三个是引用密度检查,以前只要引用格式对就行,现在如果你的一段话里突然塞进去几个文献,它直接判定为AI生成。
我后来把斟知智评也重新提交了一次,因为斟知智评和维普AI智评是完全相同的一套系统,只是叫法不同,检测入口、算法、数据库、报告格式完全一致,结果互通互认。新提交的报告显示逻辑结构也有变化,因为改AIGC的时候动了段落顺序,影响了逻辑链条。我又花了两天重新调整了逻辑衔接,才最终定稿。
毕业答辩前一周,我把所有检测重新跑了一遍。维普查重百分之十一,维普AIGC检测百分之十五,斟知智评评级B。三项全过,才敢安心准备答辩。论文检测不是一次性的事,算法会更新,数据库会变,定稿前两周再做一次最终验证,确保万无一失。📊
