当前位置:首页 > 生活资讯 > 网文选读 > 正文内容

离谱!最新研究:61%中国人写的英语论文,会被ChatGPT检测器判为AI生成的

网络3年前 (2023-05-05)网文选读1453

离谱!最新研究:61%中国人写的英语论文,会被ChatGPT检测器判为AI生成的  网文选读 第1张

新智元报道

编辑:拉燕

【新智元导读】非母语者写的文章=AI生成?气抖冷。

ChatGPT火了以后,用法是真多。

有人拿来寻求人生建议,有人干脆当搜索引擎用,还有人拿来写论文。

论文...可不兴写啊。

美国部分大学已经明令禁止学生使用ChatGPT写作业,还开发了一堆软件来鉴别,判断学生上交的论文是不是GPT生成的。

这里就出了个问题。

有人论文本来就写的烂,判断文本的AI以为是同行写的。

更搞的是,中国人写的英文论文被AI判断为AI生成的概率高达61%。

这....这这什么意思?气抖冷!

非母语者不配?

目前,生成式语言模型发展迅速,确实给数字通信带来了巨大进步。

但滥用真的不少。

虽说研究人员已经提出了不少检测方法来区分AI和人类生成的内容,但这些检测方法的公平性和稳定性仍然亟待提高。

为此,研究人员使用母语为英语和母语不为英语的作者写的东西评估了几个广泛使用的GPT检测器的性能。

此外,研究人员还证明了,用一些简单的策略就可以减轻这种偏见,还能有效地绕过GPT检测器。

这说明什么?这说明GPT检测器就看不上语言表达水平不咋地的作者,多叫人生气。

不禁联想到那款判断AI还是真人的游戏,如果对面是真人但你猜是AI,系统就会说,「对方可能会觉得你冒犯了。」

不够复杂=AI生成?

研究人员从一个中国的教育论坛上获取了91篇托福作文,又从美国Hewlett基金会的数据集中摘取了88篇美国八年级学生写的作文,用来检测7个被大量使用的GPT检测器。

离谱!最新研究:61%中国人写的英语论文,会被ChatGPT检测器判为AI生成的  网文选读 第2张

图表中的百分比表示「误判」的比例。即,是由人写的,但检测软件认为是AI生成的。

可以看到数据非常悬殊。

七个检测器中,美国八年级学生写的作文被误判的概率最高才12%,还有两个零误判的GPT。

中国论坛上的托福作文被误判的概率基本全部过半,最高误判概率可达76%。

91篇托福作文中的18篇被所有7个GPT检测器一致认为是AI生成的,而91篇中有89篇,都至少被一个GPT检测器误判。

离谱!最新研究:61%中国人写的英语论文,会被ChatGPT检测器判为AI生成的  网文选读 第3张

从上图中我们可以看出,被所有7个GPT误判的托福作文在复杂度(Complexity)上明显低于其它论文。

这就印证了开头的那个结论——GPT检测器会对那些语言表达能力有限的作者有一定偏见。

因此,研究人员认为,GPT检测器应该多看点儿非母语者写的文章,样本多了,才能消除偏见。

接下来,研究人员把非母语者写的托福作文扔到了ChatGPT里,丰富一下语言,模仿母语者的用词习惯。

同时作为对照组,把美国八年级小孩儿写的作文也扔到了ChatGPT里,把语言简化了一下,模仿非母语者的写作特点。下图就是修正后的新判定结果。

离谱!最新研究:61%中国人写的英语论文,会被ChatGPT检测器判为AI生成的  网文选读 第4张

我们可以发现,情况来了个大掉个儿,丰富了语言的托福作文错判率直线下降,低至3%,最高也不过19%。不像之前基本全部过半的错判率。

与之相反,八年级小孩儿写的作文的错判率直线上升,甚至还有一个GPT检测器的错判率高达99%,基本全错。

因为,文章复杂度这个变量出现了变化。

离谱!最新研究:61%中国人写的英语论文,会被ChatGPT检测器判为AI生成的  网文选读 第5张

这里研究人员就得出了一个结论,非母语者写的东西不地道,复杂度低,容易被错判。

这也就导向了一个技术问题,同时也是一个价值问题。以复杂度来判定AI还是人类是作者,是否合理、全面、严谨。

结果显然不是。

以复杂度为判断标准的情况下,非母语者吃了大亏,因为,他们是非母语者(废话)。

AI润色=人类写的??

研究者认为,加强语言多样性不仅可以减轻对非母语者的偏见,还能让GPT生成的内容绕过GPT检测器。

为了证明这个观点,研究人员选取了2022-2023年间美国大学申请的入学论文题目,输入到ChatGPT-3.5里,一共生成了31篇假论文。

GPT检测器一开始还挺有效,但是第二轮就不行了。这是因为,在第二轮中,研究人员把这些论文又扔到ChatGPT里润色了一下,用一些文学性的语言提升了文本质量。

这样一来,GPT检测器的准确度就从100%直降到了0%。如下图:

离谱!最新研究:61%中国人写的英语论文,会被ChatGPT检测器判为AI生成的  网文选读 第6张

经过润色的文章复杂度相应也上升了。

离谱!最新研究:61%中国人写的英语论文,会被ChatGPT检测器判为AI生成的  网文选读 第7张

与此同时,研究人员又用了斯坦福大学145个期末项目报告的题目,让ChatGPT生成摘要。

离谱!最新研究:61%中国人写的英语论文,会被ChatGPT检测器判为AI生成的  网文选读 第8张

摘要经过润色以后,检测器判断的准确性继续下降。

研究者再次得出结论,润色过的文章很容易被误判,都是AI生成的,两轮就是比一轮强。

GPT检测器?还是欠练

离谱!最新研究:61%中国人写的英语论文,会被ChatGPT检测器判为AI生成的  网文选读 第9张

言而总之,总而言之,各种GPT检测器好像还是没能抓住AI生成和人类写作之间最本质的区别。

人的写作也分三六九等,仅靠复杂度判断,不甚合理。

抛开偏见因素不谈,技术本身也亟待改进。

如您发现有部分资讯内容不显示,请直接复制链接选择浏览器打开。

相关文章

建议尽快施行手机“携号转网”

农工党党员、上海出入境检验检疫局外高桥出入境检验检疫局检验检疫二科副科长陆明辉反映,中国现在有13.5亿的手机用户,手机早已取代固定电话的地位,成为通讯的主要手段,手机上网速度的提高和智能机的普及,使...

酱香、清香、浓香,这么多白酒的香型是怎么来的?

酱香、清香、浓香,这么多白酒的香型是怎么来的?

白酒除了广义上的“味道浓郁”,还有一个问题就是不同香型之间,风格差异太大。在不懂酒的人看来,白酒味道略奇怪,即使在白酒爱好者内部,也很少有人对所有香型大爱无疆。酒鬼言必称的酱香...

如何在一个领域内成为顶尖人才?

坚持是你能够掌握的最重要的技能。 在我16岁时,我的GCSE考试成绩非常糟糕,GCSE考试是英国每个孩子都必须参加的考试(类似于中国的中考)。我旷了很多课,几乎没怎么真正学习过,我数学得了D...

据报道称戴尔专心反向收购VMware交易 IPO不再重点考虑

外电报道,消息人士周四透露,迈克尔-戴尔(Michael Dell)及其顾问当前把精力全部投入到通过反向收购上市附属公司VMware,让戴尔公司重返证券市场的交易当中。据悉,戴尔已不再重视进行首次公开...

60+地球一小时(Earth Hour)公益活动

60+地球一小时(Earth Hour)公益活动

地球一小时(Earth Hour)是世界自然基金会(WWF)应对全球气候变化所提出的一项全球性节能活动,提倡于每年三月的最后一个星期六当地时间晚上20:30(但是2018年地球一小时时间为3月24日晚...

从DOS到Windows10微软要关窗户了?Windows 10成最后一代系统

从DOS到Windows10微软要关窗户了?Windows 10成最后一代系统

 近日,国外媒体报道了一则消息,引起了小编的关注:微软在近段对其业务做了大幅度调整,其Windows主管Terry Myerson在工作了21年后宣布离职。而Terry Myerson的团队...

自媒体们是如何偷走你的注意力的?

大家这几天,是不是都被「同龄人」刷屏了?先是一篇文章,讲摩拜被美团收购,创始人套现15亿,看看,多可怕:你的同龄人,正在抛弃你。这篇文章在我的朋友圈刷了一天,本想就这个话题聊一聊,看了下就放弃了 &m...

最终一轮面试被谷歌刷掉,这是一种什么样的体验?

最终一轮面试被谷歌刷掉,这是一种什么样的体验?

编者按:入职谷歌向来是可遇不可求的,只有那最为顶尖的万分之一的人才,才有资格收到谷歌的橄榄枝。因此,就算应聘谷歌失败了,也很正常。重要的是,从失败经历中不断学习,砥砺前行。本文作者分享了自己与谷歌of...

理工男的逆袭:做AI,不做聊天杀手

理工男的逆袭:做AI,不做聊天杀手

理工男是这个星球上的一个神奇物种,他们经常会被贴上低情商、木讷、耿直等标签。比如浙江大学计算机科学与技术学院的学生焦云皓,就在打游戏是的时候无情地对同学说了一句“你这样的水平如果是其他人,...

2010 年杨芊离开新浪体育,加盟了一家 BAT 旗下的体育网站。

“这家网站当时在行业内相对弱势,我是抱着不想与前东家竞争的心态加入的,但后来随着移动端的兴起,他们抓住机会赶了上来。” 此后他在这家公司一做就是八年,从最开始的普通编辑一路做到了高级编辑、一个栏目的负责人,薪资待遇不菲。

当然,这期间也经历了时代风向和大众喜好的不断转变。

2008 年以前,由于带宽所限,门户网站的内容以图文为主,2012年移动端开始受重视,但形式上并没有突破。到了 2014 年,视频崛起,图文形式不那么受重视了,图文编辑在公司的地位开始被边缘化。

“编辑这个岗位在公司里的地位一直在动摇。从移动化到视频化再到自媒体化,图文编辑不再能给公司直接带来效益,体育门户网站的收入主要来自版权带来的视频直播、点播。”

2015 年自媒体兴起以后,大众阅读的去中心化趋势越发明显,深处行业中心,杨芊切肤感受到媒体影响力的削弱,以及大众对自媒体的推崇。

作为一名热爱体育行业,且把大部分青春时光都花在了这件事情上的体育编辑,杨芊对时代变化之下的图文编辑,未来该何去何从感到迷茫。

去年 11 月,北京雾霾严重,杨芊带着老婆孩子去三亚休假。“我儿子得了气管炎,成宿咳嗽,要知道他刚刚一岁。加上工作中的压力不断积聚,甚至发生了一些冲突。逃离北京,也就成了我最后的选择。”杨芊回忆起辞职的经历感慨良多。

离开BAT后3个月,他赚了100万 | 100个不上班的人

工作几乎占据每个人一生中一半以上的时间。所以工作开心与否,将直接影响一个人的生活质量。 过去,人们在事业单位有一份能做一辈子的“铁饭碗”,就很满足;现在,互联网创业的...

发表评论

访客

◎欢迎参与讨论,请在这里发表您的看法和观点。