万维读者网 > 信息时代 > 正文

离谱！61%中国人写的英语论文会被ChatGPT判为

www.creaders.net | 2023-05-04 22:31:30 新智元导读 | 0条评论 | 查看/发表评论

非母语者写的文章=AI生成？气抖冷。

ChatGPT火了以后，用法是真多。

有人拿来寻求人生建议，有人干脆当搜索引擎用，还有人拿来写论文。

论文...可不兴写啊。

美国部分大学已经明令禁止学生使用ChatGPT写作业，还开发了一堆软件来鉴别，判断学生上交的论文是不是GPT生成的。

这里就出了个问题。

有人论文本来就写的烂，判断文本的AI以为是同行写的。

更高的是，中国人写的英文论文被AI判断为AI生成的概率高达61%。

这....这这什么意思？气抖冷！

非母语者不配？

目前，生成式语言模型发展迅速，确实给数字通信带来了巨大进步。

但滥用真的不少。

虽说研究人员已经提出了不少检测方法来区分AI和人类生成的内容，但这些检测方法的公平性和稳定性仍然亟待提高。

为此，研究人员使用母语为英语和母语不为英语的作者写的东西评估了几个广泛使用的GPT检测器的性能。

研究结果显示，这些检测器始终将非母语者写作的样本错误地判定为AI生成的，而母语写作样本则基本能被准确地识别。

此外，研究人员还证明了，用一些简单的策略就可以减轻这种偏见，还能有效地绕过GPT检测器。

这说明什么？这说明GPT检测器就看不上语言表达水平不咋地的作者，多叫人生气。

不禁联想到那款判断AI还是真人的游戏，如果对面是真人但你猜是AI，系统就会说，“对方可能会觉得你冒犯了。”

不够复杂=AI生成？

研究人员从一个中国的教育论坛上获取了91篇托福作文，又从美国Hewlett基金会的数据集中摘取了88篇美国八年级学生写的作文，用来检测7个被大量使用的GPT检测器。

图表中的百分比表示“误判”的比例。即，是由人写的，但检测软件认为是AI生成的。

可以看到数据非常悬殊。

七个检测器中，美国八年级学生写的作文被误判的概率最高才12%，还有两个零误判的GPT。

中国论坛上的托福作文被误判的概率基本全部过半，最高误判概率可达76%。

91篇托福作文中的18篇被所有7个GPT检测器一致认为是AI生成的，而91篇中有89篇，都至少被一个GPT检测器误判。

从上图中我们可以看出，被所有7个GPT误判的托福作文在复杂度（Complexity）上明显低于其它论文。

这就印证了开头的那个结论——GPT检测器会对那些语言表达能力有限的作者有一定偏见。

因此，研究人员认为，GPT检测器应该多看点儿非母语者写的文章，样本多了，才能消除偏见。

接下来，研究人员把非母语者写的托福作文扔到了ChatGPT里，丰富一下语言，模仿母语者的用词习惯。

同时作为对照组，把美国八年级小孩儿写的作文也扔到了ChatGPT里，把语言简化了一下，模仿非母语者的写作特点。下图就是修正后的新判定结果。

我们可以发现，情况来了个大掉个儿，丰富了语言的托福作文错判率直线下降，低至3%，最高也不过19%。不像之前基本全部过半的错判率。

与之相反，八年级小孩儿写的作文的错判率直线上升，甚至还有一个GPT检测器的错判率高达99%，基本全错。

因为，文章复杂度这个变量出现了变化。

这里研究人员就得出了一个结论，非母语者写的东西不地道，复杂度低，容易被错判。

这也就导向了一个技术问题，同时也是一个价值问题。以复杂度来判定AI还是人类是作者，是否合理、全面、严谨。

结果显然不是。

以复杂度为判断标准的情况下，非母语者吃了大亏，因为，他们是非母语者（废话）。

AI润色=人类写的？？

研究者认为，加强语言多样性不仅可以减轻对非母语者的偏见，还能让GPT生成的内容绕过GPT检测器。

为了证明这个观点，研究人员选取了2022-2023年间美国大学申请的入学论文题目，输入到ChatGPT-3.5里，一共生成了31篇假论文。

GPT检测器一开始还挺有效，但是第二轮就不行了。这是因为，在第二轮中，研究人员把这些论文又扔到ChatGPT里润色了一下，用一些文学性的语言提升了文本质量。

这样一来，GPT检测器的准确度就从100%直降到了0%。如下图：

经过润色的文章复杂度相应也上升了。

与此同时，研究人员又用了斯坦福大学145个期末项目报告的题目，让ChatGPT生成摘要。

摘要经过润色以后，检测器判断的准确性继续下降。

研究者再次得出结论，润色过的文章很容易被误判，都是AI生成的，两轮就是比一轮强。

GPT检测器？还是欠练

言而总之，总而言之，各种GPT检测器好像还是没能抓住AI生成和人类写作之间最本质的区别。

人的写作也分三六九等，仅靠复杂度判断，不甚合理。

抛开偏见因素不谈，技术本身也亟待改进。

0

相关新闻

Meta业务大洗牌查克柏格宣布组建新部门	苹果首款AI眼镜终极曝光要引爆整个行业?
苹果AI发展缓慢被批恐会步Nokia后尘	热议：10大最易被AI淘汰职业！第一名超意外
辉达下一个“万亿级美元商机”，来了	比DeepSeek还具威胁性！这家中国AI公司引发关注
2名中国AI人才高调加入辉达晒与黄仁勋合影	跟谷歌、微软拼了 OpenAI将推AI版Office
AI学会撒谎与威胁？专家忧发展失控	OpenAI开始租用Google芯片
逮住OpenAI猛薅 Meta又挖走4位知名研究人员	“机器人胶囊” 震撼世界吞下能无痛检查胃
软银拼当超级AI领头羊	川普高招果然有用 DeepSeek新模型难产
英伟达夺回全球市值王黄仁勋身价暴增	人类会与AI相爱吗？
扎克伯格开出$1亿天价挖人亲发邀请被误为诈骗	Tesla试运营无人出租车安全员陪同每次$4.2
华为鸿蒙6来了众多关键能力升级全面拥抱AI	全球扫地机器人5强中国企业包办前4

“人工智能AI”

当前新闻共有0条评论

分享到：

评论前需要先登录或者注册哦

全部评论

暂无评论上一页下一页

实用资讯

抗癌明星组合多年口碑保证！天然植物萃取有效对抗癌细胞
中老年补钙必备，2星期消除夜间抽筋、腰背疼痛，防治骨质疏松立竿见影

24小时新闻排行榜

1	空姐坦白：机组人员在飞行中这样“发生性
2	红色家族海外财产达二十万亿习近平犯下两
3	习亲自指挥谋害传遗孀程虹爆李克强死前心
4	重磅！川普放话，关税大消息
5	坐实了！这机构刚刚成立习近平的手脚被绑

48小时新闻排行榜

1	比恒大还多1.14万亿的巨头，倒了
2	北京出了啥事？美前顶级情报头子发话
3	普京沉痛宣布:我们被骗了
4	空姐坦白：机组人员在飞行中这样“发生性
5	红色家族海外财产达二十万亿习近平犯下两
6	习亲自指挥谋害传遗孀程虹爆李克强死前心
7	4年倒闭5万多家中国最暴利行业要彻底消
8	刚刚！美联储，突传重磅
9	哈梅内伊又装了一回，代价也来了
10	重磅！川普放话，关税大消息

热门专题

1 美伊冲突	6 俄乌战争	11 大S
2 以伊战争	7 万维专栏	12 洛杉矶大火
3 四中全会	8 何卫东	13 叙利亚
4 中美冷战	9 AI	14 苗华被抓
5 川普	10 中共两会	15 美国大选

一周博客排行

1	俺吃错过药	阿妞不牛
2	空前绝后：24岁的中共总书记及	赵大夫话室
3	人养金毛犬，我养白眼狼：伊朗	高伐林
4	回国避坑：既不能评论国内好坏	aoe2
5	人死后灵魂还在吗？	骆驼
6	走出中国城，走活中国人	解滨
7	中美空军相差多远？看运-20和C	弓长贝占郎
8	共产革命之前的上海和伊斯兰革	陈家梁子
9	习大大唱独角戏，听床师们情何	蛇形刁手
10	浅谈2022年至今中共高层和习近	刘反共2012

一周博文回复排行榜

1	人死后灵魂还在吗？	骆驼
2	文明、优雅、格局	体育老师
3	俺吃错过药	阿妞不牛
4	奇袭伊朗.高法裁决.外交内政.	木秀于林
5	走出中国城，走活中国人	解滨
6	相信固执己见可以治愈	施化
7	2024回国：海南环岛游	马黑
8	人养金毛犬，我养白眼狼：伊朗	高伐林
9	再反转：B-2只炸了个皮毛？	北栖
10	老川什么时候拿诺贝尔和平奖？	山蛟龙


关于本站 \| 广告服务 \| 联系我们 \| 招聘信息 \| 网站导航 \| 隐私保护
Copyright (C) 1998-2025. Creaders.NET. All Rights Reserved.