离谱!最新研究:61%中国人写的英语论文 会被ChatGPT检测器判为AI生成的
2023-05-05 09:51:02 来源:凤凰网
ChatGPT火了以后,用法是真多。
(相关资料图)
有人拿来寻求人生建议,有人干脆当搜索引擎用,还有人拿来写论文。
论文...可不兴写啊。
美国部分大学已经明令禁止学生使用ChatGPT写作业,还开发了一堆软件来鉴别,判断学生上交的论文是不是GPT生成的。
这里就出了个问题。
有人论文本来就写的烂,判断文本的AI以为是同行写的。
更搞的是,中国人写的英文论文被AI判断为AI生成的概率高达61%。
这....这这什么意思?气抖冷!
非母语者不配?
目前,生成式语言模型发展迅速,确实给数字通信带来了巨大进步。
但滥用真的不少。
虽说研究人员已经提出了不少检测方法来区分AI和人类生成的内容,但这些检测方法的公平性和稳定性仍然亟待提高。
为此,研究人员使用母语为英语和母语不为英语的作者写的东西评估了几个广泛使用的GPT检测器的性能。
研究结果显示,这些检测器始终将非母语者写作的样本错误地判定为AI生成的,而母语写作样本则基本能被准确地识别。
此外,研究人员还证明了,用一些简单的策略就可以减轻这种偏见,还能有效地绕过GPT检测器。
这说明什么?这说明GPT检测器就看不上语言表达水平不咋地的作者,多叫人生气。
不禁联想到那款判断AI还是真人的游戏,如果对面是真人但你猜是AI,系统就会说,「对方可能会觉得你冒犯了。」
不够复杂=AI生成?
研究人员从一个中国的教育论坛上获取了91篇托福作文,又从美国Hewlett基金会的数据集中摘取了88篇美国八年级学生写的作文,用来检测7个被大量使用的GPT检测器。
图表中的百分比表示「误判」的比例。即,是由人写的,但检测软件认为是AI生成的。
可以看到数据非常悬殊。
七个检测器中,美国八年级学生写的作文被误判的概率最高才12%,还有两个零误判的GPT。
中国论坛上的托福作文被误判的概率基本全部过半,最高误判概率可达76%。
91篇托福作文中的18篇被所有7个GPT检测器一致认为是AI生成的,而91篇中有89篇,都至少被一个GPT检测器误判。
从上图中我们可以看出,被所有7个GPT误判的托福作文在复杂度(Complexity)上明显低于其它论文。
这就印证了开头的那个结论——GPT检测器会对那些语言表达能力有限的作者有一定偏见。
因此,研究人员认为,GPT检测器应该多看点儿非母语者写的文章,样本多了,才能消除偏见。
接下来,研究人员把非母语者写的托福作文扔到了ChatGPT里,丰富一下语言,模仿母语者的用词习惯。
同时作为对照组,把美国八年级小孩儿写的作文也扔到了ChatGPT里,把语言简化了一下,模仿非母语者的写作特点。下图就是修正后的新判定结果。
我们可以发现,情况来了个大掉个儿,丰富了语言的托福作文错判率直线下降,低至3%,最高也不过19%。不像之前基本全部过半的错判率。
与之相反,八年级小孩儿写的作文的错判率直线上升,甚至还有一个GPT检测器的错判率高达99%,基本全错。
因为,文章复杂度这个变量出现了变化。
这里研究人员就得出了一个结论,非母语者写的东西不地道,复杂度低,容易被错判。
这也就导向了一个技术问题,同时也是一个价值问题。以复杂度来判定AI还是人类是作者,是否合理、全面、严谨。
结果显然不是。
以复杂度为判断标准的情况下,非母语者吃了大亏,因为,他们是非母语者(废话)。
AI润色=人类写的??
研究者认为,加强语言多样性不仅可以减轻对非母语者的偏见,还能让GPT生成的内容绕过GPT检测器。
为了证明这个观点,研究人员选取了2022-2023年间美国大学申请的入学论文题目,输入到ChatGPT-3.5里,一共生成了31篇假论文。
GPT检测器一开始还挺有效,但是第二轮就不行了。这是因为,在第二轮中,研究人员把这些论文又扔到ChatGPT里润色了一下,用一些文学性的语言提升了文本质量。
这样一来,GPT检测器的准确度就从100%直降到了0%。如下图:
经过润色的文章复杂度相应也上升了。
与此同时,研究人员又用了斯坦福大学145个期末项目报告的题目,让ChatGPT生成摘要。
摘要经过润色以后,检测器判断的准确性继续下降。
研究者再次得出结论,润色过的文章很容易被误判,都是AI生成的,两轮就是比一轮强。
GPT检测器?还是欠练
言而总之,总而言之,各种GPT检测器好像还是没能抓住AI生成和人类写作之间最本质的区别。
人的写作也分三六九等,仅靠复杂度判断,不甚合理。
抛开偏见因素不谈,技术本身也亟待改进。
关键词:
为你推荐
-
离谱!最新研究:61%中国人写的英语论文 会被ChatGPT检测器判为AI生成的
-
漢鼎事|2023年「共享書香」漢鼎閱讀日_今日最新
-
日本首相官邸内发现一名警察死亡
-
滚动:中国有色金属工业协会:一季度规上有色金属企业工业增加值同比增长5.8%
-
nomoreshow全集在线看 nomoreshow有线观看_全球新视野
-
AI人才战转向印度,薪酬翻倍
-
毛头乳菇变色吗_毛头乳菇
-
【全球独家】【网言】“背经典免门票”是一堂生动的旅游文化课
-
智能驾驶没一个能打?那你是不知道阿维塔11
-
焦点热议:分宜县气象台发布雷电黄色预警信号【III级/较重】【2023-05-05】
-
续航1500km的凝聚态电池将彻底“杀死”油车?事情又有了变数_世界独家
-
奥巴梅扬回复球迷暖心留言:有时人们会忘记现实生活-环球热点
-
模切机是干什么用的_瑞安模切机|全球热消息
-
指导价12.49万元起 长安第三代CS75 PLUS正式上市
-
临港新片区五一迎游客逾90万人次,文体设施陆续“上新”-独家焦点
-
海利尔: 海利尔药业集团股份有限公司关于2021年限制性股票激励计划首次授予部分第二期解锁暨上市公告
-
每日简讯:多家中小银行为何下调存款利率?
-
减脂每天吃几个鸡蛋白? 焦点简讯
-
qq安全中心重置密码_qq安全中心改不了密码
-
天天播报:罗马诺:蒙扎将买断阿森纳外租后卫马里,枪手获得600万镑收入
推荐内容
- 离谱!最新研究:61%中国人写的英语论文 会被Cha
- 漢鼎事|2023年「共享書香」漢鼎閱讀日_今日最新
- 日本首相官邸内发现一名警察死亡
- 滚动:中国有色金属工业协会:一季度规上有色金属
- nomoreshow全集在线看 nomoreshow有线观看_全球新视野
- AI人才战转向印度,薪酬翻倍
- 毛头乳菇变色吗_毛头乳菇
- 【全球独家】【网言】“背经典免门票”是一堂生动
- 智能驾驶没一个能打?那你是不知道阿维塔11
- 焦点热议:分宜县气象台发布雷电黄色预警信号【III
- 续航1500km的凝聚态电池将彻底“杀死”油车?事情
- 奥巴梅扬回复球迷暖心留言:有时人们会忘记现实生
- 模切机是干什么用的_瑞安模切机|全球热消息
- 指导价12.49万元起 长安第三代CS75 PLUS正式上市
- 临港新片区五一迎游客逾90万人次,文体设施陆续“
- 海利尔: 海利尔药业集团股份有限公司关于2021年
- 每日简讯:多家中小银行为何下调存款利率?
- 减脂每天吃几个鸡蛋白? 焦点简讯
- qq安全中心重置密码_qq安全中心改不了密码
- 天天播报:罗马诺:蒙扎将买断阿森纳外租后卫马里
- 5月4日河南宝鑫聚合氯化铝价格平稳|全球快消息
- 九江星马物流有限公司被罚款15500元 环球今头条
- 全球观点:祥鑫科技获得150亿订单,新能源汽车加
- 环球新动态:“火焰蓝”全力筑牢五一假期防火墙
- 税务风险防控措施 税务风险管控措施 当前最新
- ST鹏博士(600804)5月4日10点17分触及跌停板|当前热门
- 中建六局水利水电团委举办“学思践悟二十大 踔厉
- 岁月芳华——陈钢随想曲-天天速递
- 肖申克的救赎男主角(肖申克的救赎男主角安迪)
- 医药行业先进个人范文(推荐20篇) 当前速递
- 每日速看!“太原好人”刘芳:用爱点亮患者“心灯”
- 美总统参选人肯尼迪:美政府无视俄方红线 背弃承
- 国足不知要和阿根廷踢?阿根廷排第1,预定对手缅
- 环球微头条丨2023年适合建房子吗?哪些地方建房风
- 焦点速讯:绿军大胜76人扳1-1!布朗25分恩比德复出
- 环球热点评!中方最新表态!要求缅方严厉打击
- 天天最新:地产股持续走高 浦东金桥涨停上实涨超10%
- 恒生科技指数涨0.35%,百度、快手、B站涨超1%
- 焦点速看:新兴业务高速增长 信息通信业发展动力足
- 全球热议:南宁电影市场回暖 “青春怀旧风”成亮点
油气
- 1
- 2
- 3
- 4
- 5
- 6
- 7
- 8
- 9
- 10
经济
-
中新网通辽10月18日电 (记者 张林虎)18日,记者从内蒙古自治区通辽市奈曼旗公安局获悉,国家一级保护动物--梅花鹿误入当地村民羊群,
-
中新网杭州10月18日电 (王题题 胡燕婕)云天收夏色,浅秋正渐浓。10月18日,浙江杭州市西湖游船有限公司推出的惠民多站点“西湖环湖游
-
中新网福州10月18日电 (记者 龙敏 王东明)福州市晋安区官方18日晚间通报,18日14时47分,晋安区岳峰镇化工路爱摩轮商业广场项目摩天
-
中新网兰州10月18日电 (闫姣 艾庆龙 吉翔)“红山白土头,黄河向西流。”不少人疑问,天下黄河向东流,为何甘肃永靖县这段黄河却向西
-
中新网北京10月18日电 《清华城市健康设施指数》18日在北京发布。报告成果显示,城市健康设施指数领先城市以中心城市和东部沿海城市