聊天机器人ChatGPT能力波动:质数识别准确率下降
来源:中关村在线 发布时间:2023-09-08 07:46:29


(相关资料图)

斯坦福大学的一项新研究发现,热门生成式人工智能(AI)聊天机器人ChatGPT的能力在几个月内有所波动。研究人员评估了ChatGPT在几个月内如何处理不同的任务,发现ChatGPT的能力随时间推移而出现不一致。目前,ChatGPT有两个版本,免费的GPT-3.5模型和更智能、更快速的付费GPT-4版本。研究人员发现,GPT-4在3月份能够有效地解决数学问题,识别质数的准确率为97.6%。但三个月后,其准确率下降到了2.4%。而另一方面,GPT-3.5却变得更好,从7.4%的准确率提高到了86.8%。研究人员还注意到,在编写代码和视觉推理方面也有类似的波动。斯坦福大学计算机科学教授James Zou表示:“当我们调整一个大型语言模型来提高它在某些任务上的表现时,那可能会有很多意想不到的后果,可能会损害这个模型在其他任务上的表现……这个模型回答问题的方式有各种各样的相互依赖性,这可能导致我们观察到的一些恶化行为。”研究人员认为,结果并不能真正反映ChatGPT性能的准确性状态,而是显示了微调模型带来的意外后果。本质上,当修改模型的一部分来改善一个任务时,其他任务可能会受到影响。为什么会这样很难确定,因为没有人知道ChatGPT是如何运作的,而且它的代码也不是开源的。随着时间的推移,研究人员注意到,ChatGPT的回答不仅变得不太准确,而且还停止了解释其推理过程。由于ChatGPT的运作方式,要研究和衡量其表现可能很困难。这项研究强调了观察和评估驱动ChatGPT等工具的大型语言模型(LLM)性能变化的必要性。该研究已经在arXiv上发布,并正在等待同行评审。

标签:

猜你喜欢

聊天机器人ChatGPT能力波动:质数识别准确率下降

斯坦福大学的一项新研究发现,热门生成式人工智能(AI)聊天机器人Chat更多

2023-09-08 07:46:29

联合国教科文组织发布《教育研究中使用生成式AI指

联合国教科文组织于9月7日发布了《教育和研究中使用生成式AI指南》,这更多

2023-09-08 07:38:38

开学啦该换机了!影驰各硬件升级配置推荐 助力新

九月开学季已至,相信不少莘莘学子都已经回到了久违的校园里,不知道身更多

2023-09-08 06:45:28

短焦高亮 使用方便 明基JD530投影太适合升级了!

明基JD530短焦投影机是一款非常值得推荐的投影设备。它适合多种场景,更多

2023-09-08 06:36:33

成立10周年极米亿元补贴推投影普惠

9月7日,由四川省人民政府、工业和信息化部主办,成都市人民政府、四川更多

2023-09-07 22:37:08

立减百元!双扇显卡iGame RTX 4070 Ultra限时

国创新生代高端硬件品牌iGame正式推出了人气系列“Ultra”家族的新成员更多

2023-09-07 18:37:09

百望云亮相服贸会重磅发布业财税融Copilot

小望小望,我要一杯拿铁!好的,已下单成功,请问要开具发票嘛?在获得更多

2023-09-07 18:38:30

远大健科:引领健康快乐生活理念,塑造中国净水行

在当今时代,健康被赋予了前所未有的重要性,成为人们生活中的中心关注点更多

2023-09-07 17:40:49

腾讯云MaaS再升级:混元筑底、生态扩容,持续推进

9月7日,2023腾讯全球数字生态大会于深圳举办。会上,腾讯首次对外公布更多

2023-09-07 17:35:55

丰田汽车声明:系统故障并非网络攻击引起

近日,丰田汽车发布声明,表示上周导致其在日本的全部14家车辆组装工厂更多

2023-09-07 16:37:38