热搜： 佳士科技 irobot 开云电竞官网下载app 机器人机器人产业联盟 ABB 发那科机械手码垛机器人机器人展览

斯坦福大学研究发现，AI 聊天机器人 ChatGPT 的表现很不稳定

日期：2023-09-08 来源：IT之家评论：0

标签： AI 科技创新

　　斯坦福大学的一项新研究发现，热门生成式人工智能（AI）聊天 机器人ChatGPT的能力在几个月内有所波动。

　　斯坦福大学的团队评估了ChatGPT在几个月内如何处理不同的任务。他们发现，ChatGPT的能力随时间的推移而出现了不一致。目前，ChatGPT有两个版本——免费的GPT-3.5模型和更智能、更快速的付费GPT-4版本。研究人员发现，GPT-4在3月份能够有效地解决数学问题，识别质数的准确率为97.6%。三个月后，其准确率下降到了2.4%。而另一方面，GPT-3.5却变得更好，从7.4%的准确率提高到了86.8%。

　　研究人员还注意到，在编写代码和视觉推理方面也有类似的波动。斯坦福大学计算机科学教授James Zou称：“当我们调整一个大型语言模型来提高它在某些任务上的表现时，那可能会有很多意想不到的后果，可能会损害这个模型在其他任务上的表现……这个模型回答问题的方式有各种各样的相互依赖性，这可能导致我们观察到的一些恶化行为。”

　　研究人员认为，结果并不能真正反映ChatGPT性能的准确性状态，而是显示了微调模型带来的意外后果。本质上，当修改模型的一部分来改善一个任务时，其他任务可能会受到影响。为什么会这样很难确定，因为没有人知道ChatGPT是如何运作的，而且它的代码也不是开源的。

　　随着时间的推移，研究人员注意到，ChatGPT的回答不仅变得不太准确，而且还停止了解释其推理过程。

　　由于ChatGPT的运作方式，要研究和衡量它的表现可能很困难，这项研究强调了观察和评估驱动ChatGPT等工具的大型语言模型（LLM）性能变化的必要性。该研究已经在arXiv上发布，并正在等待同行评审，IT之家附链接在此。

声明：凡开云电子链接来源注明为其他媒体来源的信息，均为转载自其他媒体，并不代表本网站赞同其观点，也不代表本网站对其真实性负责。您若对该文章内容有任何疑问或质疑，请立即与开云客户(www.www.wykobounce.com)联系，本网站将迅速给您回应并做处理。
电话：021-39553798-8007

更多> 相关开云电子链接

0条 相关评论

推荐图文

加州大学科学家发明了	深圳又一制造业总部基
水下机器人在渔业中的	哈工程水下机器人再夺
里程碑！荆州市首台机	超维科技精彩亮相电力

推荐开云电子链接

点击排行

• 大摩本月将推 AI 聊天机器人：与 OpenAI 共同研	• 蚂蚁集团明日发布全栈布局、纯自研的 AI 大模型
• 上海杯首次走出国门象棋AI机器人也将在德国亮	• 自称 25 年码农，唐娜姐负责微软新 AI 项目：帮
• 腾讯 AI 聊天机器人即将公布：官方展示写文案能	• 高通 CEO：AI 或将给智能手机带来新生
• 金山办公与阿里云达成战略合作，围绕 AI 助手等	• 百川智能发布 Baichuan 2 开源大模型，号称“文
• 消息称小米自研系统首先应用于 AI 物联网和大终	• 大模型技术实践（三）｜10分钟用LangChain和Lla

恰佩克奖	机器人高峰论坛	机气林	ITES深圳工业展	机器人研究院	API数据	库卡机器人
中国传动网	索比光伏网	数控机床市场网	国家标准化委员会