旧版AI模型出现认知衰退迹象
创始人
2025-02-19 21:21:13
0

参考消息网2月19日报道据美国趣味科学网站2月16日报道,与人类一样,旧版聊天机器人也出现了认知障碍迹象。在一项通常用于人类患者的测试中,它们在几个重要指标上都不达标。

人们越来越依赖人工智能(AI)进行医学诊断,因为这些工具能以极快的速度和极高的效率,从病史、X光片和其他数据集中发现异常和警示信号,而这些往往是人眼难以很快察觉的。但2024年12月20日发表在《英国医学杂志》上的一项新研究引发了担忧:与人类一样,大语言模型和聊天机器人这样的AI技术,会随着时间推移出现认知能力下降的迹象。

论文作者写道:“这些发现挑战了AI将很快取代人类医生的假设,因为领先的聊天机器人明显存在的认知障碍可能会影响其在医学诊断中的可靠性,并削弱患者的信心。”

科学家使用蒙特利尔认知评估(MoCA)测试,对开放使用的由大语言模型驱动的聊天机器人进行了测试,包括开放人工智能研究中心(OpenAI)的聊天生成预训练转换器(ChatGPT)、Anthropic公司的“十四行诗”(Sonnet)AI模型和“字母表”公司的“双子座”(Gemini)AI模型。MoCA测试包含一系列任务,神经科医生常用它来测试注意力、记忆力、语言、空间技能和执行心理功能等。

MoCA最常用于评估或检测阿尔茨海默病或痴呆症等疾病患者的认知障碍。受试者需要完成的任务包括在钟面上画出特定时间、从100开始连续减去7、尽可能多地记住测试人员说出的单词等。对人类来说,从总分30分中得到26分就算通过测试(即受试者没有认知障碍)。

尽管对测试所使用的大多数大语言模型来说,命名能力、注意力、语言和抽象能力等测试似乎较为容易,但它们在视觉/空间技能和执行任务方面表现欠佳,有几个模型在延迟回忆等方面的表现比其他模型差。

关键是,尽管最新版本的ChatGPT得分最高(26分),但较旧的Gemini 1.0大语言模型仅得16分。这使研究人员得出结论:较旧的大语言模型出现了认知衰退迹象。

论文作者指出,他们的发现仅是观察性的,由于AI与人类的思维方式存在关键差异,该实验无法进行直接比较。但他们警告称,这可能指向他们所说的“重大薄弱领域”,有可能阻碍AI在临床医学中的应用。具体而言,他们反对在需要视觉抽象和执行功能的任务中使用AI。

这也引出了一个颇为有趣的设想:人类神经科医生开拓一个全新市场——为那些出现认知障碍迹象的AI“看病”。(编译/刘白云)

相关内容

AI赋能千行百业一线观察|...
编者按:新华网“AI赋能千行百业一线观察”系列融合报道,走进产业一...
2026-04-13 21:54:36
白天练AI,晚上“练队友”
羊城晚报记者 刘克洪 11日至12日,2026电竞粤超深圳站在深圳...
2026-04-13 13:53:33
MiniMax M2.7开...
4月13日消息,MiniMax M2.7 于今日正式开源。该公司宣...
2026-04-13 13:49:10
10000个爱因斯坦诞生?...
AI大神Karpathy的「autoresearch」爆火之后,物...
2026-04-13 13:45:14
中科闻歌冲刺港股:国家队A...
雷递网 雷建平 4月12日 北京中科闻歌科技股份有限公司(简称:“...
2026-04-13 02:56:56
开源风向看中国!Qwen累...
AIPress.com.cn报道 4月11日消息,一份最新研究报告...
2026-04-11 22:41:33

热门资讯

2024云栖大会|阿里云升级无... 北京商报讯(记者魏蔚)9月20日,阿里云无影AI云电脑在2024云栖大会上展出,该版本基于最新的终端...
MWC2025荣耀多款AI技术... 人民财讯3月6日电,2025世界移动通信大会(MWC 2025)上,荣耀MagicBook Pro ...
原创 2... #春日生活好物种草季#近年来,笔记本电脑市场迎来技术爆发期,尤其在手机厂商跨界入局后,轻薄本在性能、...
AMD锐龙AI 9 HX 37... 2024年6月3日,AMD正式发布全新的锐龙AI 300系列处理器。该系列处理器一经发布就引发大家的...
5个AI模特生成软件推荐 当前AI模特生成软件市场提供了多样化的解决方案,以下是几款备受推崇的工具: 触站AI:强烈推荐!...
骁龙本这么猛?联想YOGA A... 在人人都是自媒体的时代,一部手机可以解决出镜拍摄问题,而商务出差、大量码字、图像处理等需求用笔记本则...
摩尔线程发布AI算力笔记本MT... 钛媒体App 12月20日消息,摩尔线程创始人、董事长兼CEO张建中在摩尔线程首届MUSA开发者大会...
2023年CentOS与Ubu... CentOS与Ubuntu的市场格局与技术特性探讨 在服务器操作系统领域,CentOS与Ubuntu...
苹果macOS 15.1:允许... 苹果公司在其最新的macOS 15.1版本中,推出了一项引人注目的新功能——允许用户将Mac App...
原创 华... 在2024年这个被誉为"AI元年"的关键时刻,随着生成式AI的流行,各家手机厂商都在积极备战AI手机...