研究称AI 越聪明越有可能“胡编乱造”
创始人
2024-09-29 18:52:18
0

据媒体援引一项新研究表示,随着大型语言模型(LLM)变得越来越强大,它们似乎也越来越容易编造事实,而不是避免或拒绝回答它们无法回答的问题。这表明,这些更聪明的 AI 聊天机器人实际上变得不太可靠。

该研究发表在《自然》杂志上,研究人员研究了一些业界领先的商业 LLM:OpenAI 的 GPT 和 Meta 的 LLaMA,以及由研究小组 BigScience 创建的开源模型 BLOOM。研究发现,虽然这些 LLM 的回答在许多情况下变得更加准确,但总体上可靠性更差,给出错误答案的比例比旧模型更高。

瓦伦西亚人工智能研究所在西班牙的研究员 José Hernández-Orallo 对《自然》杂志表示:“如今,它们几乎可以回答一切。这意味着更多正确的答案,但也意味着更多错误的答案。”

相关内容

Luma推出基于统一智能模...
AI视频生成初创公司Luma周四推出了Luma智能体,旨在处理文本...
2026-03-07 14:23:12
龙虾之父参与的首个Open...
鱼羊 发自 凹非寺 量子位 | 公众号 QbitAI OpenAI...
2026-03-07 14:21:09
看完背后冷汗流!研究:先拥...
快科技3月7日消息,最近Anthropic发布了《AI 对劳动力市...
2026-03-07 09:49:30
日产千部的AI漫剧,正在“...
文 | 超聚焦 AI的风暴正在悄然重塑短剧产业的边界。 近日,在...
2026-03-06 23:18:54
软硬协同设计定律,理想切入...
“每18-24个月,集成电路晶体管数量翻一番,对应性能提升一倍、成...
2026-03-06 22:50:27
一场“龙虾”AI盛宴,大厂...
作者 | 叶二 编辑 | 魏晓 3 月 6 日的深圳腾讯大厦北广场...
2026-03-06 22:50:10

热门资讯

原创 2... #春日生活好物种草季#近年来,笔记本电脑市场迎来技术爆发期,尤其在手机厂商跨界入局后,轻薄本在性能、...
AMD锐龙AI 9 HX 37... 2024年6月3日,AMD正式发布全新的锐龙AI 300系列处理器。该系列处理器一经发布就引发大家的...
2024云栖大会|阿里云升级无... 北京商报讯(记者魏蔚)9月20日,阿里云无影AI云电脑在2024云栖大会上展出,该版本基于最新的终端...
5个AI模特生成软件推荐 当前AI模特生成软件市场提供了多样化的解决方案,以下是几款备受推崇的工具: 触站AI:强烈推荐!...
骁龙本这么猛?联想YOGA A... 在人人都是自媒体的时代,一部手机可以解决出镜拍摄问题,而商务出差、大量码字、图像处理等需求用笔记本则...
2023年CentOS与Ubu... CentOS与Ubuntu的市场格局与技术特性探讨 在服务器操作系统领域,CentOS与Ubuntu...
MWC2025荣耀多款AI技术... 人民财讯3月6日电,2025世界移动通信大会(MWC 2025)上,荣耀MagicBook Pro ...
苹果macOS 15.1:允许... 苹果公司在其最新的macOS 15.1版本中,推出了一项引人注目的新功能——允许用户将Mac App...
原创 苹... 前言 IQUNIX在做好看的桌面产品上,一直都给我留下非常深刻的印象。而且早期和苹果产品的设计风格...
原创 华... 在2024年这个被誉为"AI元年"的关键时刻,随着生成式AI的流行,各家手机厂商都在积极备战AI手机...