最新研究!用AI训练AI,可能越练越“傻”
创始人
2024-07-26 19:06:43
0

(央视财经《正点财经》)对于人工智能大语言模型来说,通常给予的训练数据越多,模型就会越“聪明”。但英国《自然》杂志最新发表的一项关于大模型的研究显示,如果只用AI生成的数据来训练大模型,会使模型性能下降,还可能越练越“傻”。

据了解,这项研究由英国牛津大学、剑桥大学等机构共同参与。研究人员发现,如果在训练大模型时,只用人工智能生成的内容,会导致大模型出现不可逆的缺陷,逐渐忘记真实数据的分布,这被称为“模型崩溃”。

研究人员首先使用大语言模型创建类似维基百科词条的文本,然后利用这个内容来训练该模型的新版本,并反复使用前代模型生成的文本训练更新的版本。在模型的第九次迭代中,它完成了一篇关于英国教堂塔楼的文章,其中一段文字却在讲述野兔尾巴的多种颜色。

研究发现,导致“模型崩溃”的重要原因是,由于模型只能从其训练数据中采样,一些在第一代数据中本就低频出现的词汇,在每次迭代后出现的频率变得更低,而一些常见词汇出现的频率则逐渐增加。这种变化的结果就是,模型逐渐无法正确模拟真实世界的复杂性。随着时间推移,这种错误会在迭代中被层层累积、逐渐放大,最终导致“模型崩溃”。

不过,应对“模型崩溃”并非束手无策。研究人员表示,如果能在模型微调过程中保留10%左右的真实数据,崩溃就会发生得更缓慢。还可以在大型科技公司的协作下使用水印技术,将AI生成的数据与真实数据区分开来。此外,在AI生成的文本重新进入数据池之前,可由人类先筛选过滤,也会有效应对“模型崩溃”。

转载请注明央视财经

编辑:安琪

相关内容

昆仑万维正式开源Matri...
5月13日,昆仑万维正式开源(17B+)Matrix-Game大模...
2025-05-13 17:48:24
生成视频好看还不够,还要能...
机器之心报道 作者:张倩、泽南 世界模型的进度条,最近坐上了火箭。...
2025-05-13 13:16:44
钛媒体科股早知道:AI硬件...
必读要闻一:英伟达开源多个代码推理大模型,机构称AI大模型加速高速...
2025-05-13 08:17:19
5月12日隆盛科技涨5.6...
证券之星消息,5月12日隆盛科技(300680)涨5.68%,收盘...
2025-05-12 19:19:12
AI旅游如何玩儿?新加坡旅...
刚刚结束的五一假期,成为AI含量最高的一届黄金周。 飞猪上线“由多...
2025-05-12 19:18:32
“5G+AI”赋能数字人教...
通信世界网消息(CWW)作为全球领先的高端无线蓝牙耳机和无线充电模...
2025-05-12 18:48:03

热门资讯

原创 华... 想在竞争残酷的市场中发力,必须要带来一些激进的卖点,但是随着功能特性的提升,硬件也必须要进行给力才可...
支持 AI 扩图,华为 Pur... 2024-07-28 09:05:02作者:姚立伟 华为Pura 70 Pro手机今日推出鸿蒙Ha...
苹果macOS 15.1:允许... 苹果公司在其最新的macOS 15.1版本中,推出了一项引人注目的新功能——允许用户将Mac App...
吞噬星空维妮娜美图/高清壁纸/... 国漫女神|《吞噬星空》维妮娜美图/高清壁纸/AI手机壁纸/无水印 国漫女神|《吞噬星空》维妮娜美图...
原创 苹... 前言 IQUNIX在做好看的桌面产品上,一直都给我留下非常深刻的印象。而且早期和苹果产品的设计风格...
原创 商... 最近,各家的AI 9笔记本开始陆续登场,其实大家并不一定非选AI 9 HX 370,主要是这颗CPU...
AI智能+高效清洁!萤石RS2... 目前扫拖机器人市场的竞争非常激烈,在上下水扫拖一体机市场也出现了很多所谓的创新产品。但是对于这些产品...