研究团队新发现:AI大模型看“块头”更要看“密度”
创始人
2025-11-23 10:46:03
0

新华社记者 魏梦佳

近年来,AI的发展遵循着一个简单直接的规则——模型越大、能力越强。这个被称为“规模法则”的路径,催生了今天我们看到的各种强大的AI大模型。但同时,随着模型参数量的增大,模型训练的成本、使用的成本也随之飙升,一定程度上制约了大模型的产业应用进程。

清华大学的一项最新研究成果——大模型“密度法则”20日在国际期刊《自然·机器智能》上作为封面文章发表,为AI发展指出了一个新方向:AI大模型变强,不应只靠“体型”,更要靠“密度”。

“过去,我们往往关心一个AI模型的‘块头’有多大,即参数量有多大,其实我们更应该关心模型的‘能力密度’,即每个单位的参数能展现出的智能水平。”论文第一作者、清华大学计算机科学与技术系助理研究员肖朝军说,“这就好比评价一个武林高手,不是看他块头有多大,而是看他一招一式里蕴含了多少功力。”

研究人员表示,实现这样的“能力密度”,不能靠“模型压缩”。研究发现,强行压缩一个大模型,就像是把一本厚厚的字典强行塞进小本子里,很多内容会丢失,导致“智力”下降,因此需要采用更先进的“数据+算力+算法”体系,才能培养出“高密度”的精干小模型。

通过研究过去几年发布的51个开源大模型,研究人员发现:AI大模型的“能力密度”正以指数级速度增长,大约每3.5个月就翻一倍。

这意味着什么?打个比方,如果今天我们需要一个体育馆大小的“大脑”才能完成某项复杂任务,那么约3个半月后,我们只需要一个客厅大小的“大脑”就够了;再过3个半月,这个“大脑”可能只需要一个背包大小。

据了解,目前,清华大学已与AI企业面壁智能的团队合作推出了系列“高密度”模型,已应用于手机、汽车、智能家居等生活领域。

“AI模型不是越大越好,‘精炼’‘高效’是其未来发展的方向。”肖朝军说,强大的AI大模型在未来将会更广泛地在手机、电脑、汽车等终端上运行。当芯片的计算能力和AI的智能密度这两条快车道交汇时,“端侧智能”的时代或将来临。届时,个人设备有望拥有前所未有的智能,不仅反应更快,还能更好地保护个人隐私。

相关内容

开源之争,撕裂硅谷
文|熔财经 每文 7月24日,黄仁勋发出了人生第一条X(原推特)...
2026-08-03 07:40:41
以AI大模型“伏羲”为基础...
台风为何经常“跑偏”?因为大气系统自带“混沌”属性,初始条件差之毫...
2026-08-02 19:37:57
MiniMax H3发布,...
7月31日,稀宇科技(MiniMax)发布新一代多模态生成模型Mi...
2026-08-02 19:21:23
Kimi K3正式开源,全...
2026年7月27日晚,月之暗面kimi正式开源Kimi K3完整...
2026-08-02 19:17:26
把AI搬进Linux:媒体...
导语:最近有开发者基于Debian推出了Shadowfetch,一...
2026-08-02 19:14:38
OpenAI加入,签署支持...
IT之家 7 月 25 日消息,微软、英伟达、IBM、Meta 等...
2026-07-25 23:13:23

热门资讯

67岁男子误信AI喷农药,15... 安徽滁州67岁农户吴大伯因轻信AI生成的除草除虫方案喷洒农药,导致150亩芝麻苗一夜之间全部枯萎,损...
外语专业“遇冷”:AI只是催化... “人们没有必要恐慌。人工智能是大语言模型,本质仍然是语言。而语言是一切学科的基础,没有语言表达,就没...
AI国际合作的中国声音 [ 人工智能不是少数国家的“特权”,而应成为造福全人类的“公共产品”;人工智能治理不是零和博弈的“角...
特斯拉将开源Model S和M... 8月3日消息,据外电报道,三年前,特斯拉在其服务网站上发布了2012款初代特斯拉Roadster的所...
开源之争,撕裂硅谷 文|熔财经 每文 7月24日,黄仁勋发出了人生第一条X(原推特)。 这位英伟达掌门人没有发布新架构...
以AI大模型“伏羲”为基础,新... 台风为何经常“跑偏”?因为大气系统自带“混沌”属性,初始条件差之毫厘,最终路径就可能谬以千里。记者2...
ChinaJoy2026|延伸... 【中国·上海,2026年7月31日】第23届中国国际数码互动娱乐展览会(ChinaJoy)在上海新国...
给中国AI“扣帽子”,遮不住美... 最近,美国对中国AI的围堵,有点歇斯底里。 当地时间7月28日,美国联邦通信委员会(FCC)宣布,将...