发现:一项新技术能将AI能源消耗降低95%
创始人
2024-10-20 10:03:20
0

在人工智能领域,能源消耗一直是一个备受关注的问题。现在,BitEnergy AI公司的研究人员开发了一种名为线性复杂度乘法(L-Mul)的技术,这项技术有潜力将AI模型的功耗降低95%,而不会牺牲模型的质量。

L-Mul技术通过在AI计算中用更简单的整数加法替换能耗大的浮点乘法来实现这一目标。对于那些不熟悉这个术语的人来说,浮点是一种数学和编程术语,它允许计算机通过调整小数点的位置高效地处理非常大和非常小的数字。你可以将其视为二进制中的科学记数法。它们对于AI模型中的许多至关重要的计算,但它们需要大量的能源和计算能力。模型越大,所需的算力就越多。从fp32的全精度模型开始,开发者通常会降低精度到fp16、fp8甚至fp4,以便他们的模型可以在本地硬件上运行。

AI对电力的庞大需求已经成为一个日益增长的担忧。仅ChatGPT每天就消耗564兆瓦时——足以为18,000个北美家庭供电。根据剑桥替代金融中心分享的估计,到2027年,整个AI行业的年能源消耗预计将达到850-1340太瓦时,与比特币挖矿操作大致相同。

L-Mul技术直接解决了AI能源问题,重新构想了AI模型处理计算的方式。与传统的浮点乘法不同,L-Mul使用整数加法来近似这些操作。例如,而不是将123.45乘以67.89,L-Mul将其分解为使用加法的更小、更简单的步骤。这使得计算更快,使用的能源更少,同时仍然保持准确性。

研究结果看起来非常有希望。研究人员声称,“在张量处理硬件中应用L-Mul操作可以潜在地通过元素级别的浮点张量乘法减少95%的能源成本,以及点积的80%能源成本。”简而言之,如果一个模型使用了这项技术,根据这项研究,它将以比原来少95%的能源来“思考”,以及比原来少80%的能源来产生新的想法。

该算法的影响不仅限于节能。在某些情况下,L-Mul的性能甚至超过了当前的8位标准,在使用显著更少的位级计算的同时实现了更高的精度。在自然语言处理、视觉任务和符号推理的测试中,平均性能下降仅为0.07%——对于潜在的能源节省来说,这是一个微不足道的权衡。

基于Transformer的模型,如GPT等大型语言模型的支柱,可能会从L-Mul中大大受益。该算法可以无缝集成到这些模型的注意力机制中,这是计算密集型的部分。在流行的模型如Llama、Mistral和Gemma上的测试甚至表现出在某些视觉任务上的准确性的提升。

在操作层面上,L-Mul的优势变得更加明显。研究表明,乘以两个float8数字(AI模型今天的运行方式)需要325次操作,而L-Mul仅使用157次——不到一半。“总结误差和复杂度分析,L-Mul不仅比fp8乘法更高效,而且更准确。”研究人员得出结论。

但没有什么技术是完美的,这项技术有一个主要的弱点:它需要特殊类型的硬件,因此现行的硬件对其而言还没有得到充分优化。

支持L-Mul计算的专用硬件开发计划可能已经在进行中。“为了充分激发我们提出的方法的潜力,我们将在硬件层面上实现L-Mul和L-Matmul内核算法,并为高级模型设计开发编程API。”研究人员表示道。这可能诱发新一代的AI模型诞生,它们快速、准确且成本极低——使能源高效的AI成为现实。

相关内容

热门资讯

国产大模型下调推理服务价格,南... 近日,国内某大模型企业宣布下调其flash系列模型服务价格,输入缓存命中、输入缓存未命中及输出价格最...
解码青年人AI生活《2026有... 中新网深圳9月5日电(记者索有为)《2026有意思生活方式报告》(下称《报告》)4日在全国首个有意思...
OpenAI 最强 AI 生图... 9月9日消息,OpenAI 9 月 9 日官宣发布 ChatGPT Images 2.5,图像生成延...
探索AI供应链产业化路径京东推... 2026年以来,人工智能应用范围加速拓展,持续从数字空间走向现实生活,广泛融入生产线、仓储厂房、配送...
教育部发文!AI生成内容,教师... 一篇论文,因为AI使用不当,相关高校师生被通报处理。 9月2日,安徽财经大学公布“教师与学生涉嫌学术...
AI识别出近800种可充当乳化... 英国利兹大学食品科学与营养学院和爱丁堡大学科学家携手,开发出一款 人工智能(AI)工具,能从数千万种...
搭上低空经济、AI文旅?两连板... 桂林旅游(000978)回应市场热点。 9月8日,桂林旅游再度涨停,斩获2连板。当天晚间,该公司披露...
硅谷:我们不能被硅谷“AI刹车... 【文/底线思维】 OpenAI首席科学家Jakub Pachocki最近写了一篇文章,题目叫《An ...