多家央企及产业各方共同发布《通用大模型评测标准》 助力AI赋能行业应用
创始人
2024-10-13 17:01:02
0

央广网北京10月13日消息 工业和信息化部总工程师赵志国12日表示,我国人工智能核心产业的规模在不断提升,企业数量超过了4500家。完成备案并上线为公众提供服务的生成式人工智能服务大模型近200个,注册用户超过6亿。

大模型评测是助力人工智能赋能行业应用的重要一环。当前众多企业已启动大模型建设,亟需建立配套的通用大模型和行业大模型评测体系。为发挥大模型评测领域的引领作用,中国移动联合电子标准院及16家重点央企共同开展大模型评测体系建设工作。在2024中国移动全球合作伙伴大会期间,中国移动携手央企及产业各方共同发布大模型评测体系建设的重要成果《通用大模型评测标准》,为产业界遴选优质大模型提供重要参考依据。

据介绍,第一阶段将围绕通用领域和4个重点行业领域,从评测标准制定、评测基地建设、评测试点应用等方面开展工作。目前,中国移动携手央企及产业各方遵循“确保评测权威、加强业界协同、解决实际问题、保持开放态度”的原则,初步完成通用大模型评测标准制定。

据了解,此次发布的通用大模型评测标准基于“2-4-6”框架。“2”代表两类评测视角,以重点行业实际使用需求为导向,与国标对模型能力要求拉齐,将评测任务划分为理解和生成两类视角。“4”代表四类评测要素,从评测全生命周期中提取出评测工具、评测数据、评测方式和评测指标四类关键要素,确保评测工作可实施性。“6”代表六大评测维度,综合考虑大模型应用过程中的核心能力,设定功能性、准确性、可靠性、安全性、交互性和应用性六大维度。该标准广泛吸纳产学研用各方意见,并结合行业特色场景需求,可为通用大模型全面评估提供客观依据,为AI赋能千行百业提供保障。

中国移动表示,未来将联合行业龙头企业、业界头部公司、知名高校和科研机构,深入挖掘石油、电力、交通和物流等重点行业应用需求,持续打造并完善通用及行业大模型评测体系,积极建设大模型评测基地,广泛征集各中央企业及头部民企积极参与大模型评测,打造落地应用最佳实践。

相关内容

开源证券给予爱婴室买入评级...
每经AI快讯,开源证券8月23日发布研报称,给予爱婴室(60321...
2025-08-24 17:42:36
预售19.38万起,银河M...
8月23日,吉利银河旗下首款“AI科技大六座旗舰SUV”——吉利银...
2025-08-24 16:13:36
【2025数博会】相约20...
金秋时节,数智盛会再启新篇。作为企业走向智能体时代的全栈解决方案提...
2025-08-24 15:49:50
数智改变生活 | 当AI机...
当机器狗在社区巡逻,当手术机器人帮老人重新行走,当AI主播正式“上...
2025-08-24 15:47:29
华金证券给予天娱数科增持评...
每经AI快讯,华金证券8月24日发布研报称,给予天娱数科(0023...
2025-08-24 15:46:55
马斯克宣布将开源Grok ...
8月6日 特斯拉CEO埃隆·马斯克宣布 其创办的xAI公司 将于下...
2025-08-24 11:14:13

热门资讯

原创 2... #春日生活好物种草季#近年来,笔记本电脑市场迎来技术爆发期,尤其在手机厂商跨界入局后,轻薄本在性能、...
AMD锐龙AI 9 HX 37... 2024年6月3日,AMD正式发布全新的锐龙AI 300系列处理器。该系列处理器一经发布就引发大家的...
骁龙本这么猛?联想YOGA A... 在人人都是自媒体的时代,一部手机可以解决出镜拍摄问题,而商务出差、大量码字、图像处理等需求用笔记本则...
5个AI模特生成软件推荐 当前AI模特生成软件市场提供了多样化的解决方案,以下是几款备受推崇的工具: 触站AI:强烈推荐!...
2023年CentOS与Ubu... CentOS与Ubuntu的市场格局与技术特性探讨 在服务器操作系统领域,CentOS与Ubuntu...
苹果macOS 15.1:允许... 苹果公司在其最新的macOS 15.1版本中,推出了一项引人注目的新功能——允许用户将Mac App...
原创 苹... 前言 IQUNIX在做好看的桌面产品上,一直都给我留下非常深刻的印象。而且早期和苹果产品的设计风格...
原创 华... 想在竞争残酷的市场中发力,必须要带来一些激进的卖点,但是随着功能特性的提升,硬件也必须要进行给力才可...
原创 华... 在2024年这个被誉为"AI元年"的关键时刻,随着生成式AI的流行,各家手机厂商都在积极备战AI手机...