摩尔线程:正式开源音频理解大模型MooER
创始人
2024-08-24 11:15:06
0

【环球网科技综合报道】8月24日消息,国内GPU与AI计算解决方案提供商摩尔线程宣布,正式开源了其音频理解大模型——MooER(摩耳)。

据介绍,该模型是业界首个基于国产全功能GPU进行训练和推理的大型开源语音模型。MooER大模型的开源,是摩尔线程在AI语音技术领域的又一重要里程碑。据摩尔线程介绍,MooER依托其自研的夸娥(KUAE)智算平台,结合创新算法和高效计算资源,仅用38个小时就完成了对5000小时音频数据和伪标签的训练,展现了惊人的计算效率和数据处理能力。

作为业界领先的开源语音模型,MooER不仅支持中文和英文的语音识别,还具备中译英的语音翻译能力。在多个语音识别领域的测试集中,MooER展现出了领先或至少持平的优异表现,特别是在Covost2 zh2en中译英测试集上,BLEU分数达到了25.2,显著优于其他开源模型,取得了可与工业水平相媲美的效果。

MooER的模型结构由Encoder、Adapter、Decoder(LLM)三部分组成,通过高效的音频建模和文本融合机制,实现了对复杂语音信号的理解和转换。在模型训练阶段,摩尔线程采用了先进的LoRA技术,仅更新2%的LLM参数,显著提升了训练效率和最终效果。

此外,摩尔线程还计划后续开源训练代码以及基于8万小时数据训练的模型,旨在推动语音大模型的方法演进和技术落地,为社区贡献更多价值。摩尔线程方面表示,希望通过MooER的开源,促进AI语音技术的普及和发展,助力更多开发者和企业实现技术创新和产业升级。

相关内容

香港维尔利与联合国健康技术...
香港维尔利健康科技集团正式宣布,已与联合国健康技术基金(Unite...
2025-07-12 15:13:30
拍一部烧掉几亿的大烂片,最...
原标题:烂片有种经济上行的美 作者:谢明宏 编辑:李春晖 任何时代...
2025-07-12 14:12:28
看了AI生成的ASMR吃播...
前段时间,一条用 AI 生成的切水果 ASMR 短视频,在洋抖上爆...
2025-07-12 13:13:44
上海AI实验室团队:如何优...
这项由上海AI实验室和复?dan大学联合开展的突破性研究发表于20...
2025-07-12 13:13:26
告别“无效阅读”,AI正在...
学校管理者为零散的阅读活动、无法量化的成果而苦恼; 一线教师在“选...
2025-07-12 12:42:00
月之暗面Kimi K2发布...
月之暗面今天宣布,正式发布Kimi K2模型,并同步开源。Kimi...
2025-07-12 06:12:21

热门资讯

原创 2... #春日生活好物种草季#近年来,笔记本电脑市场迎来技术爆发期,尤其在手机厂商跨界入局后,轻薄本在性能、...
AMD锐龙AI 9 HX 37... 2024年6月3日,AMD正式发布全新的锐龙AI 300系列处理器。该系列处理器一经发布就引发大家的...
骁龙本这么猛?联想YOGA A... 在人人都是自媒体的时代,一部手机可以解决出镜拍摄问题,而商务出差、大量码字、图像处理等需求用笔记本则...
5个AI模特生成软件推荐 当前AI模特生成软件市场提供了多样化的解决方案,以下是几款备受推崇的工具: 触站AI:强烈推荐!...
2023年CentOS与Ubu... CentOS与Ubuntu的市场格局与技术特性探讨 在服务器操作系统领域,CentOS与Ubuntu...
苹果macOS 15.1:允许... 苹果公司在其最新的macOS 15.1版本中,推出了一项引人注目的新功能——允许用户将Mac App...
原创 苹... 前言 IQUNIX在做好看的桌面产品上,一直都给我留下非常深刻的印象。而且早期和苹果产品的设计风格...
原创 华... 想在竞争残酷的市场中发力,必须要带来一些激进的卖点,但是随着功能特性的提升,硬件也必须要进行给力才可...
原创 华... 在2024年这个被誉为"AI元年"的关键时刻,随着生成式AI的流行,各家手机厂商都在积极备战AI手机...