阿里通义千问开源新一代音频语言模型 支持语音聊天且内容精准度更高
创始人
2024-08-13 22:15:18
0

【太平洋科技快讯】近日,阿里巴巴旗下通义千问团队宣布正式开源Qwen2-Audio系列的两个模型——Qwen2-Audio-7B和Qwen2-Audio-7B-Instruct。Qwen2-Audio系列模型作为大规模音频语言模型,具备接受多种音频信号输入的能力,并能根据语音指令进行音频分析或直接生成文本响应。

Qwen2-Audio提供两种交互模式。一是语音聊天模式,用户可无需文本输入,直接通过语音与模型进行互动;二是音频分析模式,用户可结合音频和文本指令对音频内容进行分析,并且该模型支持超过8种语言和方言,包括中文、英语、法语、意大利语、西班牙语、德语、日语和粤语,满足不同用户的需求。

Qwen2-Audio与上一代模型Qwen-Audio相比,Qwen2-Audio在声音理解能力和指令跟随能力上均实现了显著提升,通义团队还发布了一套全新的音频理解模型测评基准,相关论文已被国际顶级会议ACL 2024收录。

该模型具有高性能、易于集成和可微调的特点,代码已集成到Hugging Face的transformers库,方便开发者快速上手和使用。

在一系列基准数据集的测试中,Qwen2-Audio系列模型的表现超越了之前的最佳模型,展现了其在音频处理领域的领先地位。

相关内容

从“一键出片”到“规模量产...
当真人短剧竞争白热化,“纸片人”漫剧成为霸屏新风口。DataEye...
2026-03-10 12:59:57
美专家质疑:美使用AI打击...
在美以开始对伊朗发动军事打击之后,美国在这次行动中使用了人工智能模...
2026-03-10 11:26:58
ALL IN AI 深圳正...
政府工作报告总结过去一年来我国科技创新的非凡成就:新质生产力稳步发...
2026-03-10 11:26:50
整合多元AI模型,三星突围...
三星电子正推进多AI模型手机战略,拟与OpenAI等多家人工智能企...
2026-03-09 23:49:00
AI技术让恶意黑客轻松识别...
一项新研究警告称,AI技术已经让恶意黑客识别匿名社交媒体账号变得极...
2026-03-09 23:48:38
用AI训练AI?AI制药企...
尽管软件服务、技术授权以及自主管线研发构成了 AI 制药企业的三大...
2026-03-09 23:46:47

热门资讯

原创 2... #春日生活好物种草季#近年来,笔记本电脑市场迎来技术爆发期,尤其在手机厂商跨界入局后,轻薄本在性能、...
AMD锐龙AI 9 HX 37... 2024年6月3日,AMD正式发布全新的锐龙AI 300系列处理器。该系列处理器一经发布就引发大家的...
2024云栖大会|阿里云升级无... 北京商报讯(记者魏蔚)9月20日,阿里云无影AI云电脑在2024云栖大会上展出,该版本基于最新的终端...
5个AI模特生成软件推荐 当前AI模特生成软件市场提供了多样化的解决方案,以下是几款备受推崇的工具: 触站AI:强烈推荐!...
骁龙本这么猛?联想YOGA A... 在人人都是自媒体的时代,一部手机可以解决出镜拍摄问题,而商务出差、大量码字、图像处理等需求用笔记本则...
2023年CentOS与Ubu... CentOS与Ubuntu的市场格局与技术特性探讨 在服务器操作系统领域,CentOS与Ubuntu...
MWC2025荣耀多款AI技术... 人民财讯3月6日电,2025世界移动通信大会(MWC 2025)上,荣耀MagicBook Pro ...
苹果macOS 15.1:允许... 苹果公司在其最新的macOS 15.1版本中,推出了一项引人注目的新功能——允许用户将Mac App...
原创 苹... 前言 IQUNIX在做好看的桌面产品上,一直都给我留下非常深刻的印象。而且早期和苹果产品的设计风格...
原创 华... 在2024年这个被誉为"AI元年"的关键时刻,随着生成式AI的流行,各家手机厂商都在积极备战AI手机...