阿里通义千问开源新一代音频语言模型 支持语音聊天且内容精准度更高
创始人
2024-08-13 22:15:18
0

【太平洋科技快讯】近日,阿里巴巴旗下通义千问团队宣布正式开源Qwen2-Audio系列的两个模型——Qwen2-Audio-7B和Qwen2-Audio-7B-Instruct。Qwen2-Audio系列模型作为大规模音频语言模型,具备接受多种音频信号输入的能力,并能根据语音指令进行音频分析或直接生成文本响应。

Qwen2-Audio提供两种交互模式。一是语音聊天模式,用户可无需文本输入,直接通过语音与模型进行互动;二是音频分析模式,用户可结合音频和文本指令对音频内容进行分析,并且该模型支持超过8种语言和方言,包括中文、英语、法语、意大利语、西班牙语、德语、日语和粤语,满足不同用户的需求。

Qwen2-Audio与上一代模型Qwen-Audio相比,Qwen2-Audio在声音理解能力和指令跟随能力上均实现了显著提升,通义团队还发布了一套全新的音频理解模型测评基准,相关论文已被国际顶级会议ACL 2024收录。

该模型具有高性能、易于集成和可微调的特点,代码已集成到Hugging Face的transformers库,方便开发者快速上手和使用。

在一系列基准数据集的测试中,Qwen2-Audio系列模型的表现超越了之前的最佳模型,展现了其在音频处理领域的领先地位。

相关内容

黄仁勋官宣Alpamayo...
英伟达CEO黄仁勋在X上发文称,今天正式推出Alpamayo 2 ...
2026-08-06 05:55:05
京东开源JoyAI-Vid...
快科技8月5日消息,京东正式开源自研实时流式视频编辑模型JoyAI...
2026-08-05 17:17:32
AI不再用完即忘:华为诺亚...
2026年8月3日,华为诺亚方舟实验室正式开源MindMemOS—...
2026-08-05 17:11:41
京东开源实时流式视频编辑模...
8月5日,京东宣布开源自研的实时流式视频编辑模型JoyAI-Vid...
2026-08-05 17:06:20
韩国启动全民AI成长阶梯项...
2026年8月3日,韩国科学技术信息通信部正式启动全民AI成长阶梯...
2026-08-03 20:27:33
从全民AI入门到创业孵化,...
8月3日,财闻海外资讯消息,韩国科学技术信息通信部正式启动全民AI...
2026-08-03 20:23:33

热门资讯

黄仁勋官宣Alpamayo 2... 英伟达CEO黄仁勋在X上发文称,今天正式推出Alpamayo 2 Super,这是英伟达面向自动驾驶...
“AI小法官”提升法治教育实效 原标题:福建省厦门市康乐第二小学推动人工智能与法治教育融合——“AI小法官”提升法治教育实效 “偷看...
开源证券:给予国邦医药买入评级 开源证券股份有限公司近期对国邦医药进行研究并发布了研究报告《公司信息更新报告:收入稳健增长,动保业务...
京东开源JoyAI-Video... 快科技8月5日消息,京东正式开源自研实时流式视频编辑模型JoyAI-Video-Edit,打破传统视...
AI不再用完即忘:华为诺亚开源... 2026年8月3日,华为诺亚方舟实验室正式开源MindMemOS——一个面向AI Agent的可迁移...
京东开源实时流式视频编辑模型J... 8月5日,京东宣布开源自研的实时流式视频编辑模型JoyAI-Video-Edit。据悉,用户可以一边...
NVIDIA发布新功能分支Un... IT之家 8 月 4 日消息,NVIDIA 当地时间昨日发布了版本号为 610.57.04 的新功能...
开源证券:维持陆家嘴“买入”评... 开源 证券研报指出, 陆家嘴中期业绩大幅增长,租赁现金流入稳中有增。公司2026H1实现归母净利润1...
韩国启动全民AI成长阶梯项目,... 2026年8月3日,韩国科学技术信息通信部正式启动全民AI成长阶梯项目,项目整合全民AI学习馆、全民...