通义千问开源Qwen2.5 开源模型累计下载量突破4000万
创始人
2024-09-19 18:48:28
0

新京报贝壳财经讯(记者罗亦丹)9月19日,云栖大会上,阿里云CTO周靖人发布通义千问新一代开源模型Qwen2.5,其涵盖多个尺寸的大语言模型、多模态模型、数学模型和代码模型,每个尺寸都有基础版本、指令跟随版本、量化版本,总计上架100多个模型,刷新业界纪录。

从数据上看,Qwen2.5全系列模型都在18T tokens数据上进行预训练,相比Qwen2,整体性能提升18%以上,拥有更多的知识、更强的编程和数学能力,支持128K的上下文长度,可生成最多8K内容。模型能够响应多样化的系统提示,实现角色扮演和聊天机器人等任务。在指令跟随、理解结构化数据(如表格)、生成结构化输出等方面Qwen2.5都进步明显。

专项模型方面,用于编程的Qwen2.5-Coder和用于数学的Qwen2.5-Math都比前代有了实质性进步。Qwen2.5-Coder在多达5.5T tokens的编程相关数据上作了训练;Qwen2.5-Math支持使用思维链和工具集成推理(TIR)解决中英双语的数学题。

多模态模型方面,视觉语言模型Qwen2-VL-72B正式开源,Qwen2-VL能识别不同分辨率和长宽比的图片,理解20分钟以上长视频,具备自主操作手机和机器人的视觉智能体能力。

生态上,通义与海内外的开源社区、生态伙伴、开发者共建生态网络,截至2024年9月中旬,通义千问开源模型下载量突破4000万,Qwen系列衍生模型总数超过5万个,成为仅次于Llama的世界级模型群。

校对 穆祥桐

相关内容

“反内卷”与AI双轮驱动 ...
证券时报记者 裴利瑞 吴琦 当科技成长风格占尽市场高光,在杠铃的另...
2025-09-15 07:14:38
重塑投资,公募AI量化大变...
【导读】重塑投资,公募AI量化大变革已至 中国基金报记者 孙晓辉 ...
2025-09-15 06:16:14
AI&半导体:AI...
华金证券近日发布电子行业周报:在以GPT、Gemini等大模型为代...
2025-09-15 06:14:23
“犯罪邀请”伪装成扶贫 老...
制图:朱林(豆包AI生成) 2024年12月,北京市民齐夏走进公...
2025-09-14 07:45:37
图多尔:这几个月一直在培养...
直播吧9月14日讯 在尤文4-3击败国米后,尤文主帅图多尔接受了D...
2025-09-14 07:44:14

热门资讯

原创 2... #春日生活好物种草季#近年来,笔记本电脑市场迎来技术爆发期,尤其在手机厂商跨界入局后,轻薄本在性能、...
AMD锐龙AI 9 HX 37... 2024年6月3日,AMD正式发布全新的锐龙AI 300系列处理器。该系列处理器一经发布就引发大家的...
5个AI模特生成软件推荐 当前AI模特生成软件市场提供了多样化的解决方案,以下是几款备受推崇的工具: 触站AI:强烈推荐!...
骁龙本这么猛?联想YOGA A... 在人人都是自媒体的时代,一部手机可以解决出镜拍摄问题,而商务出差、大量码字、图像处理等需求用笔记本则...
2023年CentOS与Ubu... CentOS与Ubuntu的市场格局与技术特性探讨 在服务器操作系统领域,CentOS与Ubuntu...
苹果macOS 15.1:允许... 苹果公司在其最新的macOS 15.1版本中,推出了一项引人注目的新功能——允许用户将Mac App...
原创 苹... 前言 IQUNIX在做好看的桌面产品上,一直都给我留下非常深刻的印象。而且早期和苹果产品的设计风格...
原创 华... 想在竞争残酷的市场中发力,必须要带来一些激进的卖点,但是随着功能特性的提升,硬件也必须要进行给力才可...
原创 华... 在2024年这个被誉为"AI元年"的关键时刻,随着生成式AI的流行,各家手机厂商都在积极备战AI手机...