微信视觉团队近日WeMM-Embedding,并透露这组模型已经用于视频号、公众号、朋友圈和电商等业务。
WeMM-Embedding不是聊天模型,而是把文本、图片、视频和视觉文档转成统一的可检索表示,用于搜索、内容召回和推荐。此次发布包括2B、4B和9B三个版本,公开评测结果显示,9B版本在MMEB-v2和MMEB-v3中的综合表现均排名第一。
微信团队还开放了模型代码、评测工具和模型权重,开发者可以自行下载和部署。
上一篇:微软联手沙特AI企业HUMAIN,ALLAM阿拉伯语大模型接入微软生态
下一篇:美媒:乌兰察布跻身中国AI算力重镇