9月5日消息,微信于官方平台宣布,微信视觉团队把微信线上每天调用十亿量级的通用多模态嵌入模型 WeMM-Embedding开源,包含 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档以及任意交错的多模态输入。
WeMM-Embedding 从统一多模态架构出发,通过两阶段训练提升内容区分能力,再用知识蒸馏与套娃表示兼顾小模型效果和大规模部署效率。
上一篇:广州多举措打通AI技术落地民生的“最后100米”
下一篇:深圳AI同传耳机让外宾直呼Wonderful!