微信开源多模态嵌入模型WeMM-Embedding,已在微信大规模使用
9月8日,据报道,微信AI官方于9月4日宣布开源通用多模态嵌入模型WeMM-Embedding,提供2B、4B、9B三个版本,支持文本、图像、视频、视觉文档及任意交错的多模态输入。
微信员工@客村小蒋介绍,该模型让系统能同时理解文字、图片和视频,并将其置于同一语义空间进行比较和检索。据透露,该模型已在微信内部大规模部署,覆盖朋友圈搜索、视频号推荐、公众号推荐及微信电商等场景,每天调用量达10亿次。在国际权威榜单MMEB-v2上,WeMM-Embedding排名第一,超越此前所有已提交的开源与闭源模型。