微信开源多模态嵌入模型WeMM-Embedding
IT时代网9月4日消息,微信 AI 团队宣布将通用多模态嵌入模型 WeMM-Embedding 开源,提供 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档以及任意交错的多模态输入。这个模型目前每天都在线上承接十亿量级的调用。
架构上,WeMM-Embedding 以 Qwen3.5 多模态架构作为统一骨干,图像、视频和文字从一开始就在同一个模型里共同处理。在权威多模态嵌入榜单 MMEB-v2 上,9B 版本以 80.6 分位列第一,2B 版本拿到 77.9 分,超过此前领先的 8B 开源模型。
模型已在微信的推荐与搜索系统中大规模部署,覆盖视频号、直播、图文内容平台、电商与朋友圈,生成的多模态表示被用于候选检索、排序特征构建、用户序列建模和跨域内容理解。在 26 项内部任务基准上,2B 版本相比同规模基线从 60.9 提升到 72.0,分类、搜索、跨域匹配等五类任务全面走高。

注:本文综合自IT之家等,文中包含AI辅助创作的内容。
THE END