扛住十亿级日均调用!微信视觉团队重磅开源 WeMM-Embedding 模型
近日,AI 开源社区迎来了一位重量级选手。腾讯微信视觉团队正式宣布,将旗下通用多模态嵌入模型 WeMM-Embedding 全面开源。
历经实战考验,日调用破十亿
与许多停留在实验室阶段的模型不同,WeMM-Embedding 是一项真正经过严苛工业级检验的技术成果。目前,它已被大规模部署在微信的推荐与搜索系统核心链路中,每日支撑着高达十亿量级的调用量。此次开源,意味着微信将自身在多模态 AI 领域的实战经验与基础设施向全行业敞开。
多版本矩阵,满足多样化部署需求
为了适配不同业务场景下的算力限制,WeMM-Embedding 提供了 2B、4B 和 9B 三个不同参数体量的版本。不论是追求极致性能的云端服务,还是需要轻量化的端侧部署,开发者都能找到最契合的方案。
硬核技术架构:既要懂多模态,也要跑得快
在技术实现上,该模型采用了统一架构设计,并巧妙融合了“两阶段训练”与“知识蒸馏”两项核心技术。这种设计思路的精妙之处在于,它不仅大幅增强了模型对文本、图像等跨模态数据的深度理解能力,更兼顾了实际落地时的部署效率,打破了性能与效率的壁垒。
赋能行业,共建多模态AI生态
对广大 AI 开发者而言,WeMM-Embedding 的开源不仅是获得了一个强大的基础工具,更是拿到了多模态应用落地的加速器。随着这项底层技术的开放,微信正进一步推动其在多模态 AI 生态建设上的开放步伐,势必将为各垂直领域的创新应用注入一剂强心针。