9月5日消息,微信于官方平台宣布,微信视觉团队把微信线上每天调用十亿量级的通用多模态嵌入模型 WeMM-Embedding开源,包含 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档以及任意交错的多模态输入。
WeMM-Embedding 从统一多模态架构出发,通过两阶段训练提升内容区分能力,再用知识蒸馏与套娃表示兼顾小模型效果和大规模部署效率。
上一篇:尼泊尔泥石流灾害中1名受困中国公民获救
下一篇:广东VOCs治理新范本:宇特环境干式一体化方案深度解析