9月5日消息,微信于官方平台宣布,微信视觉团队把微信线上每天调用十亿量级的通用多模态嵌入模型 WeMM-Embedding开源,包含 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档以及任意交错的多模态输入。
WeMM-Embedding 从统一多模态架构出发,通过两阶段训练提升内容区分能力,再用知识蒸馏与套娃表示兼顾小模型效果和大规模部署效率。
9月5日消息,微信于官方平台宣布,微信视觉团队把微信线上每天调用十亿量级的通用多模态嵌入模型 WeMM-Embedding开源,包含 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档以及任意交错的多模态输入。
WeMM-Embedding 从统一多模态架构出发,通过两阶段训练提升内容区分能力,再用知识蒸馏与套娃表示兼顾小模型效果和大规模部署效率。
免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。
热门推荐