微信AI新突破!WeMM
发布时间:2026-09-08来源:互联网编辑
微信视觉团队近日宣布,其研发的通用多模态嵌入模型WeMM-Embedding正式开源,涵盖20亿、40亿和90亿参数的三个版本。该模型突破传统单一模态处理限制,可同步解析文本、图像、视频及视觉文档等输入形式,并支持多模态数据的混合交互处理。
据技术团队介绍,这项创新的核心在于构建统一的语义表征空间。通过将不同模态的数据映射至同一维度向量,系统能够实现跨模态内容的精准比对与智能检索。例如在朋友圈搜索场景中,用户输入文字描述即可匹配包含相关图像或视频的动态;视频号推荐系统则能同时分析视频画面、字幕文本和音频信息,提升内容分发精准度。
该模型已深度融入微信生态体系,日均调用量突破10亿次。除朋友圈搜索外,还广泛应用于视频号内容推荐、公众号文章匹配以及微信电商场景。在近期国际权威评测MMEB-v2中,WeMM-Embedding以显著优势超越所有开源及闭源模型登顶榜首,验证了其在多模态理解领域的领先性。
开发团队同步开放了完整技术资源:学术研究论文已上传至arXiv预印本平台,源代码托管于GitHub的Tencent/WeMM-Embedding项目仓库,预训练模型则通过Hugging Face平台提供下载。此举将为全球开发者提供多模态技术研究的标准化基线,推动跨模态人工智能应用的生态发展。
转载说明:本文系转载内容,版权归原作者及原出处所有。转载目的在于传递更多行业信息,文章观点仅代表原作者本人,与本平台立场无关。若涉及作品版权问题,请原作者或相关权利人及时与本平台联系,我们将在第一时间核实后移除相关内容。
