Команда WeChat Vision из Tencent открыла исходный код семейства мультимодальных моделей WeMM-Embedding. Модели предназначены для представления и сопоставления текста, изображений, видео и других типов контента. Как сообщает TechNode, их уже используют в WeChat Channels, Official Accounts, Moments и сервисах электронной коммерции.
В семейство входят версии 2B, 4B и 9B. Согласно опубликованным Tencent результатам оценки, модель 9B заняла первое место среди перечисленных моделей в тестах MMEB-v2 и MMEB-v3.
Вместе с моделями компания выпустила код, инструменты оценки и веса. Их можно применять при разработке решений для мультимодального поиска, извлечения информации и рекомендаций.
Ключевые факты
Семейство включает версии 2B, 4B и 9B.
Модели уже используются в WeChat Channels, Official Accounts, Moments и сервисах электронной коммерции.
По результатам Tencent, версия 9B заняла первое место среди перечисленных моделей в тестах MMEB-v2 и MMEB-v3.
Вопросы и ответы
- Что именно доступно разработчикам кроме исходного кода?
Tencent выпустила веса моделей и инструменты оценки для создания мультимодального поиска, извлечения информации и рекомендаций.
- Есть ли у моделей подтвержденное применение в реальных продуктах?
WeMM-Embedding уже используется в WeChat Channels, Official Accounts, Moments и сервисах электронной коммерции.
- Какую версию выбрать для максимального качества?
Семейство включает модели 2B, 4B и 9B; по результатам Tencent версия 9B заняла первое место среди перечисленных моделей в тестах MMEB-v2 и MMEB-v3.
Контекст по теме
- Google Cloud встроила поддержку TPU в vLLM для масштабирования пайплайнов эмбеддингов26 августа 2026 г.
- Tencent тестирует AI-агента Xiaowei для экосистемы WeChat8 июля 2026 г.
- Tencent тестирует ИИ‑ассистента Xiaowei внутри WeChat перед возможным запуском в Q322 июня 2026 г.
- Liquid AI выпустила модели LFM2.5-Embedding-350M и LFM2.5-ColBERT-350M для быстрого многоязычного поиска19 июня 2026 г.
