Поиск и RAGКомпьютерное зрение

WeMM-Embedding

Универсальные эмбеддинги на базе Qwen3.5: переводят текст, картинки, видео и визуальные документы в один вектор на 4096 чисел. Звук не поддерживается. Языки в карточке: китайский и английский.

Разработчик
Tencent, Китай
Первый выпуск
авг 2026
Последний выпуск
авг 2026
Размеры
2B и 9B
Лицензия
Можно в коммерциюApache 2.0, кроме сторонних компонентов (их условия указаны в файле LICENSE)
Русский язык
Нет
Запуск
Через свой серверНужна видеокарта
Сферы
Торговля и маркетплейсы, Медиа и продакшн, Документы и бухгалтерия, Поддержка клиентов

Какие задачи решает

  • поиск по каталогу товаров по картинке или описанию
  • поиск по видео и презентациям
  • RAG по смешанным материалам из текста и изображений

Где применяется

интернет-магазинымедиа и архивыбазы знаний

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. WeMM-Embedding-9B
  2. WeMM-Embedding-2B

Как запустить

На своём сервереВеса скачиваются с Hugging Face, запуск — через vLLM (нагрузка и API) или llama.cpp (скромное железо). Так модель работает в закрытом контуре, без оплаты за запросы.Hugging Face
Сколько нужно железаПосчитайте видеопамять под нужный размер модели, контекст и число одновременных запросов.Открыть калькулятор железа

Ставлю и настраиваю под ключ: подберу размер модели, разверну на вашем сервере, подключу к вашим системам.

Частые вопросы

Можно ли использовать WeMM-Embedding в коммерческом проекте?

Да. Лицензия: Apache 2.0, кроме сторонних компонентов (их условия указаны в файле LICENSE). Это разрешает коммерческое использование, но перед запуском лицензию всё равно стоит показать юристу.

Какое железо нужно для WeMM-Embedding?

Минимум: Ноутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии. Без видеокарты модель практически не работает. Точный объём видеопамяти под ваш размер модели и контекст можно посчитать в калькуляторе железа.

Поддерживает ли WeMM-Embedding русский язык?

Нет. В документации разработчика языки перечислены, русского среди них нет. Для русских задач лучше взять модель из подборки «Открытые ИИ-модели с русским языком».

Где скачать WeMM-Embedding и сколько это стоит?

Веса WeMM-Embedding лежат в открытом доступе и скачиваются бесплатно. Платить нужно только за железо, на котором модель работает, и за настройку. Ссылки на первоисточник — в конце страницы.

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели

Источник: huggingface.co/tencent/WeMM-Embedding-9B. Данные сверены с карточкой модели 22.09.2026. Лицензию перед коммерческим запуском проверьте с юристом.