Картинка + текст
Moondream
Небольшая и быстрая модель зрения для продуктовых задач: ответы на вопросы, поиск и указание объектов, подписи. Moondream 3.1 — MoE на 9B с 2B активных.
- Разработчик
- Moondream (M87 Labs), США
- Первый выпуск
- янв 2024
- Последний выпуск
- июн 2026
- Размеры
- 2B – 9B-A2B
- Лицензия
- Коммерция с условиямиMoondream 2 — Apache 2.0; Moondream 3 — Moondream Model License (коммерция в своих продуктах разрешена, нельзя продавать доступ к самой модели как облачный сервис)
Какие задачи решает
- Поиск объектов и подсчёт на фото
- Проверка фото из полевых отчётов
- Подписи и теги для каталога
- Обработка кадров с камер
Где применяется
Розница и складПолевые службыЭлектронная коммерция
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Moondream 3.1 9B-A2B
- Moondream 3 Preview
- moondream2
- moondream1
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Картинка + текстFlorence-2Microsoft · СШАМожно в коммерцию
Очень маленькая модель зрения: подписи, поиск объектов, сегментация и чтение текста по одной команде. Работает даже на процессоре.
ПодробнееКартинка + текстSmolVLMHugging Face · Франция / СШАМожно в коммерциюСамые маленькие модели зрения Hugging Face: от 256M, работают в браузере и на телефоне. SmolVLM2 понимает и видео.
ПодробнееКартинка + текстMolmoAi2 (Allen Institute for AI) · СШАМожно в коммерциюПолностью открытые модели зрения Ai2 (веса и данные). Умеют указывать точку на картинке и считать предметы; Molmo2 понимает видео, MolmoWeb управляет браузером.
Подробнее

