Картинка + текстКартинки
Janus
Одна модель и понимает картинки, и рисует их по описанию. Janus-Pro-7B была заметна в начале 2025 года, но по качеству картинок уступает специализированным моделям.
- Разработчик
- DeepSeek, Китай
- Первый выпуск
- окт 2024
- Последний выпуск
- янв 2025
- Размеры
- 1B – 7B
- Лицензия
- Коммерция с условиямиКод — MIT, веса — DeepSeek Model License (коммерция разрешена, есть запреты на отдельные применения)
Какие задачи решает
- Ответы на вопросы по картинкам
- Черновые иллюстрации по описанию
- Эксперименты с единой моделью зрения и генерации
Где применяется
МаркетингИсследовательские команды
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- Janus-Pro 1B / 7B
- JanusFlow-1.3B
- Janus-1.3B
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
КартинкиBAGELByteDance Seed · КитайМожно в коммерцию
Единая модель, которая и понимает картинки, и генерирует, и редактирует их по диалогу. Похожа на то, как работают картинки в ChatGPT.
ПодробнееКартинкиOmniGenBAAI (Пекинская академия ИИ) · КитайМожно в коммерциюУниверсальная модель: генерирует, редактирует, переносит объект или человека с фото в новую сцену без отдельных плагинов.
ПодробнееКартинка + текстQwen-VLAlibaba (команда Qwen) · КитайМожно в коммерциюОдна из сильнейших открытых моделей зрения: читает документы, таблицы, графики, видео, работает с интерфейсами. С Qwen3.5 зрение встроено прямо в основную модель Qwen.
Подробнее

