Картинка + текст
Keye-VL
Модели зрения от Kuaishou с упором на короткие видео. Keye-VL-2.0 (30B, активны 3B) хорошо понимает, что и когда происходит в ролике.
- Разработчик
- Kuaishou, Китай
- Первый выпуск
- июн 2025
- Последний выпуск
- май 2026
- Размеры
- 8B – 671B-A37B
- Лицензия
- Можно в коммерциюApache 2.0
Какие задачи решает
- Разбор и описание коротких видео
- Проверка роликов и контента
- Поиск нужного момента в видео
- Ответы на вопросы по фото
Где применяется
Медиа и соцсетиМаркетингКонтроль контента
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
подходитВерсии
- Keye-VL-2.0-30B-A3B
- Keye-VL-671B-A37B
- Keye-VL-1.5-8B
- Keye-VL-8B-Preview
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
Картинка + текстQwen-VLAlibaba (команда Qwen) · КитайМожно в коммерцию
Одна из сильнейших открытых моделей зрения: читает документы, таблицы, графики, видео, работает с интерфейсами. С Qwen3.5 зрение встроено прямо в основную модель Qwen.
ПодробнееКартинка + текстKimi-VLMoonshot AI · КитайМожно в коммерциюЭкономичная MoE-модель зрения (16B, активны 3B) с длинным контекстом и рассуждающей версией. Хорошо разбирает длинные документы и видео.
ПодробнееКартинка + текстInternVLShanghai AI Laboratory (OpenGVLab) · КитайМожно в коммерциюБольшая линейка китайских моделей зрения с размерами от 1B до 241B. InternVL-U (4B) объединяет понимание картинок, их генерацию и редактирование.
Подробнее

