Роботы

OpenVLA

Первая крупная открытая модель «зрение-язык-действие»: робот-манипулятор выполняет команды вроде «положи яблоко в миску». OFT ускоряет её в разы.

Разработчик
Стэнфорд, Беркли и партнёры, США
Первый выпуск
июн 2024
Последний выпуск
фев 2025
Размеры
7B
Лицензия
Можно в коммерциюMIT

Какие задачи решает

  • Управление манипулятором по текстовой команде
  • Пилоты по роботизации простых операций
  • Основа для дообучения под свой робот

Где применяется

ПроизводствоСклады и логистикаИсследовательские лаборатории

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
нет версий
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. OpenVLA-OFT
  2. OpenVLA

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели