Проверка фактов и оценка ответов

Skywork-Reward

Модели-оценщики: ставят балл ответу языковой модели, насколько он хорош для пользователя. Нужны для дообучения своих моделей и отбора лучшего из нескольких ответов.

Разработчик
Skywork (Kunlun Tech), Китай
Первый выпуск
сен 2024
Последний выпуск
июн 2025
Размеры
0.6B – 27B
Лицензия
Коммерция с условиямиV2 на базе Qwen3 — Apache 2.0; версии на Llama — лицензии Llama 3.1/3.2; первые версии — Skywork Community License
Русский язык
Не заявлен
Запуск
Через свой серверРаботает и без видеокарты
Сферы
Разработка ПО, Поддержка клиентов

Какие задачи решает

  • Выбор лучшего из нескольких ответов бота
  • Оценка качества ответов при дообучении модели
  • Сравнение моделей перед внедрением

Где применяется

Команды, которые дообучают моделиРазработка чат-ботовКонтроль качества ИИ-сервисов

Требования к железу

НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит
1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходит
КластерСервер с несколькими видеокартами — флагманские версии
нет версий

Версии

  1. Skywork-Reward-V2 (8 моделей, 0.6B – 8B)
  2. Skywork-Reward v0.2
  3. Skywork-Reward Llama-3.1-8B и Gemma-2-27B

Как внедряю у заказчика

  1. ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
  2. УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
  3. ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
  4. ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.

Похожие модели