ТекстКодМатематика и рассуждения
WizardLM, WizardCoder, WizardMath
Дообучения Llama, Mistral и StarCoder методом Evol-Instruct — автоматическим усложнением инструкций. WizardLM-2 выложили в апреле 2024 и почти сразу удалили, поэтому актуальны только версии 2023 года.
- Разработчик
- WizardLM (Microsoft и Пекинский университет), США / Китай
- Первый выпуск
- май 2023
- Последний выпуск
- янв 2024
- Размеры
- 7B – 70B
- Лицензия
- Коммерция с условиямиЗависит от базы: версии на Llama 2 — Llama 2 Community License, WizardCoder 33B — лицензия DeepSeek, ранние на LLaMA 1 — некоммерческие
Какие задачи решает
- Сложные многошаговые инструкции
- Помощь программистам
- Решение математических задач
- Эксперименты с методами дообучения
Где применяется
ИТ-отделОбразованиеR&D
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- WizardCoder 33B V1.1
- WizardMath 7B V1.1 (Mistral)
- WizardLM 70B, WizardMath 70B, WizardCoder Python 34B
- WizardLM 13B V1.2
- WizardCoder 15B
- WizardLM 13B V1.0
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
ТекстVicunaLMSYS (Беркли и партнёры) · СШАКоммерция с условиями
Одна из первых открытых чат-моделей 2023 года: LLaMA, дообученная на диалогах пользователей ChatGPT. Историческая веха, сегодня уступает любой современной модели того же размера.
ПодробнееКодCode LlamaMeta · СШАКоммерция с условиямиВерсия Llama 2, доученная на коде; есть варианты для Python и для диалога. Устарела, но много готовых дообученных версий и инструментов.
ПодробнееТекстHermesNous Research · СШАКоммерция с условиямиДообучения Nous Research поверх Llama, Mistral, Qwen и Seed-OSS. Ценятся за точное следование инструкциям, вызов функций и ответы в строгом JSON; реже отказывают, чем исходные модели, у Hermes 4 есть режим рассуждений.
Подробнее

