Математика и рассужденияКод
DeepScaleR, DeepCoder, DeepSWE
Небольшие модели, дообученные обучением с подкреплением: DeepScaleR на 1.5B решает олимпиадную математику, DeepCoder пишет код, DeepSWE работает агентом-разработчиком. Рецепты и данные открыты.
- Разработчик
- Agentica (Беркли, Sky Computing Lab) и Together AI, США
- Первый выпуск
- фев 2025
- Последний выпуск
- июл 2025
- Размеры
- 1.5B – 32B
- Лицензия
- Можно в коммерциюMIT
- Русский язык
- Нет
- Запуск
- Есть в OllamaРаботает и без видеокарты
- Сферы
- Образование, Разработка ПО, Наука
Какие задачи решает
- Решение математических задач с пошаговым выводом
- Генерация и проверка кода
- Агент для исправления ошибок в репозитории
Где применяется
ОбразованиеРазработкаИсследования
Требования к железу
НоутбукНоутбук или обычный ПК, до 8 ГБ видеопамяти — младшие версии
подходит1 видеокартаОдна видеокарта на 16–80 ГБ — средние версии
подходитКластерСервер с несколькими видеокартами — флагманские версии
нет версийВерсии
- DeepSWE-Preview 32B
- DeepCoder-14B и 1.5B
- DeepScaleR-1.5B-Preview
Как внедряю у заказчика
- ПодборВыбираю размер модели под задачу и ваше железо, проверяю на ваших примерах.
- УстановкаРазворачиваю на вашем сервере или в закрытом контуре, отдаю API.
- ДообучениеДообучаю на ваших данных (LoRA) или подключаю базу знаний — что дешевле для задачи.
- ВстраиваниеПодключаю к CRM, 1С, боту, сайту или рабочему чату, настраиваю мониторинг.
Похожие модели
ТекстDeepSeek-R1DeepSeek · КитайМожно в коммерцию
Рассуждающая модель: думает по шагам перед ответом. Сильна в расчётах, логике и коде; есть компактные дистиллированные версии.
ПодробнееМатематика и рассужденияOpenThinkerOpen Thoughts (Стэнфорд, Беркли и другие университеты) · СШАМожно в коммерциюПолностью открытые рассуждающие модели: выложены и веса, и обучающие данные. Новые версии OpenThinkerAgent умеют выполнять многошаговые задачи.
ПодробнееМатематика и рассужденияSky-T1NovaSky (Sky Computing Lab, Беркли) · СШАМожно в коммерциюРассуждающая модель из Беркли, обученная меньше чем за 450 долларов. Показала, что рассуждения уровня o1-preview можно повторить малыми силами.
Подробнее

