Open-source и свой сервер 4 мин чтения

ИИ в браузере без сервера: Transformers.js и 152-ФЗ

Transformers.js от Hugging Face запускает модели ИИ в браузере посетителя или в Node.js, без отправки данных на ваш сервер и без платы за каждый запрос. Разбираем, какие задачи реально работают, что с WebGPU, весом моделей и русским языком, и что можно и нельзя утверждать про 152-ФЗ.

Transformers.jsИИ в браузере152-ФЗopen source
Коротко. Transformers.js от Hugging Face запускает нейросети прямо в браузере посетителя или в Node.js: распознавание речи, классификацию текста и картинок, поиск по смыслу. Лицензия Apache 2.0, актуальная версия 4.3.0. Запись голоса или текст заявки можно обработать у человека на устройстве, не гоняя их через платный API. Плюс в деньгах и в меньшем числе мест, где лежат чужие данные. Минус в весе моделей, скорости на слабых телефонах и русском языке, который работает не у всех моделей одинаково.

Зачем ИИ-функции без сервера

Типичный запрос: на сайте нужна кнопка «надиктовать заявку» или умный поиск по каталогу. Обычный путь такой: страница отправляет данные на сервер, сервер идёт в чужой API, вы платите за каждый запрос.

Transformers.js убирает целый этап. Модель скачивается в браузер, считает на процессоре или видеокарте телефона и отдаёт результат странице. На ваш сервер ничего не уходит, счёта за токены нет. Для мелких задач, которые повторяются тысячи раз в день, это заметная экономия.

Репозиторий живой: huggingface/transformers.js на GitHub, более 16 тысяч звёзд, последний релиз 4.3.0 вышел 16 сентября 2026 года. Пакет называется @huggingface/transformers, лицензия Apache 2.0 подтверждается и в репозитории, и в npm.

Что библиотека умеет на практике

Текст: классификация, поиск именованных сущностей, вопросы и ответы, суммаризация, перевод, генерация, эмбеддинги. Изображения: классификация, поиск объектов, сегментация, оценка глубины, удаление фона. Звук: распознавание речи, классификация звуков, синтез речи.

Работает это через pipeline: одна строка выбирает задачу и модель, вторая запускает её. Версия 4 вышла в феврале 2026 года, в ней переписан движок WebGPU вместе с командой ONNX Runtime, и тот же код идёт в браузере, Node.js, Bun и Deno. Готовые модели лежат на Hugging Face Hub с тегом transformers.js.

Что мы проверили на конкретных цифрах. Whisper tiny в квантованном виде весит около 41 МБ: энкодер 10,1 МБ плюс декодер 30,7 МБ по списку файлов на Hub. Мультиязычная модель эмбеддингов multilingual-e5-small в квантованном виде занимает около 118 МБ, лицензия исходной модели MIT. Дальше модель кэшируется в браузере.

WebGPU или WASM

Есть два режима. По умолчанию библиотека считает на процессоре через WebAssembly, для этого режима по умолчанию стоит квантизация q8. Если указать device: webgpu, расчёт переезжает на видеокарту и идёт быстрее, а для WebGPU по умолчанию берётся fp32. Квантизацию можно менять параметром dtype: fp16, q8, q4.

Ловушка в том, что WebGPU пока есть не у всех. В документации Hugging Face сказано, что на март 2026 года поддержка в мире около 85 процентов. В Firefox нужен флаг, в Safari всё зависит от версии. На MDN сказано, что WebGPU работает только по HTTPS. Поэтому в коде нужна проверка navigator.gpu и запасной путь на WASM.

Как с русским языком

Библиотека сама по себе языка не выбирает, всё решает модель. Whisper знает русский: он есть в списке языков в коде OpenAI. Но качество сильно зависит от размера. Tiny и base легко ставятся в браузер, и на русской речи с шумом и терминами они ошибаются заметно чаще, чем крупные версии. Процентов ошибок мы не измеряли, проверяйте на своих записях.

Для поиска по смыслу на русском подходят мультиязычные эмбеддинги вроде multilingual-e5-small, но берите вес в 118 МБ в расчёт. Модели для перевода и генерации крупнее, и на телефоне они упрутся в память.

Что с 152-ФЗ

Здесь легко сказать лишнее, поэтому только проверенное. В статье 3 закона о персональных данных обработкой названо «любое действие (операция) или совокупность действий» с данными, включая сбор, хранение, использование и передачу. Полный текст на consultant.ru. Оператор по тому же закону тот, кто организует или осуществляет обработку, в том числе вместе с другими лицами.

Из этого следует осторожный вывод. Если голос или текст остаётся на устройстве человека и не доходит до вас, у вас нет базы с этими данными и нет передачи в чужой сервис. Это упрощает архитектуру. Но считается ли такая локальная обработка обработкой с вашей стороны и что писать в политике, мы однозначно не подтверждали. Это вопрос к юристу. Про требования к базам напомним: часть 5 статьи 18 не допускает запись и хранение данных граждан РФ в базах за пределами России, за исключением оговорённых случаев. Смежные вопросы разобраны в статье 152-ФЗ для чат-ботов и мессенджеров.

По умолчанию модели грузятся с Hugging Face, то есть браузер посетителя обращается к стороннему хосту. Если хотите этого избежать, модели кладут на свой сервер. Счётчики и аналитика на странице тоже что-то собирают, их нужно учитывать отдельно.

Где это не сработает

Слабые телефоны. Загрузка 40 или 120 МБ по мобильной сети раздражает, а расчёт на старом Android с малым объёмом памяти может идти медленно или завершиться ошибкой. Измеренных нами цифр по скорости и памяти на конкретных моделях телефонов нет, поэтому закладывайте тест на реальных устройствах ваших клиентов.

Качество. Маленькие модели проще больших. Для анализа договора или длинного ответа клиенту нужна серверная модель. Пока модель качается, функция недоступна, покажите человеку индикатор.

И контроль. Модель лежит у пользователя, значит её можно скопировать. Секретной логики в браузер не кладите.

Что можно сделать уже сейчас

Первое: голосовой ввод в форме заявки или в анкете. Запись остаётся на устройстве, текст попадает в поле, человек его правит и отправляет сам. Серверный вариант той же задачи описан в статье про расшифровку совещаний.

Второе: умный поиск по каталогу или базе знаний. Эмбеддинги считаются в браузере или в Node.js, и поиск находит «кондиционер для спальни», даже если в карточке написано иначе. Третье: быстрая классификация обращений до отправки, например отделить жалобу от вопроса. Четвёртое: удаление фона у фото на стороне клиента. Если нужен ответчик на сайте с настоящими рассуждениями, смотрите наш материал про чат-бота на сайт: там модель, скорее всего, будет серверной.

Мы вставляем такие функции в сайты и веб-приложения под ключ: выбираем модель под ваш язык и задачу, проверяем на реальных телефонах, настраиваем запасной режим для устройств без WebGPU. Подробнее на странице ИИ-агентов и встроенного ИИ.

Частые вопросы

Это бесплатно?

Библиотека бесплатна, лицензия Apache 2.0. У каждой модели своя лицензия, её надо читать на карточке в Hub. Платить за токены не придётся, но вы платите трафиком и временем загрузки у пользователя.

Работает ли без интернета?

После первой загрузки модель хранится в кэше браузера, и расчёты идут локально. Первая загрузка требует сети.

Заменит ли это ChatGPT или GigaChat?

Нет. Это небольшие специализированные модели для узких задач. Свободный диалог и сложные рассуждения остаются за большими серверными моделями.

Коротко о главном

Transformers.js под лицензией Apache 2.0 хорошо подходит для узких задач: голос, поиск по смыслу, классификация. Вы экономите на API, а данные остаются у человека. Цена вопроса: вес моделей, разбросе устройств и русском языке, который нужно проверять на ваших данных. По 152-ФЗ локальная обработка снимает часть вопросов, но формулировки в политике согласуйте с юристом.

Хотите узнать, какие функции в вашем сайте можно вынести в браузер, а какие лучше оставить на сервере? Напишите мне в Telegram кодовое слово «БРАУЗЕР», и мы обсудим вашу задачу.

Ещё open-source для бизнеса

Эта статья — часть каталога бесплатных решений, которые я разворачиваю на вашем сервере под ключ: CRM, аналитика, документы, почта, безопасность, магазины, AI.

Услуги по теме

Что я делаю для бизнеса

  • Боты в Telegram, MAX, VK
  • Автоматизация процессов и CRM
  • Аналитика и дашборды
  • Сайты и лендинги под ключ

Бесплатно: чек-лист «Готов ли ваш бизнес к 152-ФЗ»

12 пунктов, которые проверяют готовность за час: данные, согласия, уведомление в РКН, локализация, защита. Отметьте, что уже сделано, и увидите дыры, за которые сейчас штрафуют.

Готовы обсудить вашу задачу?

Бесплатная консультация — разберём, как внедрить это в вашем бизнесе под ключ. Без форм, пишите напрямую.

Пишу о разработке, ИИ и законах для бизнеса

Разборы, кейсы и практика — без воды. Выходит регулярно, читать 3–5 минут.

Готовые решения под ключTurnkey solutionsSoluciones llave en mano交钥匙解决方案Түлхүүр гардуулах шийдэл 451 готовых IT-решений для бизнеса451 ready-made IT solutions for business451 soluciones IT listas para empresas451 个面向企业的现成 IT 解决方案Бизнест зориулсан 451 бэлэн IT шийдэл Автоматизация, боты, AI, 152-ФЗ и платформы · бесплатная консультацияAutomation, bots, AI, data privacy and platforms · free consultationAutomatización, bots, IA, privacidad de datos y plataformas · consulta gratis自动化、机器人、AI、数据合规与平台 · 免费咨询Автоматжуулалт, бот, AI, өгөгдлийн хамгаалалт ба платформ · үнэгүй зөвлөгөө Смотреть каталогView catalogVer catálogo查看目录Каталог үзэх