1. Главная
  2. Блог
  3. Модели и инфраструктура

Модели и инфраструктура

LoRA и QLoRA: когда дообучение действительно нужно
15 августа 2026

Решение «дообучать или нет» разбирается отдельно и почти всегда решается в пользу поиска по документам — «RAG или дообучение модели».

Эта статья про другое: что делать, если решение уже принято в пользу дообучения. Как оно устроено технически, чем облегчённые методы отличаются от полного, что нужно подготовить и во что это обходится.

Выбор модели — решение не про рейтинги, а про ограничения: где могут обрабатываться данные, сколько допустимо тратить на обращение, какая нужна скорость ответа и на каком железе всё это должно работать. Модель, лучшая по бенчмаркам, часто оказывается неподходящей по одному из этих пунктов.

В разделе: сравнение YandexGPT и GigaChat, открытые модели для русского языка, подбор модели под конкретную задачу, расчёт необходимой видеопамяти и квантизация, инструменты развёртывания, шлюзы моделей и миграция без переписывания системы.

Отдельно — тестирование: как проверить модель на своей задаче, а не доверять чужим замерам, и что делать, если зарубежная модель стала недоступна.