
Вы в сотый раз пишете нейросети «мужчина в сером плаще, шрам над бровью, усталый взгляд» — а она каждый раз рисует нового человека. Знакомо? В 2026 году это лечится за один вечер. Обучение LoRA позволяет «загрузить» в Stable Diffusion своего персонажа, фирменный стиль иллюстраций или конкретный товар — и дальше получать его по одному короткому слову в промпте.
В этом руководстве разберём, что такое LoRA простыми словами, как собрать датасет, какие параметры выставить в тренере Kohya_ss и как понять, что модель получилась. Всё делается на своём компьютере: без подписок и без отправки личных фотографий на чужие серверы.
Если коротко: LoRA-модель что это? Это небольшой файлик весом примерно от 10 до 300 МБ, который доучивает большую нейросеть под одну узкую задачу — конкретное лицо, стиль рисования или продукт.
Представьте, что базовая модель — это выпускник университета с широкими знаниями обо всём. Вам не нужно переучивать весь университет с нуля — достаточно приставить к нему узкого специалиста, который шёпотом подсказывает: «рисуй вот этого конкретного человека». Технически LoRA (Low-Rank Adaptation) не переписывает миллиарды весов Stable Diffusion, а добавляет к ним компактные матрицы-надстройки. База остаётся нетронутой, поверх подключается лёгкий слой.
Из этого следуют приятные бонусы: файл весит копейки, lora обучение занимает часы даже на игровом ПК, готовую модель легко передать другу и комбинировать с другими. Именно поэтому на площадках вроде Civitai миллионы таких файликов — люди делятся «специалистами» по всему на свете.
Есть ли альтернативы? Midjourney v8 умеет персонализацию под ваш вкус — это упрощённый аналог, но он подстраивается под предпочтения в целом, а не запоминает конкретный объект. Если нужен строго ваш герой, ваш флакон духов или ваша манера штриховки — своя модель Stable Diffusion через LoRA вне конкуренции.
Главный ингредиент любого обучения — фотографии. Ориентиры по количеству:
Больше — не значит лучше. Двадцать разнообразных кадров работают лучше сотни однотипных селфи.
Требования к самим фото:
Для товара логика обратная: половина кадров на чистом фоне под разными углами, половина — в контексте (в руке, на полке, в интерьере).
Lora обучение реально запустить дома:
Нет подходящей карты? Облачные тренеры Replicate и Fal обучают LoRA за почасовую оплату GPU — несколько долларов за прогон. Удобно для тестов, но личные фото в этом случае уезжают на чужие серверы — решайте сами, что вам ближе.
Этот этап решает 80% успеха. Плохой датасет не спасут никакие настройки.
Шаг 1. Отбор и обрезка. Выкиньте размытые, тёмные и дублирующие кадры. Приведите изображения к квадрату 1024×1024 (или оставьте пропорции, если тренер поддерживает их ведение). Лицо или объект должны занимать значительную часть кадра.
Шаг 2. Капченинг. Каждому фото нужна текстовая подпись — описание того, что в кадре меняется и не должно впитаться в LoRA: одежда, фон, причёска, поза, окружение. Правило простое: что не описано словами — то прилипнет к вашей модели навсегда. Не подписали красную кофту? Получите героя, который вечно носит красную кофту.
Шаг 3. Токен-триггер. Придумайте уникальное слово-активатор, например zxkira — оно не должно ничего значить в языке модели. Все подписи начинаются с него: «zxkira, мужчина в сером пальто стоит у вокзала…». Позже одно это слово будет вызывать вашего персонажа из воздуха.
Типичные ошибки сбора данных, которые губят новичков:
Самый популярный тренер — Kohya_ss: бесплатный, с графическим интерфейсом и активной поддержкой свежих архитектур. Для работы со Stable Diffusion 3.5 ставьте актуальную сборку 2026 года — старые версии эту модель просто не увидят.
Установка:
Параметры для первого запуска (проверенная точка входа):
Сколько времени занимает? Датасет из 25 фото и 15 эпох на RTX 3060 — это примерно час-два для версии Medium и заметно дольше для Large. Облачный прогон на Replicate/Fal укладывается в те же сроки, просто списывается по минутам.
Запустили — и можно идти пить чай. Тренер сам пройдёт по датасету нужное число раз и сложит чекпоинты в папку output.
Не спешите радоваться первому файлу .safetensors — проверяем.
Тестовые генерации. Подключите LoRA и попросите триггер в сценах, которых не было в датасете: герой на пляже, в костюме, в дождь. Похоже на вашего человека в каждом кадре? Отлично.
X/Y plot — сравнение эпох. В WebUI соберите сетку: по одной оси — номера чекпоинтов (эпохи 5, 10, 15, 20), по другой — вес LoRA (0.6, 0.8, 1.0). Одна картинка покажет всю кривую обучения сразу.
Если не похоже — что крутить:
Готовая LoRA подключается элементарно.
В WebUI (Automatic1111-совместимых интерфейсах) — прямо в тексте промпта конструкцией вида <lora:имя_файла:вес>.
В ComfyUI — добавьте ноду LoraLoader между загрузчиком чекпоинта и текстовыми энкодерами, укажите файл и strength.
Вес LoRA — главная ручка влияния: 0.6–0.8 для деликатного вмешательства, 0.9–1.0 для полного сходства. Выше единицы лезут артефакты.
Комбинирование двух LoRA (например, персонаж + стиль): обе конструкции ставятся в один промпт, суммарный вес держите умеренным — что-то вроде 0.7 + 0.6. Перебор даст кашу из артефактов.
Пример промпта с триггером:
zxkira, мужчина в тёмно-сером пальто сидит в вагоне ночного поезда,
тёплый свет от окна, кинематографичный план, 35mm, малая глубина резкости
Negative prompt: blurry, deformed hands, extra fingers, watermark, text
Одно слово zxkira — и знакомый человек едет в незнакомом поезде. Ради этого всё и затевалось.
Обучать самому — необязательно: на Civitai лежат тысячи готовых LoRA на любой вкус — стили, персонажи, предметы, техники. Но перед скачиванием читайте страницу модели: у файла может стоять ограничение на коммерческое использование или запрет отдельных категорий контента. Помните и про базу: Stable Diffusion 3.5 распространяется по лицензии Stability Community — коммерческое применение разрешено компаниям с годовой выручкой до миллиона долларов, выше — отдельное соглашение.
Теперь серьёзная часть. Обучение нейросети на своих фото — полностью легально и приватно, особенно локально. А вот учить модель на чужом лице без согласия человека — плохая идея и во многих странах прямое нарушение (право на изображение, законы о дипфейках). С чужими художественными стилями юридическая планка ниже, но этическая — нет: живой художник вряд ли обрадуется, обнаружив свою манеру в бесплатном файлике. Делайте LoRA на своих героях, свои товары и своё творчество — так проще, чище и спокойнее спится.
Сколько фото минимум нужно, чтобы создать LoRA? Технически модель соберётся даже с 5–10 снимков, но результат будет нестабильным. Комфортный минимум — 15 качественных разнообразных кадров для лица или объекта и от 20 для стиля. Важнее не количество, а разброс ракурсов, света и фонов: двадцать разных фотографий уверенно обыгрывают сто однотипных.
Потянет ли RTX 3060 обучение LoRA? Да, это классический «народный» вариант. На 12 ГБ видеопамяти Stable Diffusion 3.5 Medium обучается спокойно: включите кэширование латентов и выходов текстового энкодера, поставьте batch size 1 и точность fp16. Версия Large на такой карте уже тесновата — для неё разумнее взять карту на 16–24 ГБ или облачный тренинг.
Можно ли обучить нейросеть на своих фото? Конечно, и это лучший сценарий. При локальном обучении фотографии никуда не уходят с компьютера: датасет, тренировка и результат живут на вашем диске, никакой облачной обработки нет. Это принципиальное преимательство перед онлайн-сервисами — приватность по умолчанию. Единственное «но»: храните датасет в надёжном месте, он же биометрия.
Чем LoRA отличается от полноценного checkpoint? Checkpoint — это целая модель весом в несколько гигабайт: самодостаточная, но тяжёлая. LoRA — надстройка на 10–300 МБ, которая работает только поверх базовой модели и меняет её поведение в узкой области. Зато LoRA можно подключать по несколько штук одновременно, быстро переключать и передавать — полный checkpoint ради одного персонажа никто качать не будет.
Можно ли продавать изображения, созданные с LoRA? Зависит от двух лицензий: базовой модели и самой LoRA. SD 3.5 разрешает коммерцию небольшим командам, а у скачанной с Civitai LoRA автор мог поставить ограничения — ищите блок permitted/allowed use на странице модели. Свои обученные LoRA вы контролируете сами, поэтому для коммерческих проектов честнее и безопаснее натренировать модель на своём материале.
Своя LoRA — это переход от «уговаривания» нейросети к управлению ею. Один вечер на сбор датасета, пара часов на обучение в Kohya_ss — и ваш персонаж, стиль или продукт доступны по одному триггеру в любом интерфейсе. Начните с малого: 15–20 фото, настройки из этой статьи, первая проверка через X/Y plot — вторая попытка почти всегда попадает в цель.
Чтобы двигаться быстрее, пригодятся наши материалы: полный гид по Stable Diffusion поможет разобраться с генерацией в целом, негативные промпты и апскейл доведут качество картинок до прода, а заработок на промптах подскажет, как превратить умение делать кастомные модели в доход.
Ежедневные подборки промптов, свежие новости и материалы об ИИ — там, где удобно. Без спама, только редакционный отбор.