Как генерировать картинки локально на компьютере без ограничений с 8 ГБ VRAM — полный гайд

Первые шаги

В один прекрасный день я задался вопросом, могу ли я, ни платя никакие деньги, генерить хоть что-нибудь на своей ни самой топовой конфигурации ПК. Меня интересовал стиль аниме и картун с прицелом на создание позднее собственной игры (визуальной новеллы) с определенными героями. Но так как я не знал и не понимал какой у меня есть выбор, рассматривал все варианты.

Сам по себе рисую я в стиле «палка-палка-огуречик» и возможность в несколько кликов создать с помощью ИИ красивый арт-картинку в стилистике любой анимехи прямо таки, завораживал. Помыкавшись какое-то время по всяким онлайн сервисам, я понял, что все они в разной степени зацензурены и «творить друг с другом любовь» в рамках сюжета и законодательства мои персонажи, если я буду их делать там, — не смогут.

Тогда остался только один путь — генерить изображения у себя, чтобы никто и никак ни мог ограничить мое высокое искусство. Но что можно сгенерить на компе, который собирался 5 лет назад? Сейчас, когда цены на оперативку и видюхи только олигархам по карману?

Конфигурация

У меня с собой было:

  • видеокарта Нвидиа 3050 с 8 гб видеопамяти (для некоторых моделей нужно меньше). 30-ая серия не принципиальна, главное количество памяти.
  • 32 гб оперативки (купил до повышения цен впрок, для большинства моделей, которые мы будем использовать, столько не требуется).

Эта статья призвана ответить на два вопроса:

  1. Может ли человек без топовой видеокарты приобщиться к миру высокой культуры ИИ творчества и генерить без ограничений у себя на компухтере, все что захочет?
  2. Может ли это сделать человек, который никогда в жизни ничего подобного не делал?

Спустя 2 недели опытов на себе и 900 с лишним (ДЕВЯТЬСОТ, КАРЛ!) страниц переписки разными ИИ-помощниками я могу с уверенностью ответить на оба. Да, может.

Этот скромный и далеко не исчерпывающий опыт я и постараюсь изложить на этом сайте, начиная с этой статьи, чтобы помочь таким же энтузиастам ИИ творчества, как я, начать свой тернистый путь и не наделать столь же глупых ошибок.

Какие локальные модели можно запускать дома

Мои личные ограничения 8 ГБ видеопамяти и 32 Гб ОЗУ. Пока это потолок моих возможностей и все запускается на этой конфе. Если какие-то модели требуют чего-то меньше или больше, я пропишу дополнительно.

Для генерации изображений 8 ГБ VRAM — это тот порог, где вы можете делать почти всё, но для новейших моделей потребуются оптимизированные версии.

32 ГБ ОЗУ здесь играют вспомогательную роль (помогают не «вылетать» при загрузке моделей), но основная нагрузка лежит на видеокарте. Вот лучшие варианты на 2026 год.

FLUX.1

Примеры генераций. Есть кошаки, тянки и анимехи. Пальцев по пять штук, что еще для счастья надо!

На данный момент модель Flux — это лидер по качеству, пониманию текста и прорисовке пальцев и деталей. В оригинале она огромная, но сообщество сделало сжатые версии.

Версия которая запустится на моей конфигурации: Flux.1 [Dev] или [Schnell] в формате GGUF (Q4_0, Q5_0) или NF4.

Оригинальный Flux требует 24 ГБ VRAM (то есть на момент написания статьи 150-200к за 3090), НО сжатые (квантованные) версии (GGUF/NF4) позволяют запускать его на 8 ГБ VRAM с отличным качеством.

Забегая вперед скажу, что Флукс 1 на своей «картохе» я запустил, но работать с ним с кучей костылей в моем случае было тяжеловато.

SDXL (Stable Diffusion XL) — Золотая середина

Это стандарт индустрии на сегодня (как говорит чатик). Родное разрешение 1024×1024. На 8 ГБ работает отлично, если не пытаться генерировать сразу в 4K.

Лучшие модели на базе SDXL:

  • Juggernaut XL: Лучшая универсальная модель для фотореализма. Картинки выглядят как настоящие фото.

    Juggernaut XL, примеры генераций (не мои). Так как мне интересно аниме, то и примеры будут анимешные.
  • RealVisXL: Конкурент Juggernaut, очень «чистый» реализм.

    Примеры генераций RealVisXL.
  • Pony Diffusion V6 XL: Абсолютный король для аниме, артов и 18+ контента. Если вы хотите создавать персонажей — вам нужна именно она. Она понимает стиль и теги лучше любой другой модели.
Примеры генераций Pony Diffusion V6 XL.
  • Animagine XL: Хорошая альтернатива Pony для более «стандартного» аниме-стиля.
Примеры генераций Animagine XL
  • Illustrious XL. Один из основных конкурентов Пони в его весовой категории. Арты выглядят подороже, но библиотека плюшек меньше (хотя пополняется).
Примеры генераций. Кошаки и тянки тоже в наличии.

SD 1.5 (Старое поколение моделей) — Для скорости и ControlNet

Старое, не значит плохое! Я начал именно с него, чтобы понимать как все работает. Запускается на допотопных «калькуляторах» и позволяет «пощупать руками» локальную генерацию изображений без цензуры вообще считай кому угодно!

Родное разрешение 512×512 (но можно делать апскейл).

«Летает» на 8 ГБ VRAM. Генерация занимает секунды. Огромная база дополнений, персонажей, костюмов (LoRA, ControlNet).

Лучшие модели:

  • Realistic Vision: Классика фотореализма для SD 1.5.

    Примеры генераций Realistic Vision.
  • RevAnimated: Потрясающая модель для 2.5D и фэнтези артов.

    Примеры генераций RevAnimated. Это будет одна из первых моделей, которую мы запустим.
  • EpicPhotoGasm: Очень качественный реализм.
Примеры генераций.

Промежуточное резюме

Довольно много моделей можно запустить дома на своей «картошке»!

  • Самая большая из тех что влезет — FLUX.1 [Dev] или [Schnell]: (оригинал требует 24 ГБ VRAM) единственным путем решения на 8 ГБ является использование квантованных (сжатых) форматов. Запустится версия, которая ужата в 3 раза. Только в форматах GGUF (Q4_0, Q5_0) или NF4.
  • Для семейства моделей SDXL 8 ГБ — это стандарт и их можно запускать без плясок с бубном. К это варианту относятся куча моделей типа оригинальной SDXL, Pony, Illustrious XL. Модели крутые, яркие и для ценитей «культурного контента» (18+) дают сейчас наибольший простор для самореализации.
  • Для SD 1.5 лимит 8 ГБ позволяет работать максимально быстро и использовать всю экосистему расширений. Ваш выбор, если у вас меньше 8 ГБ видеопамяти (4-6). Идеальна для начала, чтобы понять надо ли онов ам вообще.

Самые большие и качественные модели (типа Flux) на слабом железе работают медленнее, чем старые, но зато дают стиль фотореализм без дополнительных усилий. Смотрите, что вам важнее. Плюс учтите, что библиотека расцензуренных решений для Флукса сильно меньше, чем для того же Пони.

Итак что выбрать:

  • Если нужно максимальное качество и простое понимание промпта БЕЗ «культурных» изысков → используй FLUX.1 в форматах GGUF или NF4.
  • Если нужен баланс, скорость и огромный выбор LoRA, в том числе 18+ → используй SDXL (Pony/Illustrious).
  • Если нужно супер быстрое создание картинок или работа на слабом железе (ниже 8 ГБ) → используй SD 1.5.

Вот в этой статье (которая вообще-то вторая часть этой) я чуть подробнее пишу об особенностях выбора аниме моделей для генерации изображений особенно для NSFW. Если хотите углубится в тему, пожалуйста.

Через что запускать: WebUI Forge vs Fooocus vs ComfyUI

С нашими картофельными 8 ГБ VRAM выбор программы критически важен.

Варианты:

  • WebUI Forge: Это оптимизированная версия популярного интерфейса Automatic1111. Главный плюс: Она автоматически управляет памятью. Там, где обычный Automatic1111 вылетит с ошибкой «Out of Memory», Forge просто чуть замедлится, но сгенерирует картинку. Это простейший способ для работы с NF4-версиями (ужатыми) Flux.

Гайд: Как скачать и установить веб интерфейс Stable Diffusion Webui Forge на ПК в первый раз без опыта.

  • Fooocus: Максимально простой интерфейс (как у Midjourney). Работает на базе SDXL. Сам настраивает все параметры под 8 ГБ VRAM. Качество выдает отличное без лишних кликов.
  • ComfyUI: Выглядит как схема из проводов и блоков. Самая быстрая и экономная по памяти. Позволяет запускать то, что не запускается нигде больше.

Когда я начинал будучи полным новичком, то понял для себя, что новой информации и так много и дополнительную эпопею с проводами-нодами в ComfyUI я не осилю, поэтому выбрал для первых запусков WebUI Forge. 

Стоит ли переплачивать за видюху 16 ГБ

Допустим, вы обчитались всяких статей и насмотрелись ютуб роликов и теперь горите желаем продать что-нибудь ненужное и купить новую видюху «для работы». Но надо ли оно вам? Если вы ни разу ничего не генерили до этого момента, разоряться здесь и сейчас не обязательно. Для старта 8 ГБ хватит за глаза.

Условная RTX 5060 Ti 16 ГБ (на 2026 год) — это не «билет на вход», а «инструмент комфорта и профессионального роста». Критична ли она? Нет. Ускорит ли процесс? Да, (в определенных задачах).

Давайте разберем на пальцах, в чем именно будет заметна разница между нынешними 8 ГБ и условными 16 ГБ (будь то RTX 4060 Ti 16GB или новая 5060 Ti). Есть вещи, которые на 8 ГБ делать либо невозможно, либо очень больно, а на 16 ГБ они становятся рутиной.

Когда 16 ГБ открывают новые возможности

Тренировка своих моделей (LoRA) — Персонажей \ одежды \ поз \ стилей рисования и т.д.

8 ГБ:

  • Тренировать LoRA для SD 1.5: Можно, легко.
  • Тренировать LoRA для Pony XL (SDXL): Почти невозможно локально. Придется танцевать с бубном, использовать экстремальную оптимизацию, и всё равно риск вылета «Out of Memory» огромен. Если вы не прошаренный пользователь, скорее всего, придется платить за облака (RunPod, Colab).

Лайфхак! На самом деле Лоры для моделей семейства SDXL можно тренировать абсолютно бесплатно в облаке на сайте Civitai, потратив на это 5 минут в день. Я лично натренировал уже 2 штуки и вам советую. Делая это вы даже сможете заработать на тамошней партнерской программе «долляры». Вот подробный гайд по регистрации на сайте Civitai.

А вот тренировать Лоры для Флукса или чего-то еще более тяжелого выходит действительно дорого. Тут без хорошей домашней видюхи или облака не обойтись.

16 ГБ:

  • Вы можете тренировать LoRA под Pony XL / SDXL прямо у себя на компьютере. Для визуальной новеллы или девушки-модели на онлике вам нужно обучить нейросеть рисовать именно вашего персонажа в нужном костюме. 16 ГБ дают вам полную независимость.

Современные модели (Flux)

  • 8 ГБ: Запускаются только сильно урезанные версии (Q2/Q3 GGUF). Медленно, качество страдает (но для не профи на глаз не критично).
  • 16 ГБ: Можно запустить Flux.1 Dev в нормальном качестве (FP8 или Q8 \ почти без сжатия) и получать топовую картинку с нормальной скоростью.

Умные текстовые модели (LLM)

  • 8 ГБ: Вы ограничены моделями 7B–8B. Они неплохие, но часто «тупят» в сложных сценариях (написание длинного сюжета).
  • 16 ГБ: Вы можете полностью загрузить в видеокарту модели 12B, 14B и даже 20B (например, Command R). Разница: Модель 14B гораздо лучше держит контекст книги и пишет более литературным языком, чем 8B. И на 16 ГБ она будет летать (50+ токенов/сек), а не ползти.

Когда 16 ГБ просто ускоряют работу

Генерация пачками (Batch Size)

Допустим вам нужно не 1 картинку, а 100 вариантов эмоций или поз 1 персонажа.

  • 8 ГБ: Вы генерируете по 1 картинке за раз (Batch size = 1).
  • 16 ГБ: Вы ставите размер пачки Batch size = 4.

Итог: Пока вы пьете кофе, нейросеть выдает вам в 4 раза больше вариантов за то же время. Меньший размер пачки займет больше времени, но новичку это не критично, если качество тоже самое.

Hires. Fix (Апскейл)

Чтобы картинка была четкой, ее нужно увеличивать.

  • 8 ГБ: Апскейл до 2K разрешения может выбить ошибку памяти. Приходится использовать технологию Tiled VAE (разрезать картинку на куски), что медленнее.
  • 16 ГБ: Можно делать апскейл в 2K–3K разрешение «в лоб» за один проход. Это быстрее и стабильнее.

Сложно придумать, куда среднестатистический пользователь может деть картинку в разрешении 2К. Сделать обои на рабочий стол? Пару штук сделаете и так, потратив лишние 10 минут.

Особенности 50-й серии RTX (Blackwell)

Поскольку речь про RTX 5060 Ti (учитывая, что мы в 2026 году), тут есть еще пара бонусов помимо объема памяти:

  1. Шина памяти и скорость: В 50-й серии память быстрее (GDDR7). Это значит, что сама генерация (Inference) будет проходить на 30–50% быстрее, чем на 30-й или 40-й серии, даже если объем памяти тот же.
  2. FP8 поддержка: Карты 40-й и 50-й серии аппаратно ускоряют работу с форматом FP8 (в котором сейчас работают все новые модели типа Flux и Pony). Ваша 3050 делает это программно (медленнее).

Стоит ли брать перед началом

НЕ СПЕШИТЕ. Разумная стратегия должна быть такой:

  1. Начните на 8 ГБ или меньше (Ваша текущая система).
  2. Поставьте SD 1.5 и Pony XL (FP8) через WebUI Forge или ComfyUI.
  3. Попробуйте сделать первые изображения.
  4. Попробуйте натренировать LoRA для SD 1.5.

Этого достаточно, чтобы понять, нравится ли вам вообще процесс, или вы бросите через неделю.

Вам нужна карта 16 ГБ только тогда, когда вы упретесь в потолок:

  • «Черт, я хочу натренировать LoRA на Флуксе, но не могу!»
  • «Flux мне жизненно необходим, так как я 1000% заработаю на этом миллиард рубасов, но он тормозит!»
  • «Мне нужно генерировать по 500 картинок в час, я не успеваю!»

Итого: Для обучения и старта 8 ГБ — это комфортный минимум. RTX 5060 Ti 16 ГБ — это отличный апгрейд для работы, но он не обязателен в первый день.

Рекомендую также ознакомится с другими статьями из цикла «обучение молодого бойца ИИ фронта»:

  1. Как скачать выбранную модель Stable Diffusion, VAE и прочие «прибамбасы» к ней
  2. Какие настройки Stable Diffusion 1.5 в Forge (или аналоге) надо вбить, чтобы всё заработало и почему именно такие. Тут мы получим нашу первую картинку.