Как генерировать аниме картинки локально на компьютере без ограничений с 8 ГБ VRAM: выбор модели

Первые шаги

Продолжаем разбираться в выборе оптимальной модели для генерации аниме артов на картошке в 2026 году. Сначала мы рассмотрели, какие модели могут, в принципе, запустится на 8 Гб-ой видеокарте. В первом обзоре были и те кто специализируются на реализме, и те что могут в мультики и в аниме.

Первая часть тут: Как генерировать картинки на компьютере без ограничений с 8 ГБ VRAM

Как мы помним, наша цель именно рисованные персонажи в стиле комикса, манхвы или аниме с возможностью создания NSFW-контента.

Базовые модели обычно намеренно цензурируются и плохо справляются с анатомией в откровенных сценах. Поэтому для аниме, специфических артов и 18+ контента используются файн-тюны (fine-tunes) — модели, дообученные сообществом на огромных массивах специализированных изображений (с таких сайтов, как Danbooru, Pixiv и т.д.).

Хорошая новость! Наши 8 ГБ VRAM идеально подходят для этих задач.

В чем сложность аниме и картун стилей

Тут работает интересный парадокс. С технической точки зрения (для видеокарты) аниме генерировать проще, но с точки зрения восприятия глазом человека — ошибки в аниме стиле часто бросаются в глаза сильнее, чем в фотореализме. Давайте разберем почему.

В чем аниме действительно «проще»:

  1. Текстуры кожи и материалов. В фотореализме мозг зрителя подсознательно ищет поры на коже, пушок на лице, правильное отражение света в зрачке, текстуру ткани. Если кожа выглядит как пластик — фотореализм «сломался». В аниме кожа — это просто заливка одним цветом. Вам не нужно бороться за идеальную текстуру.
  2. Освещение. В фотореализме неправильная тень (например, солнце справа, а тень падает влево) сразу выдает фейк. В аниме освещение часто условное, драматическое или вообще физически невозможное, и это считается нормой («стилем»).
  3. Фон. В аниме фон можно размыть или сделать схематичным (просто цветные полосы), и это будет выглядеть органично. В фотореализме «мыльный» фон часто выглядит как плохой фотошоп.

Почему аниме генерировать СЛОЖНЕЕ (Ловушка четких линий)

Вот здесь кроется подвох. Аниме и комиксы — это лайн-арт (линии).

  1. Линия не прощает ошибок. В фотореализме, если рука немного кривая, она может спрятаться в тени, в складках одежды или в «зерне» фотографии (шуме). В аниме четкий черный контур. Если линия пальца прерывается, идет не туда или сливается с одеждой — это видно моментально. Контраст между линией и заливкой «подсвечивает» любой анатомический косяк.
  2. Анатомия на виду. Аниме часто предполагает стилизованные, но очень точные пропорции. «Шестипалость» нейросетей в аниме заметнее, потому что пальцы в аниме часто рисуются тонкими и длинными. Любое искривление выглядит как перелом, а не как игра света.
  3. Специфичность промптов (Проблема Pony XL). Чтобы получить красивое фото, часто достаточно написать photo of a beautiful woman, 8k, realistic. Чтобы получить красивое аниме в Pony XL, вам нужно знать терминологию. Нейросеть нужно просить конкретными тегами: flat color (плоская заливка) или volumetric lighting (объемный свет), стиль рисовки (kyoto animation style или 90s style). Без этого нейросеть выдаст «кашу» из стилей, которая выглядит дешево.

Сравнение

Тип ошибки Фотореализм Аниме / Арт
Лишний палец «Может, это просто так рука повернулась / смазалась в движении?» (Иногда прокатывает) «Ужас, кривая рисовка, сразу в мусорку.» (Видно сразу)
Странные глаза Выглядит жутко (Зловещая долина). В аниме глаза могут быть любыми, но если они разные по стилю — это провал.
Складки одежды «Ну, ткань так легла». Есть строгие правила рисования складок. Если они рандомные — рисунок выглядит «грязным».
Смешивание стилей Редко бывает проблемой (все фото похожи). Если лицо в стиле 2024 года, а покраска в стиле 1990 года — выглядит отвратительно.

Для новичка начать с фотореализма (модель Juggernaut XL) на самом деле проще. Она почти всегда выдает результат, похожий на фото, и мозг легко обманывается. Начать с аниме (на Pony XL) веселее, но вы быстрее столкнетесь с необходимостью править руки, глаза и учить «заклинания» (теги) для правильного стиля. Зато, когда вы поймете как это делать, результат будет более творческим и уникальным.

«Списать на стиль» можно странную цветовую гамму или фон. Но кривые линии и анатомию в аниме списать на стиль сложнее, чем спрятать их в тенях на фото.

Вот список лучших именно аниме моделей для локальной генерации на ПК на текущий момент, разделенный по архитектурам.

SDXL (Stable Diffusion XL)

На 8 ГБ VRAM модели SDXL дают лучшее соотношение качества и детализации. Родное разрешение — около 1024×1024.

Pony Diffusion V6 XL (и её вариации)

На сегодняшний день это абсолютный король в генерации аниме, фурри, мультяшного арта и любого 18+ контента. Эта модель была обучена с нуля понимать специфические «Booru-теги» (теги с имиджбордов).

Pony V6 — это не просто модель, это уже стандарт. Она «сломала» рынок тем, что выучила миллионы специфических тегов с Danbooru. Пони знает, что такое ахэгао, специфические костюмы, позы и взаимодействия «из коробки». Ей не нужно объяснять анатомию в сценах 18+ — она её вызубрила по умолчанию.

Она невероятно точно следует сложным инструкциям, отлично знает персонажей, позы и фетиши.

Минусы: Имеет специфический «жирный» стиль шейдинга и контуров («Pony Style»), который без использования LoRA или негативных промптов может выглядеть однообразно («пластиково»).

ВАЖНО: Она требует специального стиля промптинга. В начале обязательно нужно писать «скор-теги» для качества:

score_9, score_8_up, score_7_up, score_6_up, [ваши теги тут…]

В негативный промпт обязательно:

score_4, score_5, score_6, source_pony, source_furry, (последние 2 если не нужны пони и фурри)

Без этих тегов модель выдает мусор.

Для 18+: Лучшая анатомия, понимание взаимодействий между персонажами.

Animagine XL 3.1

Главный конкурент Pony в сфере чистого аниме.

Особенности: Создает изображения, больше похожие на скриншоты из современных высокобюджетных аниме. Стиль более «чистый» и кинематографичный, чем у Pony.

Промптинг: Более стандартный, не требует жестких «скор-тегов», но тоже хорошо понимает теги Danbooru.

Для 18+: Хороша, но Pony считается более гибкой для сложных анатомических сцен.

Illustrious XL

Это модель генерации изображений на архитектуре SDXL, которая позиционируется как мощная альтернатива для создания аниме-артов и 2D-иллюстраций. Ее главная цель — предоставить качество и гибкость популярных аниме-моделей (как Pony), но без их специфических ограничений и артефактов.

Примеры генераций.

Тренировалась с нуля на качественном датасете, что дает ей «чистый» стиль без артефактов, свойственных перетренированным моделям. Отлично понимает систему тегов Danbooru (как и Pony), но не требует специфических «триггерных слов» качества (score_99, rating_explicit и т.д.).

На Illustrious XL очень легко тренировать стили и персонажей. LoRA получаются гибкими. Но их количество и разнообразие пока сильно уступают показателям Пони.

Архитектура SD 1.5

Родное разрешение 512×512 (или 512×768 для портретов).

Почему это все еще актуально на 8 ГБ VRAM? Скорость. Модели SD 1.5 будут генерировать за секунды. Плюс под эту базу существуют тысячи LoRA-модификаторов для конкретных персонажей или стилей. Другими словами под нее уже много готовых шаблонов и есть простор для творчества.

RevAnimated (Reverb’s Animated)

Это модель не совсем про чистое аниме, а про 2.5D арт и фэнтези.

Особенности: Лучшая модель для создания игровых артов, концепт-артов, фэнтези-персонажей. У неё очень узнаваемый «объемный», красочный стиль, средний между рисунком и 3D-рендером.

Для 18+: Отлично справляется, создавая очень красивые «рисованные» арты.

Любые «Mix» модели (Anything V5, AbyssOrangeMix3)

Модель Hassaku (SD1.5).

Это классические аниме-модели эпохи SD 1.5. Дают более «плоский», традиционный аниме-стиль. Их главное преимущество — они очень легкие и под них сделано 90% существующих LoRA для аниме-персонажей на сайте Civitai.

Сравнение с Flux.1 (и его аниме-версиями)

Примеры генераций.

Flux — это монстр в плане следования инструкциям (prompt adherence).

Главный плюс: Если вы напишете: «Девочка держит яблоко в левой руке, а правой машет, на заднем плане текст ‘HELLO'», Flux нарисует это идеально с первого раза. Pony здесь начнет путаться (рисовать три руки или яблоко в зубах).

Главный минус (Стиль): Базовый Flux тяготеет к реализму или 3D-рендеру. Чтобы заставить его рисовать «чистое 2D аниме», нужно использовать сильные LoRA или специальные чекпоинты (файн-тюны), которые часто ломают его «ум».

  • Цензура и Анатомия 18+: Базовый Flux сильно зацензурен. Чтобы получить откровенный контент, нужно использовать Uncensored версии и LoRA. И даже с ними Flux пока хуже понимает специфическую «аниме-физику» тел, чем Pony.
  • Скорость на 8 ГБ: Это боль. Даже в сжатом (GGUF Q4/NF4) виде генерация займет 30-60 секунд на кадр. Это убивает процесс творческого поиска («нагенерить 50 вариантов и выбрать лучший»).

Сравнительная таблица

Характеристика Pony V6 XL (SDXL) Flux.1 (Dev/Anime Finetunes)
Понимание тегов (Booru tags) ⭐⭐⭐⭐⭐ (Идеально) ⭐⭐⭐ (Лучше понимает обычные предложения)
Сложные позы (без ControlNet) ⭐⭐⭐ ⭐⭐⭐⭐⭐ (Понимает «лево/право», «сверху/снизу»)
Количество персонажей ⭐⭐⭐ (Путается без плагинов) ⭐⭐⭐⭐⭐ (Отлично разделяет даже без плагинов)
Наличие LoRA (персонажи) Огромное количество Мало, но растет
Стиль Аниме Нативный, красивый 2D Часто выглядит как «3D модель» или «пластик»
Нагрузка на 8 ГБ VRAM Легкая (можно делать Batch size 4) Тяжелая (по одной картинке, греет карту)

Стоит остаться на Pony XL, если:

  1. Вы хотите генерировать много картинок быстро.
  2. Вам важны специфические фетиши, костюмы или редкие аниме-персонажи (под них есть LoRA).
  3. Вы любите «рисованный» стиль, а не стиль 3D-игры.

Вам стоит попробовать Flux 1 на 8 ГБ (версии GGUF/NF4), если:

  1. Вы хотите создать сложную композицию (например, «Персонаж А сидит на плечах у Персонажа Б и читает газету»). Pony такое не сможет, Flux сможет.
  2. Вам нужно добавить в картинку читаемый текст.
  3. Вы готовы ждать по минуте ради одной картинки с идеальными пальцами (у Flux пальцы получаются лучше).

Недавно вышел Flux 2, который стал во многом лучше, но при этом в 3 раза медленнее, чем Flux 1.

Для наших задач (аниме, генерация персонажей) переход на Flux 2 на 8 ГБ видеокарте сейчас выглядит как даунгрейд по удобству. Вы потеряете возможность быстрой генерации («гача-стайл»).Качество в режиме Q2 (сильное сжатие) будет даже  хуже, чем у полноценной Pony XL.

Общая сравнительная таблица

Модель База Лучшее применение Качество 18+/Анатомии Сложность промптинга Скорость на 8GB
Pony Diffusion V6 SDXL Аниме, Фурри, Арты, Сложный NSFW ⭐⭐⭐⭐⭐ (Лучшая) Высокая (нужны спец. теги) Средняя
Animagine XL 3.1 SDXL Современное аниме (скриншоты) ⭐⭐⭐⭐ Средняя (понимает теги) Средняя
RevAnimated SD 1.5 2.5D арт, Фэнтези, Игровая графика ⭐⭐⭐⭐ Низкая Высокая ⚡
Flux.1 (Dev/Schnell) Flux Только с NSFW LoRA. Сам по себе цензурирован. ⭐⭐⭐ (Пока что) Низкая (естественный язык) Низкая
Illustrious
SDXL Аниме, NSFW, чистый стиль и создание ЛОР ⭐⭐⭐⭐ Средняя (понимает теги) Средняя

Где брать и как использовать

Все эти модели скачиваются с сайта Civitai.com. Там нужно зарегистрироваться и в настройках профиля включить отображение контента «Adult» или «XXX», иначе вы не увидите 18+ модели. Как все это сделать в первый раз, я описал в отдельном гайде по сайту Civit Ai.

Если совсем новичок для 8 ГБ VRAM используйте WebUI Forge (гайды для новичков написаны именно на нем), если готовы потратить пару дней на освоение интерфейса перед работой  — ComfyUI. 

Гайд как в первый раз скачать, установить и запустить WebUI Forge, не взорвав свой компуктер.

Секрет красивых аниме артов — LoRA и Embeddings. Сами модели — это только база. Для конкретного персонажа (например, «2B из Nier Automata») или конкретной позы или действия вам нужно скачать LoRA файл с Civitai и подключить его к модели.

Для исправления рук и анатомии в SD 1.5 используйте «Negative Embeddings» (например, EasyNegative или bad-hands-5), вставляя их в негативный промпт. SDXL (Pony) обычно справляется без них, если промпт составлен верно.

Если вы только начинаете свой тернистый путь ИИ генерации изображений на дому, дальше обязательно почитайте:

Как и где скачать нужную модель Stable Diffusion и все что нужно для ее работы (на примере ReV Animated)

Какие настройки нужно прописать в веб интерфейс для Stable Diffusion 1.5 на примере ReV Animated (разрешение, cfg scale, clip skip и другие).