Продолжаем разбираться в выборе оптимальной модели для генерации аниме артов на картошке в 2026 году. Сначала мы рассмотрели, какие модели могут, в принципе, запустится на 8 Гб-ой видеокарте. В первом обзоре были и те кто специализируются на реализме, и те что могут в мультики и в аниме.
Первая часть тут: Как генерировать картинки на компьютере без ограничений с 8 ГБ VRAM
Как мы помним, наша цель именно рисованные персонажи в стиле комикса, манхвы или аниме с возможностью создания NSFW-контента.
Базовые модели обычно намеренно цензурируются и плохо справляются с анатомией в откровенных сценах. Поэтому для аниме, специфических артов и 18+ контента используются файн-тюны (fine-tunes) — модели, дообученные сообществом на огромных массивах специализированных изображений (с таких сайтов, как Danbooru, Pixiv и т.д.).
Хорошая новость! Наши 8 ГБ VRAM идеально подходят для этих задач.
В чем сложность аниме и картун стилей
Тут работает интересный парадокс. С технической точки зрения (для видеокарты) аниме генерировать проще, но с точки зрения восприятия глазом человека — ошибки в аниме стиле часто бросаются в глаза сильнее, чем в фотореализме. Давайте разберем почему.
В чем аниме действительно «проще»:
- Текстуры кожи и материалов. В фотореализме мозг зрителя подсознательно ищет поры на коже, пушок на лице, правильное отражение света в зрачке, текстуру ткани. Если кожа выглядит как пластик — фотореализм «сломался». В аниме кожа — это просто заливка одним цветом. Вам не нужно бороться за идеальную текстуру.
- Освещение. В фотореализме неправильная тень (например, солнце справа, а тень падает влево) сразу выдает фейк. В аниме освещение часто условное, драматическое или вообще физически невозможное, и это считается нормой («стилем»).
- Фон. В аниме фон можно размыть или сделать схематичным (просто цветные полосы), и это будет выглядеть органично. В фотореализме «мыльный» фон часто выглядит как плохой фотошоп.
Почему аниме генерировать СЛОЖНЕЕ (Ловушка четких линий)
Вот здесь кроется подвох. Аниме и комиксы — это лайн-арт (линии).
- Линия не прощает ошибок. В фотореализме, если рука немного кривая, она может спрятаться в тени, в складках одежды или в «зерне» фотографии (шуме). В аниме четкий черный контур. Если линия пальца прерывается, идет не туда или сливается с одеждой — это видно моментально. Контраст между линией и заливкой «подсвечивает» любой анатомический косяк.
- Анатомия на виду. Аниме часто предполагает стилизованные, но очень точные пропорции. «Шестипалость» нейросетей в аниме заметнее, потому что пальцы в аниме часто рисуются тонкими и длинными. Любое искривление выглядит как перелом, а не как игра света.
- Специфичность промптов (Проблема Pony XL). Чтобы получить красивое фото, часто достаточно написать photo of a beautiful woman, 8k, realistic. Чтобы получить красивое аниме в Pony XL, вам нужно знать терминологию. Нейросеть нужно просить конкретными тегами: flat color (плоская заливка) или volumetric lighting (объемный свет), стиль рисовки (kyoto animation style или 90s style). Без этого нейросеть выдаст «кашу» из стилей, которая выглядит дешево.
Сравнение
| Тип ошибки | Фотореализм | Аниме / Арт |
| Лишний палец | «Может, это просто так рука повернулась / смазалась в движении?» (Иногда прокатывает) | «Ужас, кривая рисовка, сразу в мусорку.» (Видно сразу) |
| Странные глаза | Выглядит жутко (Зловещая долина). | В аниме глаза могут быть любыми, но если они разные по стилю — это провал. |
| Складки одежды | «Ну, ткань так легла». | Есть строгие правила рисования складок. Если они рандомные — рисунок выглядит «грязным». |
| Смешивание стилей | Редко бывает проблемой (все фото похожи). | Если лицо в стиле 2024 года, а покраска в стиле 1990 года — выглядит отвратительно. |
Для новичка начать с фотореализма (модель Juggernaut XL) на самом деле проще. Она почти всегда выдает результат, похожий на фото, и мозг легко обманывается. Начать с аниме (на Pony XL) веселее, но вы быстрее столкнетесь с необходимостью править руки, глаза и учить «заклинания» (теги) для правильного стиля. Зато, когда вы поймете как это делать, результат будет более творческим и уникальным.
«Списать на стиль» можно странную цветовую гамму или фон. Но кривые линии и анатомию в аниме списать на стиль сложнее, чем спрятать их в тенях на фото.
Вот список лучших именно аниме моделей для локальной генерации на ПК на текущий момент, разделенный по архитектурам.
SDXL (Stable Diffusion XL)
На 8 ГБ VRAM модели SDXL дают лучшее соотношение качества и детализации. Родное разрешение — около 1024×1024.
Pony Diffusion V6 XL (и её вариации)

На сегодняшний день это абсолютный король в генерации аниме, фурри, мультяшного арта и любого 18+ контента. Эта модель была обучена с нуля понимать специфические «Booru-теги» (теги с имиджбордов).
Pony V6 — это не просто модель, это уже стандарт. Она «сломала» рынок тем, что выучила миллионы специфических тегов с Danbooru. Пони знает, что такое ахэгао, специфические костюмы, позы и взаимодействия «из коробки». Ей не нужно объяснять анатомию в сценах 18+ — она её вызубрила по умолчанию.
Она невероятно точно следует сложным инструкциям, отлично знает персонажей, позы и фетиши.
Минусы: Имеет специфический «жирный» стиль шейдинга и контуров («Pony Style»), который без использования LoRA или негативных промптов может выглядеть однообразно («пластиково»).
ВАЖНО: Она требует специального стиля промптинга. В начале обязательно нужно писать «скор-теги» для качества:
score_9, score_8_up, score_7_up, score_6_up, [ваши теги тут…]
В негативный промпт обязательно:
score_4, score_5, score_6, source_pony, source_furry, (последние 2 если не нужны пони и фурри)
Без этих тегов модель выдает мусор.
Для 18+: Лучшая анатомия, понимание взаимодействий между персонажами.
Animagine XL 3.1
Главный конкурент Pony в сфере чистого аниме.

Особенности: Создает изображения, больше похожие на скриншоты из современных высокобюджетных аниме. Стиль более «чистый» и кинематографичный, чем у Pony.
Промптинг: Более стандартный, не требует жестких «скор-тегов», но тоже хорошо понимает теги Danbooru.
Для 18+: Хороша, но Pony считается более гибкой для сложных анатомических сцен.
Illustrious XL
Это модель генерации изображений на архитектуре SDXL, которая позиционируется как мощная альтернатива для создания аниме-артов и 2D-иллюстраций. Ее главная цель — предоставить качество и гибкость популярных аниме-моделей (как Pony), но без их специфических ограничений и артефактов.

Тренировалась с нуля на качественном датасете, что дает ей «чистый» стиль без артефактов, свойственных перетренированным моделям. Отлично понимает систему тегов Danbooru (как и Pony), но не требует специфических «триггерных слов» качества (score_99, rating_explicit и т.д.).
На Illustrious XL очень легко тренировать стили и персонажей. LoRA получаются гибкими. Но их количество и разнообразие пока сильно уступают показателям Пони.
Архитектура SD 1.5
Родное разрешение 512×512 (или 512×768 для портретов).
Почему это все еще актуально на 8 ГБ VRAM? Скорость. Модели SD 1.5 будут генерировать за секунды. Плюс под эту базу существуют тысячи LoRA-модификаторов для конкретных персонажей или стилей. Другими словами под нее уже много готовых шаблонов и есть простор для творчества.
RevAnimated (Reverb’s Animated)

Это модель не совсем про чистое аниме, а про 2.5D арт и фэнтези.
Особенности: Лучшая модель для создания игровых артов, концепт-артов, фэнтези-персонажей. У неё очень узнаваемый «объемный», красочный стиль, средний между рисунком и 3D-рендером.
Для 18+: Отлично справляется, создавая очень красивые «рисованные» арты.
Любые «Mix» модели (Anything V5, AbyssOrangeMix3)

Это классические аниме-модели эпохи SD 1.5. Дают более «плоский», традиционный аниме-стиль. Их главное преимущество — они очень легкие и под них сделано 90% существующих LoRA для аниме-персонажей на сайте Civitai.
Сравнение с Flux.1 (и его аниме-версиями)

Flux — это монстр в плане следования инструкциям (prompt adherence).
Главный плюс: Если вы напишете: «Девочка держит яблоко в левой руке, а правой машет, на заднем плане текст ‘HELLO'», Flux нарисует это идеально с первого раза. Pony здесь начнет путаться (рисовать три руки или яблоко в зубах).
Главный минус (Стиль): Базовый Flux тяготеет к реализму или 3D-рендеру. Чтобы заставить его рисовать «чистое 2D аниме», нужно использовать сильные LoRA или специальные чекпоинты (файн-тюны), которые часто ломают его «ум».
- Цензура и Анатомия 18+: Базовый Flux сильно зацензурен. Чтобы получить откровенный контент, нужно использовать Uncensored версии и LoRA. И даже с ними Flux пока хуже понимает специфическую «аниме-физику» тел, чем Pony.
- Скорость на 8 ГБ: Это боль. Даже в сжатом (GGUF Q4/NF4) виде генерация займет 30-60 секунд на кадр. Это убивает процесс творческого поиска («нагенерить 50 вариантов и выбрать лучший»).
Сравнительная таблица
| Характеристика | Pony V6 XL (SDXL) | Flux.1 (Dev/Anime Finetunes) |
| Понимание тегов (Booru tags) | ⭐⭐⭐⭐⭐ (Идеально) | ⭐⭐⭐ (Лучше понимает обычные предложения) |
| Сложные позы (без ControlNet) | ⭐⭐⭐ | ⭐⭐⭐⭐⭐ (Понимает «лево/право», «сверху/снизу») |
| Количество персонажей | ⭐⭐⭐ (Путается без плагинов) | ⭐⭐⭐⭐⭐ (Отлично разделяет даже без плагинов) |
| Наличие LoRA (персонажи) | Огромное количество | Мало, но растет |
| Стиль Аниме | Нативный, красивый 2D | Часто выглядит как «3D модель» или «пластик» |
| Нагрузка на 8 ГБ VRAM | Легкая (можно делать Batch size 4) | Тяжелая (по одной картинке, греет карту) |
Стоит остаться на Pony XL, если:
- Вы хотите генерировать много картинок быстро.
- Вам важны специфические фетиши, костюмы или редкие аниме-персонажи (под них есть LoRA).
- Вы любите «рисованный» стиль, а не стиль 3D-игры.
Вам стоит попробовать Flux 1 на 8 ГБ (версии GGUF/NF4), если:
- Вы хотите создать сложную композицию (например, «Персонаж А сидит на плечах у Персонажа Б и читает газету»). Pony такое не сможет, Flux сможет.
- Вам нужно добавить в картинку читаемый текст.
- Вы готовы ждать по минуте ради одной картинки с идеальными пальцами (у Flux пальцы получаются лучше).
Недавно вышел Flux 2, который стал во многом лучше, но при этом в 3 раза медленнее, чем Flux 1.
Для наших задач (аниме, генерация персонажей) переход на Flux 2 на 8 ГБ видеокарте сейчас выглядит как даунгрейд по удобству. Вы потеряете возможность быстрой генерации («гача-стайл»).Качество в режиме Q2 (сильное сжатие) будет даже хуже, чем у полноценной Pony XL.
Общая сравнительная таблица
| Модель | База | Лучшее применение | Качество 18+/Анатомии | Сложность промптинга | Скорость на 8GB |
| Pony Diffusion V6 | SDXL | Аниме, Фурри, Арты, Сложный NSFW | ⭐⭐⭐⭐⭐ (Лучшая) | Высокая (нужны спец. теги) | Средняя |
| Animagine XL 3.1 | SDXL | Современное аниме (скриншоты) | ⭐⭐⭐⭐ | Средняя (понимает теги) | Средняя |
| RevAnimated | SD 1.5 | 2.5D арт, Фэнтези, Игровая графика | ⭐⭐⭐⭐ | Низкая | Высокая ⚡ |
| Flux.1 (Dev/Schnell) | Flux | Только с NSFW LoRA. Сам по себе цензурирован. | ⭐⭐⭐ (Пока что) | Низкая (естественный язык) | Низкая |
| Illustrious |
SDXL | Аниме, NSFW, чистый стиль и создание ЛОР | ⭐⭐⭐⭐ | Средняя (понимает теги) | Средняя |
Где брать и как использовать
Все эти модели скачиваются с сайта Civitai.com. Там нужно зарегистрироваться и в настройках профиля включить отображение контента «Adult» или «XXX», иначе вы не увидите 18+ модели. Как все это сделать в первый раз, я описал в отдельном гайде по сайту Civit Ai.
Если совсем новичок для 8 ГБ VRAM используйте WebUI Forge (гайды для новичков написаны именно на нем), если готовы потратить пару дней на освоение интерфейса перед работой — ComfyUI.
Гайд как в первый раз скачать, установить и запустить WebUI Forge, не взорвав свой компуктер.
Секрет красивых аниме артов — LoRA и Embeddings. Сами модели — это только база. Для конкретного персонажа (например, «2B из Nier Automata») или конкретной позы или действия вам нужно скачать LoRA файл с Civitai и подключить его к модели.
Для исправления рук и анатомии в SD 1.5 используйте «Negative Embeddings» (например, EasyNegative или bad-hands-5), вставляя их в негативный промпт. SDXL (Pony) обычно справляется без них, если промпт составлен верно.
Если вы только начинаете свой тернистый путь ИИ генерации изображений на дому, дальше обязательно почитайте:







