
Все мы любим генерировать картинки с помощью нейросетей – бесплатно и быстро. Мне они нужны для презентаций семинаров, блога и соцсетей, кто-то использует их в рекламных материалах, а кто-то просто так развлекается – благо что нейросеток, для онлайн-генерации хоть отбавляй.
Вот только когда вы пытаетесь сгенерировать нечто отличное от пушистых котиков, сразу же начинаются проблемы.
Одна нейросеть напрочь отказывается генерировать любую обнажённую натуру с реалистичной анатомией, считая, что в этом обязательно есть сексуальный подтекст.
Другая – не хочет рисовать известных людей, включая персонажей анимационных и художественных фильмов.

У третьей – запрет на товары и логотипы известных брендов.
Четвертая (и это самое фантастическое!) – не желает визуализировать любые ситуации, выставляющие привилегированные с её точки зрения группы (мигрантов, ЛГБТ) в неблаговидном свете.

С последним я реально столкнулся, когда эксперимента ради попробовал сгенерировать иллюстрацию для статьи «Белая либеральная женщина» с помощью ChatGPT.
Я ввёл вполне безобидный с точки зрения любого законодательства промпт:
Нарисуй картинку. Белая либеральная женщина нежно прижимает руками к груди голову чернокожего беженца, воздев глаза к небу. Крупный план. На заднем плане вне фокуса – руины западной цивилизации и заходящее солнце. Золотой час. 16:9
На что получил ответ:
Нам очень жаль, но ваш запрос может нарушать наши правила использования контента. Если вы считаете, что произошла ошибка, попробуйте еще раз или отредактируйте свой запрос.
На все попытки выяснить в лоб, в чём же конкретно проблема с этим промптом, ответ был ровно тем же. Понятно, что приложив усилия, можно до какой-то степени обойти guardrails модели, но стоит ли игра свеч?

Лучшая с точки зрения минимальной цензуры и максимального качества генерации бесплатная онлайн-модель это Grok от Илона Маска. Но, во-первых, у неё есть лимиты, и, во-вторых, она всё же уступает локальным бесплатным моделям, поэтому я предпочитаю генерировать все иллюстрации локально, на моём макбуке.
До недавних пор я пользовался моделью Z-image turbo и был счастлив, но примерно месяц назад вышла модель Krea 2 turbo, ставшая моим новым фаворитом.
Это одна из самых быстрых и качественных моделей на рынке, разработанная в компании Krea AI командой во главе с Диего Родригесом с чистого листа.
Под капотом модели 12-миллиардный плотный DiT-бэкбон (Diffusion Transformer) и текстовый энкодер Qwen3-VL – добротная, надёжная связка.

Модель занимает 2-е место среди моделей от независимых лабораторий и входит в топ-10 мирового рейтинга text-to-image моделей по версии Artificial Analysis, а по моему мнению – это сейчас безальтернативно лучший вариант для того, кого по каким-то причинам не устраивает цензура.
Для того, чтобы раскрыть весь потенциал модели, нужно установить две LoRa (Low-Rank Adaptation – дополнительные модули для диффузионных нейросетей), и после этого вы сможете на свой страх и риск генерировать всё, что способно представить себе ваше воображение, включая вещи, распространение которых строго запрещено законодательством и порицается обществом:
- Krea2_TextFusion_Refusal_Reduction.safetensors – снижение отказного поведения модели
- Krea-2-unlocked.safetensors – обход ограничений модели NSFW-контента
По сравнению с моей предыдущей любимицей Z-image Krea 2:
- ещё лучше работает с анатомией – ставшие «визитной карточкой» нейросетей ошибки с количеством пальцев или даже конечностей теперь встречаются крайне редко даже без дополнительных требований в промпте;
- гораздо лучше понимает промпты на русском языке, не требуя их обязательного перевода на английский;
- отлично справляется со сложными позами, на которых z-image пасовала;
- заметно лучше, хоть и не идеально, рисует тексты на русском языке, а с английским справляется и вовсе без проблем;
- намного точнее рисует историческое оружие и доспехи (для меня это важно);
- лучше рисует стилизованные изображения, а не только фотореализм.
Да, генерация теперь занимает чуть больше времени (на моём макбук M1 16Гб картинка 1024х640 генерируется около 5 минут), но оно того стоит, поэтому очень рекомендую всем эту нейросеть.

Я сам генерирую картинки довольно сложно организованным образом: я даю краткую концепцию изображения своему Hermes agent на модели Minimax M3, он её анализирует и пишет детализированный промпт, оптимизированный для каждой конкретной генеративной сети, которую я использую. После этого он отправляет готовый промпт с заданными параметрами генерации на MCP сервер, который я навайбкодил для управления очередью генерации, а MCP обращается к локальному gRPC серверу, который уже непосредственно оперирует генеративной моделью.
Могу себе это позволить – всё-таки я учу людей использовать всю мощь AI, плюс мне это нужно, чтобы создавать по несколько десятков картинок для презентаций за раз и не тратить на это время.
Вам так заморачиваться не обязательно, для MacOS есть прекрасное приложение DrawThings, а для Windows — ComfyUI, в которых можно локально генерировать изображения почти так же просто, как в онлайн-сервисах.
Как вы уже понимаете, все картинки в этой статье были сгенерированы через Krea 2, так что сами можете судить о её возможностях.
Друзья, подписывайтесь на мой Твиттер (там я пишу чаще) и Телеграм, чтобы получать анонсы новых материалов.







Комментариев: 0