
Полная версия
Создавай визуал с ИИ быстрее. Меньше запросов, меньше рутины, больше результата

Дарья Гулдасташоева
Создавай визуал с ИИ быстрее. Меньше запросов, меньше рутины, больше результата
© Гулдасташоева Д. С., текст, иллюстрации, 2026
© ООО «Издательство «Эксмо», 2026
Изображения и персонажи в этой книге созданы с помощью нейросетей и технологий искусственного интеллекта. Все лица, персонажи и сцены являются вымышленными и созданы исключительно в учебных и иллюстративных целях. Любые совпадения с реальными людьми случайны.
Как ориентироваться в книге
В книге вы встретите полезные вставки, которые помогут быстрее разобраться и сразу применить знания на практике.

Короткое объяснение темы или важное уточнение, которое помогает лучше понять материал.

Запрос, который можно сразу использовать в работе с ИИ.

Примеры текстов, изображений или диалогов с ИИ.

На что обратить внимание и чего лучше избегать.
О чем эта книга
Еще несколько лет назад генерация изображений с помощью нейросетей казалась странным экспериментом для энтузиастов. Картинки получались неровными, с лишними пальцами, «плывущими» лицами и случайными артефактами. Но технологии развивались очень быстро, и сегодня ИИ уже стал обычным рабочим инструментом для дизайнеров, иллюстраторов, маркетологов, видеомонтажеров и авторов цифрового контента.
При этом вокруг нейросетей до сих пор остается много крайностей. Одни воспринимают ИИ как «волшебную кнопку», которая сама сделает красивую картинку за секунду. Другие – как угрозу для художников и творческих профессий. На практике все намного спокойнее и интереснее.
Эта книга – не про замену художника нейросетью и не про «секретные промпты», которые якобы гарантируют идеальный результат. Она о том, как современные генераторы изображений реально используют в повседневной работе, учебе и творчестве: для поиска идей, создания иллюстраций, восстановления фотографий, подготовки дизайна, концептов и визуальных материалов.
Здесь не будет сложного технического языка, программирования или попыток превратить вас в «промпт-инженера». Вместо этого мы разберем:
• как устроены современные генераторы изображений;
• как писать понятные и рабочие промпты;
• как использовать Inpainting, ControlNet, Upscale и другие инструменты;
• как совмещать ИИ с Photoshop, Photopea, Pixlr и графическими редакторами;
• как художники, дизайнеры и авторы уже работают с нейросетями на практике;
• какие ошибки чаще всего допускают новички;
• где возникают вопросы авторства, лицензий и использования ИИ-контента.
Отдельно мы поговорим о гибридном подходе, где нейросеть не заменяет ручную работу, а помогает ускорить рутину и освободить время для поиска идеи, композиции и визуального решения.
В конце книги вас ждет большой справочник промптов для разных задач: от книжной иллюстрации и концепт-арта до интерфейсов, персонажей, текстур и стилизации изображений.
Эта книга не требует художественного образования или опыта работы с ИИ. Она рассчитана и на тех, кто только начинает знакомство с генерацией изображений, и на людей, которые уже используют нейросети в работе и хотят лучше понимать их возможности и ограничения.
Приятного чтения!Часть 1. ИИ и современное творчество
Глава 1. Как ИИ изменил визуальное творчество
1.1. История ИИ для генерации картинок
Еще десять лет назад идея о том, что компьютер сможет нарисовать шедевр по одному лишь текстовому описанию, казалась сюжетом для научной фантастики. Художники тратили годы на изучение академического рисунка, перспективы и колористики, в то время как машины умели лишь накладывать примитивные фильтры на готовые фотографии. Но революция произошла быстрее, чем кто-либо ожидал, и сейчас искусственный интеллект стал таким же привычным инструментом в арсенале творца, как графический планшет или палитра.
История генеративного арта началась не с идеальных портретов, а с цифрового хаоса. В середине 2010-х годов появились GAN (генеративно-состязательные нейросети). Они пытались создавать лица людей или пейзажи, но результаты напоминали жутковатые сюрреалистичные сны: расплывчатые текстуры, асимметричные глаза и полная абстракция вместо деталей.
Настоящий тектонический сдвиг произошел в 2022 году, когда на сцену вышли диффузионные модели. Они научились собирать изображение буквально из визуального шума, шаг за шагом прорисовывая детали на основе текстового запроса (промпта). Именно тогда появились сервисы, которые сделали генерацию изображений массовой.
Пожалуй, самым громким именем в истории ИИ-арта стал Midjourney. Запущенная независимой исследовательской лабораторией под руководством Дэвида Хольца, эта нейросеть изначально позиционировалась как инструмент для «расширения воображения человечества».
Если вспомнить ранние версии, Midjourney славилась своей живописностью, глубокой атмосферой, но совершенно не справлялась с анатомией и логикой. Знаменитый мем про «шесть пальцев на руках» был визитной карточкой ИИ того времени. Когда Midjourney только появилась, художники разделились на два лагеря. Первые в ужасе кричали, что это конец профессии. Вторые по ночам сидели в сообществах и чатах, генерировали чудовищ и смеялись до упаду. Потому что выдать «девушку в стиле ар-нуво» нейросеть еще как-то могла, но стоило попросить ее нарисовать чашку кофе в руке у этого персонажа – она сдавалась. Палец, растущий из середины кружки, вторая рука, скрученная в узел, и фон, который внезапно превращался в расплавленный сыр. Это был не арт. Это был сюрреалистический цирк уродцев (рис. 1.1). Но художники, как завороженные, продолжали стучать по клавишам, потому что чувствовали: что-то здесь есть. Проблеск. Огромная база изображений внутри машины уже работала, оставалось лишь научиться правильно доносить запрос.


Рис. 1.1. «Творение» ИИ в начале развития
Чтобы увидеть эту разницу своими глазами, вы можете использовать следующий классический промпт, который раньше ставил нейросети в тупик из-за обилия мелких деталей и взаимодействия рук с предметами:

Промпт (Eng): A hyper-realistic portrait of a young female watchmaker carefully examining a tiny glowing gear while holding precision tweezers close to her eye. Cinematic lighting, dramatic shadows, highly detailed hands, realistic skin texture, shallow depth of field, luxury watch workshop atmosphere, intricate mechanical elements, brass and steel details, warm lamp light, atmospheric dust particles – ar 16:9[1].
Перевод (Rus): Гиперреалистичный портрет молодой девушки-часовщика, внимательно рассматривающей маленькую светящуюся шестеренку и держащей точный пинцет рядом с глазом. Кинематографичное освещение, драматичные тени, высокодетализированные руки, реалистичная текстура кожи, малая глубина резкости, атмосфера дорогой часовой мастерской, сложные механические элементы, детали из латуни и стали, теплый свет лампы и частицы пыли в воздухе. Формат изображения 16:9.
К версиям v5 и v6 (2023–2024 годы) алгоритм освоил фотореализм и начал понимать сложные композиции. На сегодняшний день актуальные версии Midjourney не просто рисуют картинку – они понимают контекст освещения, физику материалов и позволяют художникам фиксировать персонажей для создания целых комиксов с идеальным сохранением стиля (рис. 1.2).


Рис. 1.2. Вот так теперь нейросеть справляется со сложным запросом
1.2. Что за зверь DALL·E
Параллельно развивалась технология от компании OpenAI – DALL·E. Если Midjourney тяготел к художественности и требовал набора «магических» слов-тегов в промпте (вроде masterpiece, unreal engine 5), то DALL·E сделал ставку на точное следование запросу и логику прямого диалога.
Настоящий прорыв случился с выходом DALL·E 3 и его интеграцией в ChatGPT. Пользователям больше не нужно было писать сложные технические коды. Достаточно было просто попросить ИИ на обычном, понятном языке, причем даже на русском! Нейросеть стала понимать ироничные, сюрреалистичные и очень точные концепты.
Это звучит парадоксально, но именно главное преимущество DALL·E 3 – его понятность – становится главной головной болью для художника. Midjourney хотя бы честно говорит: «Я интерпретирую твои теги как художник-абстракционист». DALL·E же создает иллюзию полного послушания. Вы пишете «пушистый рыжий кот в скафандре» – и он рисует какого-то кота. Но попробуйте указать ему конкретную породу кота, нужный вам угол обзора (ракурс «сверху сзади»), определенную фактуру кисти или, самое главное, сохранить сквозной стиль персонажа на трех разных иллюстрациях. Вот тут DALL·E начнет «забывать» договоренности. Он не поддерживает точный контроль через дообучение (тренинг на ваших эскизах), не умеет работать с seed-ом, как Stable Diffusion, и часто игнорирует отрицательные промпты (например, «не делай фон черным»), если они противоречат его «внутреннему пониманию» красоты. Поэтому для профессионала DALL·E – это гениальный набросочник и прототипировщик идей, но не замена пайплайну[2], где нужна серийная персонажка.

Промпт (Eng): A cozy living room featuring a large armchair shaped like a sliced ripe avocado in the center of the scene. Sitting in the chair is a fluffy orange cat wearing a vintage retro-futuristic space suit while reading a newspaper with a simple readable headline saying “МАРС НАШ”. Warm ambient lighting, retro-futurism aesthetic, soft atmospheric color palette, detailed interior elements, playful surreal mood, and highly detailed illustration style.
Конец ознакомительного фрагмента.
Текст предоставлен ООО «Литрес».
Прочитайте эту книгу целиком, купив полную легальную версию на Литрес.
Безопасно оплатить книгу можно банковской картой Visa, MasterCard, Maestro, со счета мобильного телефона, с платежного терминала, в салоне МТС или Связной, через PayPal, WebMoney, Яндекс.Деньги, QIWI Кошелек, бонусными картами или другим удобным Вам способом.
Примечания
1
Параметр – ar (aspect ratio – соотношение сторон) в Midjourney задает соотношение сторон изображения. Например: – ar 1:1 – квадратный формат; – ar 16:9 – широкий кинематографичный кадр; – ar 9:16 – вертикальный формат для смартфонов и сторис; – ar 4:5 – формат постера или публикации в социальных сетях.
2
Пайплайн – это последовательность шагов, через которые проходит работа от идеи до готового результата. Проще говоря, это ваш «рабочий маршрут». Придумали идею, сделали набросок, сгенерировали варианты в ИИ, выбрали лучший и доработали вручную.


