Курс Неделя 1 День 4
← День 3 День 5 →

День 4. Генерация картинок

Время: 90 минут 🎯 Цель: Создавать фото и баннеры для маркетплейса без дизайнера 🛠 Нужно: Ideogram (ideogram.ai, бесплатно) · DALL-E в ChatGPT · Gemini Imagen (Google Gemini Advanced)


Зачем это тебе

Катя работает менеджером на Wildberries — ведёт карточки товаров для небольшого поставщика, который продаёт органайзеры для дома. Когда поставщик запускал новую линейку, нужно было сделать восемь главных фото: товар на белом фоне, lifestyle-съёмка в интерьере, баннер для акции и несколько вариантов для A/B теста. Фотограф брал 15 000 рублей за день, дизайнер — ещё 5 000 за обработку. Итого 20 тысяч и неделя ожидания.

Катя отдала деньги, подождала неделю, получила фото. Из восьми штук три не подошли — фотограф неправильно понял референс. Переснимать стоило ещё денег, переделывать — ещё времени. Карточки запустились с задержкой, пропустили пиковый период.

После того как Катя освоила генерацию картинок, та же задача заняла три часа и ноль рублей. Она описала товар словами, получила двадцать вариантов фото в разных стилях, выбрала лучшие и загрузила прямо в карточку. Поставщик попросил поменять фон с белого на серый — Катя переписала один промпт и получила новый вариант за 30 секунд.

После сегодняшнего урока ты сможешь делать то же самое: фото товара на белом фоне, lifestyle-фото в интерьере или на улице, баннер с текстом для акции — всё это без дизайнера, без фотографа и без бюджета.


Теория

Как картинки «вырастают» из шума

Когда ты просишь ИИ нарисовать фото товара, внутри происходит примерно следующее. Представь, что берёшь лист бумаги и равномерно покрываешь его случайными точками — серый шум, как телевизор без сигнала. Теперь представь, что кто-то очень медленно протирает этот лист тряпочкой по специальной схеме, и под шумом проступает картинка. Именно так работает диффузия — технология, на которой построены все современные генераторы изображений.

Модель обучалась на сотнях миллионов фотографий с подписями. Она выучила: если в описании есть «белый фон», «студийный свет», «продуктовое фото» — картинка должна выглядеть вот так. Когда ты пишешь промпт, модель начинает с чистого шума и постепенно «вычищает» его в направлении твоего описания. Обычно это 20–50 шагов за несколько секунд.

Поэтому главное правило: чем точнее ты описываешь — тем точнее результат. Это не волшебная кнопка «сделай красиво» — это инструмент, который буквально переводит твои слова в пиксели.

Три инструмента — три характера

Ideogram — лучший выбор для маркетплейса по одной причине: он умеет рисовать текст на картинке. Большинство генераторов с текстом не справляются — пишут кракозябры. Ideogram решил эту проблему. Бесплатный тариф даёт несколько генераций в день, этого хватает для обучения и небольших задач. Работает прямо в браузере, регистрация через Google.

DALL-E в ChatGPT — встроен в ваш аккаунт ChatGPT, отдельно платить не нужно. Удобен тем, что можно вести диалог: «сделай фон темнее», «добавь тени», «убери лишний элемент слева» — и модель переделывает. Качество хорошее, особенно на lifestyle-фото. Минус — лимит генераций в сутки.

Gemini Imagen — генератор Google, доступен в Gemini Advanced. Сильная сторона — фотореалистичность и детализация. Хорошо справляется с людьми, интерьерами, природой. Доступен через вкладку в Gemini или прямо из диалога с просьбой «сгенерируй изображение».

Промпт для картинки — это не текст

Когда ты пишешь ChatGPT «напиши письмо», ты описываешь задачу. Когда просишь нарисовать — ты описываешь итоговую картинку. Это другой навык.

Хороший промпт для изображения состоит из четырёх блоков:

1. Объект. Что именно изображено. «Органайзер для канцелярии из белого пластика, три секции, крышка с петлями».

2. Контекст и фон. Где это находится. «На белом бесшовном фоне», «на деревянном столе в светлом офисе», «на кухонной столешнице рядом с кофемашиной».

3. Стиль и свет. Как это снято и обработано. Три главных стиля для маркетплейса:

  • photorealistic, studio lighting — чёткое фото как из каталога
  • lifestyle photo, natural light, warm tones — живое фото «из жизни»
  • 3D render, clean, minimalist — компьютерная графика, как у Apple

4. Технические параметры. high resolution, sharp focus, e-commerce style, no watermark, no text.

Ключевые слова, которые работают: photorealistic (фотореалистично), studio lighting (студийный свет), white background (белый фон), product photo (фото товара), high resolution (высокое разрешение), sharp focus (резкость), e-commerce (стиль маркетплейса).

Почему одно слово меняет всё

Попробуй мысленно сравнить два промпта:

  • «Фото органайзера»
  • «Product photo of white plastic desk organizer, three compartments, on white seamless background, professional studio lighting, sharp focus, high resolution, e-commerce style»

Второй промпт займёт у тебя 20 секунд написать — и даст результат, который можно сразу загружать в карточку. Первый даст что-то случайное.


Демо: смотрим как работает

Шаг 1. Ideogram — фото товара на белом фоне

Открываем ideogram.ai в браузере. Нажимаем «Sign in» и входим через Google — никаких форм заполнять не нужно.

На главной странице — поле для промпта. Под ним — выбор соотношения сторон (1:1 для карточки товара, 16:9 для баннера). Вводим:

Product photo of a white ceramic coffee mug with minimalist geometric pattern, 
placed on white seamless background, professional studio lighting from above, 
sharp focus, high resolution, e-commerce style, no shadows

Нажимаем Generate. Через 10–15 секунд получаем четыре варианта. Смотрим что получилось — обычно минимум два из четырёх пригодны к использованию.

Теперь проверяем фишку с текстом. Пишем:

Sale banner for online store, bold text "СКИДКА 30%" in red, 
minimalist white background, product photo of home organizer on the side, 
professional layout, e-commerce banner style, 1200x628px proportions

Ideogram пишет текст корректно — это его главное преимущество перед другими.

Шаг 2. DALL-E в ChatGPT — тот же товар, сравниваем

Открываем ChatGPT. В диалоге пишем:

Нарисуй product photo: белая керамическая кружка с минималистичным геометрическим 
орнаментом, белый бесшовный фон, профессиональный студийный свет сверху, 
резкость, высокое разрешение, стиль фото для маркетплейса, без теней

Можно писать по-русски — DALL-E понимает. Получаем результат. Сравниваем с Ideogram: обычно DALL-E даёт чуть более «живую» текстуру, Ideogram — более чистый, «каталожный» вид.

Теперь пробуем диалоговую правку. Пишем следующим сообщением:

Сделай тень чуть заметней, добавь отражение на поверхности, фон оставь белым

DALL-E переделывает с учётом правки. Это его главное преимущество — не нужно переписывать промпт с нуля.

Шаг 3. Gemini Imagen — lifestyle-фото

Открываем gemini.google.com. В диалоге пишем:

Generate an image: lifestyle photo of white ceramic mug on a wooden desk 
in a bright modern home office, morning light from the window, 
green plant in the background blurred, cozy atmosphere, 
photorealistic, warm tones, high resolution

Gemini хорошо справляется с интерьером и атмосферой. Результат выглядит как будто снятый на хорошую камеру в реальном пространстве.

Разбор: что влияет на стиль

Ключевое слово Результат
photorealistic Фото из каталога
illustration, flat design Плоская иллюстрация
3D render Компьютерная графика
watercolor Акварельная картинка
minimalist Чисто, без деталей
cinematic Как кадр из фильма

Практика

Задание 1. Три стиля одного баннера в Ideogram

Возьми любой товар из своей реальной работы. Сгенерируй три баннера с одинаковым содержанием, но разными стилями. Используй этот шаблон — меняй только последнюю строку:

Banner for marketplace, [название товара и его описание], 
prominent product in center, clean composition, 
e-commerce style, high quality

Стиль 1: photorealistic, studio lighting, white background
Стиль 2: flat illustration, pastel colors, minimalist
Стиль 3: 3D render, premium look, dark background with soft glow

Сохрани три результата и посмотри — какой стиль лучше работает для твоего товара.

Задание 2. Lifestyle-фото в DALL-E

Создай фото товара «в жизни» — не на белом фоне, а в контексте использования. Шаблон:

Lifestyle photo of [товар], [где используется и кем], 
natural light, realistic scene, people in background blurred, 
warm and inviting atmosphere, high resolution, photorealistic

Например: «Lifestyle photo of a desk organizer on a work-from-home setup, young woman working in background, morning light, plants nearby, cozy home office atmosphere».

После генерации попробуй написать правку одним предложением — например, «сделай свет теплее» или «убери человека на фоне». Посмотри как DALL-E реагирует на итерации.

Задание 3. Сравнение одного промпта в двух инструментах

Возьми один промпт и запусти его и в Ideogram, и в DALL-E без изменений. Положи результаты рядом и зафикисруй разницу письменно: что лучше у одного, что у другого. Это твой личный ориентир — к каком инструменту идти с какой задачей.

Product photo of [твой товар], placed on white seamless background, 
professional studio lighting, sharp focus, high resolution, 
e-commerce style, no shadows, no text

Задание 4. Баннер с текстом в Ideogram

Создай акционный баннер с читаемым русским текстом. Ideogram справляется лучше остальных:

E-commerce sale banner, bold text "[твой текст акции]" in [цвет], 
[товар] product image on [сторона] side, clean professional layout, 
white or light background, high contrast, banner proportions 1200x628

Проверь — прочитывается ли текст, нет ли ошибок в буквах. Если есть — перегенерируй, обычно со второй попытки выходит чище.


Самостоятельная работа

Выбери один реальный товар, который ты сейчас ведёшь или вёл недавно.

Создай три варианта главного фото для его карточки:

  1. Классическое фото на белом фоне (studio product photo)
  2. Lifestyle-фото в контексте использования
  3. Фото с минималистичным небелым фоном (серый, светло-бежевый, мраморная текстура)

Каждый вариант — в том инструменте, который, по-твоему, подходит лучше всего.

Выбери один лучший из трёх и напиши 3–5 предложений: почему именно этот? Что в нём работает — свет, фон, угол, ощущение? Как он соотносится с тем, что обычно стоит в топе по твоей категории?

Это и есть навык — не просто сгенерировать, а понять почему одно работает, а другое нет.


Чек-лист урока

  • [ ] Понял как работает диффузия: картинка «вырастает» из шума по описанию
  • [ ] Зарегистрировался в Ideogram и сгенерировал первую картинку
  • [ ] Попробовал DALL-E в ChatGPT и понял как работают итерационные правки
  • [ ] Попробовал Gemini Imagen на lifestyle-фото
  • [ ] Сгенерировал баннер с текстом в Ideogram и проверил читаемость
  • [ ] Сравнил один промпт в двух инструментах и зафиксировал разницу
  • [ ] Создал три варианта главного фото для реального товара
  • [ ] Выбрал лучший вариант и объяснил почему