Магии нет — есть описание
Генераторы изображений (Midjourney, DALL·E, Stable Diffusion и другие) обучены на миллионах пар «картинка + подпись». Вы даёте текст — модель собирает наиболее подходящее изображение.
Ключевая мысль: модель рисует то, что вы описали словами, а не то, что вы представили в голове. Чем точнее описание — тем ближе результат.
Что важно понять сразу
- Результат вероятностный. Один и тот же промпт даёт разные картинки — это норма.
- Детали решают. «Кот» и «рыжий кот у окна в тёплом свете заката» — небо и земля.
- Итерации неизбежны. Первая картинка — черновик, дальше вы уточняете.
Три типичных ожидания новичка
- «Она поймёт меня с полуслова». Нет — опишите явно, иначе получите усреднённый вариант.
- «Первая же картинка будет идеальной». Обычно нет: закладывайте 3–5 попыток.
- «Достаточно назвать объект». Объект — лишь один из четырёх слоёв (следующий урок).
Упражнение
Сгенерируйте картинку по слову «кофе», затем по фразе «чашка эспрессо на деревянном столе, утренний свет из окна, крупный план». Сравните — вы сразу почувствуете, что решают детали.
В этом курсе вы научитесь описывать образ так, чтобы получать нужное за несколько попыток, а не ловить удачу.
🧠 Почему один промпт даёт разные картинки?