Как сделать с помощью нейросети иллюстрацию по своему описанию?
Марина, Казань 422 просм.
Веду небольшой блог и не умею рисовать вообще, а иллюстрации к постам нужны постоянно. Видела, что нейросети рисуют картинки по текстовому описанию. Как это работает на практике и что нужно, чтобы получить приличный результат, а не первую попавшуюся ерунду?
Дмитрий Волков инженер по машинному обучению
ответил
Генератор изображений по тексту вроде Midjourney, Kandinsky, DALL-E или Stable Diffusion работает так: вы описываете картинку словами — объект, стиль, освещение, ракурс, а модель на основе этого описания собирает изображение из шума, постепенно уточняя его за несколько десятков шагов. Результат сильно зависит от качества описания, поэтому основная работа идёт в тексте запроса, а не в технических настройках.
Рабочий порядок для блога такой:
- сначала опишите главный объект и действие простыми словами: кто или что на картинке и что происходит;
- добавьте стиль — плоская иллюстрация, акварель, фотореализм, флэт-дизайн;
- уточните цвета и композицию, если для блога важна единая палитра;
- сгенерируйте несколько вариантов подряд и выбирайте лучший, а не первый.
Приличный результат редко получается с первого запроса, обычно нужно три-пять попыток с небольшими правками формулировки. Помогает и референс: некоторые сервисы позволяют загрузить картинку-образец и объяснить, в каком стиле сделать новую.
Для регулярного блога удобнее закрепить один и тот же стилевой промпт-хвост — набор слов про стиль и палитру, который добавляете к каждому описанию. Тогда иллюстрации получаются похожими друг на друга и блог выглядит цельно, а не как набор картинок из разных источников.
Задать свой вопрос
Вопросы проходят модерацию. Ответ эксперта публикуется на сайте в течение пары дней.
Вопрос отправлен на модерацию. После проверки он появится на сайте вместе с ответом эксперта.