Нейросети

Как сделать с помощью нейросети иллюстрацию по своему описанию?

Марина, Казань 423 просм.

Веду небольшой блог и не умею рисовать вообще, а иллюстрации к постам нужны постоянно. Видела, что нейросети рисуют картинки по текстовому описанию. Как это работает на практике и что нужно, чтобы получить приличный результат, а не первую попавшуюся ерунду?

Дмитрий Волков инженер по машинному обучению

ответил

эксперт

Генератор изображений по тексту вроде Midjourney, Kandinsky, DALL-E или Stable Diffusion работает так: вы описываете картинку словами — объект, стиль, освещение, ракурс, а модель на основе этого описания собирает изображение из шума, постепенно уточняя его за несколько десятков шагов. Результат сильно зависит от качества описания, поэтому основная работа идёт в тексте запроса, а не в технических настройках.

Рабочий порядок для блога такой:

  • сначала опишите главный объект и действие простыми словами: кто или что на картинке и что происходит;
  • добавьте стиль — плоская иллюстрация, акварель, фотореализм, флэт-дизайн;
  • уточните цвета и композицию, если для блога важна единая палитра;
  • сгенерируйте несколько вариантов подряд и выбирайте лучший, а не первый.

Приличный результат редко получается с первого запроса, обычно нужно три-пять попыток с небольшими правками формулировки. Помогает и референс: некоторые сервисы позволяют загрузить картинку-образец и объяснить, в каком стиле сделать новую.

Для регулярного блога удобнее закрепить один и тот же стилевой промпт-хвост — набор слов про стиль и палитру, который добавляете к каждому описанию. Тогда иллюстрации получаются похожими друг на друга и блог выглядит цельно, а не как набор картинок из разных источников.

Задать свой вопрос

Вопросы проходят модерацию. Ответ эксперта публикуется на сайте в течение пары дней.

Похожие вопросы

Все в теме