Генерация картинок в нейросетях: с чего начать

Привет! У нас вышло уже немало гайдов, посвящённых генерации картинок. В этой статье мы расположили их в порядке, удобном для изучения. Начинаем с более простых вещей, дальше уходим в частные случаи.

Какой сервис выбрать и как зарегистрироваться

Самое главное в начале — выбрать нейросеть, зарегистрироваться в ней и оплатить подписку.

Сейчас есть 3 лучших нейросети для работы с картинками:

  • DALL-E;
  • FLUX;
  • Midjourney.

Новичку проще всего будет начать с DALL-E, потому что он понимает запросы на русском языке и неплохо обрабатывает даже неструктированные промпты. Чтобы протестировать DALL-E, придется зарегистрироваться в ChatGPT и оплатить подписку. Как это сделать — рассказывали в отдельном гайде:

Когда зарегистрируетесь и оплатите подписку, сможете пользоваться DALL-E:

  • создавать картинки по текстовому описанию;
  • редактировать генерации во встроенном редакторе.

Когда использовать DALL-E. Когда хотите быстро создать картинку и вам не нужно что-то реалистичное. Лучше всего использовать DALL-E Для генерации логотипов, раскрасок, графики или надписей на английском.

DALL-E не генерирует реальных людей и персонажей из-за авторских прав. Вы не сможете создать портреты Илона Маска или Бэтмена в этой нейросети.

Еще нейросеть не генерирует изображения в стилях известных режиссеров, авторов, дизайнеров и художников, если авторские права на их работы не истекли (70 лет после смерти автора). Например, в стиле Ван Гога вы сможете создать изображение, а вот в стиле Энди Уорхола — нет.

Следующая нейронка — FLUX. Она генерирует фотореалистичные картинки и отлично чувствует промпты. Фишка в том, что у FLUX есть 3 разные модели, которые пригодятся для генерации разных картинок. Работает и стоит каждая модель по-разному:

  • FLUX.1.1 pro — самая производительная версия, лучше всех понимает промпты и генерит отличные картинки на любые темы. Генерация 1 картинки стоит $0,05.
  • FLUX.1 dev — еще одна модель нейросети. Работает также как и pro, только рассчитана на некоммерческое использование. Генерация 1 картинки стоит $0,03.
  • FLUX.1 schnell — самая быстрая модель, которая генерирует картинки в более плохом качестве, чем предыдущие. Подойдет для создания логотипов, иконок с надписями. Генерация 1 картинки стоит $0,003.

Минус FLUX в том, что у нее нет веб-интерфейса. Вам придется запускать что-то вроде сервера на сторонних сайтах. Поэтому пользоваться ей не так удобно.

Когда использовать FLUX. Подойдет для любых целей: создания логотипов, иконок, реалистичных фото, портретов конкретных людей и т. д.

Подробнее о том, где найти FLUX и как с ней работать, читайте в этом гайде:

В гайде про FLUX мы несколько раз упоминаем платформу HuggingFace. На ней вы бесплатно можете запускать разные модели нейросетей и использовать их в работе. Как пользоваться платформой, читайте в отдельном гайде:

И последняя нейронка — Midjourney. У нее есть полезные функции, которые позволяют рисовать качественные картинки:

  • инструменты для тонкой настройки промпта;
  • функции для копирования стилей чужих работ;
  • функции для копирования персонажей;
  • инструменты для редактирования готовых фото.

Когда использовать Midjourney. Подойдет для любых целей: создания логотипов, иконок, реалистичных фото, генерации конкретных людей и т. д. Если часто работаете с фото — это один из лучших вариантов.

В Midjourney можно работать 2 способами: через Discord и веб-версию. Функции в интерфейсах не отличаются, но есть разница в самом интерфейсе. Чтобы разобраться во всем, читайте 2 подробных гайда:

Когда зарегистрируетесь в любом из сервисов, останется еще один важный этап — оплатить подписку. Сделать картами РФ и РБ это нельзя. Придется искать посредников или предоплаченные карты. Как купить подписку на сервисы — рассказывали в гайде:

Но если возиться с оплатой не хочется, можно воспользоваться сервисами-посредниками, где в одном чате вы получаете доступ к лучшим на сегодня нейросетям: FLUX и DALL-E. Скоро появится возможность купить и Midjourney. Оплачивать подписки на такие сервисы можно российскими картами.

А чтобы наши подписчики экономили на подписках, мы договариваемся с разными ИИ-сервисами на скидки и бесплатные доступы. А в отдельной статье собираем все бонусы, которые есть сейчас.

Все о работе в Midjourney

Возможности Midjourney огромны, поэтому мы сделали несколько гайдов и рассказали обо всех фишках.

Например, в Midjourney есть параметры — короткие слова и аббревиатуры, которые добавляются в конец промпта. Их задача — улучшить картинку и сделать ее такой, какой вы хотите ее видеть. Если правильно использовать параметры, можно сильно улучшить качество генераций.

Кроме параметров есть команды, которые позволяют решать разные задачи: сохранять шаблоны, смешивать изображения или описывать понравившиеся картинки.

Еще одна классная функция Midjourney — редактор фото. Он поможет улучшить то, что нейронка уже сделала: приблизить/отдалить главный объект, расширить картинку, удалить/заменить какие-то объекты и др.

Как копировать стиль картинок

Частая задача — нарисовать несколько картинок в едином стиле.

В DALL-E есть несколько способов, которые помогут сделать это. Но каждый подойдет для разных задач: скопировать персонажа, стиль картинки, все сразу или общий принцип построения кадра. Эти методы вам пригодятся, если захотите сгенерировать несколько похожих картинок для статьи или презентации.

Картинки в едином стиле можно создавать и в Midjourney. При этом копировать можно отдельно персонажа или стиль окружения в целом.

Копировать стиль картинок в FLUX нельзя. Но можно пользоваться моделями, изначально заточенными под генерацию изображений в конкретных стилях. В отдельном гайде мы рассказали, как запустить нейронку, обучить ее на своих фотографиях и сгенерировать новые картинки.

Как работать с фотографиями реальных людей

Иногда нужно поместить себя в генерацию, сделать деловую фотосессию для сотрудников или сделать прикольного аватара. Пока что с этим справляются только 2 нейросети: Midjourney и FLUX. DALL-E обрабатывать реальные фотографии не умеет.

Лучше всего для работы с реальными лицами людей подходит FLUX. Там можно натренировать собственную модель на своих фото и получать картинки, где лицо не будет отличаться от оригинала. Но для этого придется найти от 12 до 20 фото-референсов и разобраться с обучением своей модели. На эту тему уже есть подробный гайд в Нейроцехе.

Если заморачиваться с обучением не хотите, можно сделать все в Midjourney. Но в этом случае не получится скопировать персонажа идеально. Нейронка не воссоздаст черты лица или проигнорирует реальную прическу людей. Но сам процесс работы будет проще, чем в FLUX.

Можно пойти дальше и сделать фото в прикольном стиле. Например, в анимешном или мультяшном.

А если нужно сгенерировать фото и подставить в него 2 лица сразу — поможет только Midjourney и функция —cref (она позволяет использовать в качестве референса ранее созданные изображения).

Как использовать нейронки в конкретных задачах

В нейронках можно делать крутые логотипы. Но есть большой минус — логотипы будут в jpg, png или webp формате. А чтобы все иконки красиво отображались на сайте, их нужно делать в SVG-формате.

Поэтому лучший способ сделать логотип — пользоваться нейросетями Recraft и Midjourney. Подробнее о генерации векторных картинок рассказали в отдельном гайде:

Еще одна популярная задача — сделать продуктовые фото товаров для WB, Ozon или других карточек товаров. Сгенерировать такие фото можно 2 способами:

  1. Простым и быстрым. Этот способ подойдет, если вы не хотите заморачиваться с генерацией окружения и заднего фона. Здесь достаточно загрузить в сервис фото своего товара, выбрать из предложенных место, где товар будет стоять, и сгенерировать новую картинку. А потом улучшить её качество.
  2. Сложным и долгим. Этот способ подойдет, если вы хотите сами сделать окружение и задний фон. Но подойдет способ только в том случае, если вы генерируете карточки для товаров, на упаковке которых нет надписей. Либо, если вы владеете фотошопом и можете нанести надписи после генерации. Все потому, что на этапе улучшения качества фото нейронка заменит буквы на нечитаемые иероглифы и предотвратить это никак нельзя.

Подборки готовых промптов

Кроме подробных гайдов в Нейроцехе есть сборники промтов. Это набор шаблонов, где вы можете скопировать нужный, поправить под себя и использовать в работе.

Здесь мы собрали самые крутые промпты для генерации картинок с примерами того, что может получиться. В основном все примеры сделаны в DALL-E. Но их можно повторить в Midjourney и FLUX.

В этот сборник вошли промпты:

  • Как оцифровать логотип в DALL-E.
  • Как стилизовать изображения в нейросетях.
  • Промпт, который поможет создать картинки для рекламы ваших продуктов.
  • Промпт для создания иллюстраций под формат векторных.
  • Промпт, который позволяет генерировать минималистичные мультяшные портреты.
  • Жизненный цикл развития в DALL-E.
  • Как рисовать картинки в DALL-E с одним персонажем.
  • Как нарисовать стикеры в DALL-E.
  • Как нарисовать иконки в DALL-E.
  • Как нарисовать объект в рамке с помощью DALL-E.
  • Как нарисовать любой объект в виде гирлянды в DALL-E.
  • Как нарисовать иконки разных профессий с помощью DALL-E.
  • Как нарисовать обложку для книги.
  • Как рисовать картинки в стиле старых видеоигр.
  • Как сгенерировать реалистичные фото будто на камеру смартфона.
  • Создаём рисунки карандашом в DALL-E.

0 комментариев
Старые
Новые Популярные