Генерация картинок в нейросетях: с чего начать
Привет! У нас вышло уже немало гайдов, посвящённых генерации картинок. В этой статье мы расположили их в порядке, удобном для изучения. Начинаем с более простых вещей, дальше уходим в частные случаи.
Какой сервис выбрать и как зарегистрироваться
Самое главное в начале — выбрать нейросеть, зарегистрироваться в ней и оплатить подписку.
Сейчас есть 3 лучших нейросети для работы с картинками:
- DALL-E;
- FLUX;
- Midjourney.
Новичку проще всего будет начать с DALL-E, потому что он понимает запросы на русском языке и неплохо обрабатывает даже неструктированные промпты. Чтобы протестировать DALL-E, придется зарегистрироваться в ChatGPT и оплатить подписку. Как это сделать — рассказывали в отдельном гайде:
Когда зарегистрируетесь и оплатите подписку, сможете пользоваться DALL-E:
- создавать картинки по текстовому описанию;
- редактировать генерации во встроенном редакторе.
Когда использовать DALL-E. Когда хотите быстро создать картинку и вам не нужно что-то реалистичное. Лучше всего использовать DALL-E Для генерации логотипов, раскрасок, графики или надписей на английском.
DALL-E не генерирует реальных людей и персонажей из-за авторских прав. Вы не сможете создать портреты Илона Маска или Бэтмена в этой нейросети.
Еще нейросеть не генерирует изображения в стилях известных режиссеров, авторов, дизайнеров и художников, если авторские права на их работы не истекли (70 лет после смерти автора). Например, в стиле Ван Гога вы сможете создать изображение, а вот в стиле Энди Уорхола — нет.
Следующая нейронка — FLUX. Она генерирует фотореалистичные картинки и отлично чувствует промпты. Фишка в том, что у FLUX есть 3 разные модели, которые пригодятся для генерации разных картинок. Работает и стоит каждая модель по-разному:
- FLUX.1.1 pro — самая производительная версия, лучше всех понимает промпты и генерит отличные картинки на любые темы. Генерация 1 картинки стоит $0,05.
- FLUX.1 dev — еще одна модель нейросети. Работает также как и pro, только рассчитана на некоммерческое использование. Генерация 1 картинки стоит $0,03.
- FLUX.1 schnell — самая быстрая модель, которая генерирует картинки в более плохом качестве, чем предыдущие. Подойдет для создания логотипов, иконок с надписями. Генерация 1 картинки стоит $0,003.
Минус FLUX в том, что у нее нет веб-интерфейса. Вам придется запускать что-то вроде сервера на сторонних сайтах. Поэтому пользоваться ей не так удобно.
Когда использовать FLUX. Подойдет для любых целей: создания логотипов, иконок, реалистичных фото, портретов конкретных людей и т. д.
Подробнее о том, где найти FLUX и как с ней работать, читайте в этом гайде:
В гайде про FLUX мы несколько раз упоминаем платформу HuggingFace. На ней вы бесплатно можете запускать разные модели нейросетей и использовать их в работе. Как пользоваться платформой, читайте в отдельном гайде:
И последняя нейронка — Midjourney. У нее есть полезные функции, которые позволяют рисовать качественные картинки:
- инструменты для тонкой настройки промпта;
- функции для копирования стилей чужих работ;
- функции для копирования персонажей;
- инструменты для редактирования готовых фото.
Когда использовать Midjourney. Подойдет для любых целей: создания логотипов, иконок, реалистичных фото, генерации конкретных людей и т. д. Если часто работаете с фото — это один из лучших вариантов.
В Midjourney можно работать 2 способами: через Discord и веб-версию. Функции в интерфейсах не отличаются, но есть разница в самом интерфейсе. Чтобы разобраться во всем, читайте 2 подробных гайда:
Когда зарегистрируетесь в любом из сервисов, останется еще один важный этап — оплатить подписку. Сделать картами РФ и РБ это нельзя. Придется искать посредников или предоплаченные карты. Как купить подписку на сервисы — рассказывали в гайде:
Но если возиться с оплатой не хочется, можно воспользоваться сервисами-посредниками, где в одном чате вы получаете доступ к лучшим на сегодня нейросетям: FLUX и DALL-E. Скоро появится возможность купить и Midjourney. Оплачивать подписки на такие сервисы можно российскими картами.
А чтобы наши подписчики экономили на подписках, мы договариваемся с разными ИИ-сервисами на скидки и бесплатные доступы. А в отдельной статье собираем все бонусы, которые есть сейчас.
Все о работе в Midjourney
Возможности Midjourney огромны, поэтому мы сделали несколько гайдов и рассказали обо всех фишках.
Например, в Midjourney есть параметры — короткие слова и аббревиатуры, которые добавляются в конец промпта. Их задача — улучшить картинку и сделать ее такой, какой вы хотите ее видеть. Если правильно использовать параметры, можно сильно улучшить качество генераций.
Кроме параметров есть команды, которые позволяют решать разные задачи: сохранять шаблоны, смешивать изображения или описывать понравившиеся картинки.
Важно! Команды работают только в Discord-версии, если пользуетесь веб-версией, гайд можете пропускать.
Еще одна классная функция Midjourney — редактор фото. Он поможет улучшить то, что нейронка уже сделала: приблизить/отдалить главный объект, расширить картинку, удалить/заменить какие-то объекты и др.
Как копировать стиль картинок
Частая задача — нарисовать несколько картинок в едином стиле.
В DALL-E есть несколько способов, которые помогут сделать это. Но каждый подойдет для разных задач: скопировать персонажа, стиль картинки, все сразу или общий принцип построения кадра. Эти методы вам пригодятся, если захотите сгенерировать несколько похожих картинок для статьи или презентации.
Картинки в едином стиле можно создавать и в Midjourney. При этом копировать можно отдельно персонажа или стиль окружения в целом.
Копировать стиль картинок в FLUX нельзя. Но можно пользоваться моделями, изначально заточенными под генерацию изображений в конкретных стилях. В отдельном гайде мы рассказали, как запустить нейронку, обучить ее на своих фотографиях и сгенерировать новые картинки.
Как работать с фотографиями реальных людей
Иногда нужно поместить себя в генерацию, сделать деловую фотосессию для сотрудников или сделать прикольного аватара. Пока что с этим справляются только 2 нейросети: Midjourney и FLUX. DALL-E обрабатывать реальные фотографии не умеет.
Лучше всего для работы с реальными лицами людей подходит FLUX. Там можно натренировать собственную модель на своих фото и получать картинки, где лицо не будет отличаться от оригинала. Но для этого придется найти от 12 до 20 фото-референсов и разобраться с обучением своей модели. На эту тему уже есть подробный гайд в Нейроцехе.
Если заморачиваться с обучением не хотите, можно сделать все в Midjourney. Но в этом случае не получится скопировать персонажа идеально. Нейронка не воссоздаст черты лица или проигнорирует реальную прическу людей. Но сам процесс работы будет проще, чем в FLUX.
Можно пойти дальше и сделать фото в прикольном стиле. Например, в анимешном или мультяшном.
А если нужно сгенерировать фото и подставить в него 2 лица сразу — поможет только Midjourney и функция —cref (она позволяет использовать в качестве референса ранее созданные изображения).
Важно! Добиться 100%-ного повторения не получится. Особенно, если дело касается причесок. Также не получится сделать реалистичную фотографию на основе вашего референса. Пока что нейросеть не может обработать и вставить в генерацию существующего человека так, чтобы фотографию нельзя было отличить от реальной.
Как использовать нейронки в конкретных задачах
В нейронках можно делать крутые логотипы. Но есть большой минус — логотипы будут в jpg, png или webp формате. А чтобы все иконки красиво отображались на сайте, их нужно делать в SVG-формате.
Поэтому лучший способ сделать логотип — пользоваться нейросетями Recraft и Midjourney. Подробнее о генерации векторных картинок рассказали в отдельном гайде:
Еще одна популярная задача — сделать продуктовые фото товаров для WB, Ozon или других карточек товаров. Сгенерировать такие фото можно 2 способами:
- Простым и быстрым. Этот способ подойдет, если вы не хотите заморачиваться с генерацией окружения и заднего фона. Здесь достаточно загрузить в сервис фото своего товара, выбрать из предложенных место, где товар будет стоять, и сгенерировать новую картинку. А потом улучшить её качество.
- Сложным и долгим. Этот способ подойдет, если вы хотите сами сделать окружение и задний фон. Но подойдет способ только в том случае, если вы генерируете карточки для товаров, на упаковке которых нет надписей. Либо, если вы владеете фотошопом и можете нанести надписи после генерации. Все потому, что на этапе улучшения качества фото нейронка заменит буквы на нечитаемые иероглифы и предотвратить это никак нельзя.
Подборки готовых промптов
Кроме подробных гайдов в Нейроцехе есть сборники промтов. Это набор шаблонов, где вы можете скопировать нужный, поправить под себя и использовать в работе.
Здесь мы собрали самые крутые промпты для генерации картинок с примерами того, что может получиться. В основном все примеры сделаны в DALL-E. Но их можно повторить в Midjourney и FLUX.
В этот сборник вошли промпты:
- Как оцифровать логотип в DALL-E.
- Как стилизовать изображения в нейросетях.
- Промпт, который поможет создать картинки для рекламы ваших продуктов.
- Промпт для создания иллюстраций под формат векторных.
- Промпт, который позволяет генерировать минималистичные мультяшные портреты.
- Жизненный цикл развития в DALL-E.
- Как рисовать картинки в DALL-E с одним персонажем.
- Как нарисовать стикеры в DALL-E.
- Как нарисовать иконки в DALL-E.
- Как нарисовать объект в рамке с помощью DALL-E.
- Как нарисовать любой объект в виде гирлянды в DALL-E.
- Как нарисовать иконки разных профессий с помощью DALL-E.
- Как нарисовать обложку для книги.
- Как рисовать картинки в стиле старых видеоигр.
- Как сгенерировать реалистичные фото будто на камеру смартфона.
- Создаём рисунки карандашом в DALL-E.