Генерация и редактирование картинок в GPT Image

Урок 26 из 299 курса «OpenAI Cookbook»: официальный курс OpenAI Academy (ОпенАИ) на русском языке. Урок входит в платный доступ; первые уроки курса бесплатно.

О чём урок

В этом руководстве вы узнаете, как использовать GPT Image, нашу новую большую языковую модель с возможностями генерации изображений. Эта модель обладает мировыми знаниями и может генерировать изображения, используя это широкое понимание мира. Она также значительно лучше следует инструкциям и создает фотореалистичные изображения по сравнению с нашими моделями изображений предыдущего поколения, DallE 2 и 3. Чтобы узнать больше о генерации изображений, обратитесь к нашему руководству. GPT Image 1 отлично следует инструкциям, это означает, что вы можете давать модели prompt'ы для генерации изображений с очень подробными инструкциями. Вы можете настроить следующие свойства output'а: Качество может быть low, medium, high или auto (значение по умолчанию) Размер может быть 1024x1024 (квадрат), 1536x1024 (портрет), 1024x1536 (пейзаж) или auto (по умолчанию) Вы можете настроить уровень сжатия (от 0 до 100%) для форматов JPEG и WEBP Вы можете выбрать генерацию изображения с прозрачным фоном (доступно только для PNG или WEBP) Вы можете использовать свойство background, чтобы запросить прозрачный фон, но если вы включите в свой prompt запрос на прозрачный фон, он будет установлен в transparent по умолчанию. GPT Image также может принимать изображения в качестве input'ов и использовать их для создания новых изображений. Вы также можете предоставить маску, если не хотите, чтобы модель изменяла определенную часть входного изображения. Вы можете использовать максимум 10 входных изображений, и если вы используете маску, она будет применена к первому изображению, предоставленному в массиве image. Вы также можете предоставить маску вместе с входными изображениями (если их несколько, маска будет применена к первому), чтобы редактировать только ту часть входного изображения, которая не покрыта маской. Обратите внимание, что модель может все же редактировать некоторые части изображения внутри маски, но будет стараться этого избегать. Важное примечание: маска должна содержать альфа-канал. Если вы генерируете ее вручную, например, с помощью программы для редактирования изображений, убедитесь, что вы включили этот альфа-канал.

План урока

  1. Настройка
  2. Генерация изображения
  3. Настройка output'а
  4. Прозрачный фон
  5. Редактирование изображений
  6. Редактирование изображения с помощью маски
  7. Генерация маски

Урок входит в полный доступ. Полный текст и видео открываются после оплаты. Первые уроки каждого курса бесплатны.

Урок входит в темы

Полезные гиды